View a markdown version of this page

GPT-5.4 - Amazon Bedrock

Les traductions sont fournies par des outils de traduction automatique. En cas de conflit entre le contenu d'une traduction et celui de la version originale en anglais, la version anglaise prévaudra.

GPT-5.4

Icône représentant un motif circulaire avec des segments incurvés entrelacés formant un dessin de moulinet. OpenAI — GPT-5.4

Détails du modèle

GPT-5.4 apporte à Amazon Bedrock le raisonnement de pointe, le codage, l'utilisation de l'ordinateur, les flux de travail contextuels longs et l'utilisation d'outils. Il aide les développeurs à créer des applications d'IA et des flux de production capables d'interpréter le contexte, d'interagir avec les outils, d'exploiter des environnements logiciels et de vérifier les résultats en plusieurs étapes. GPT-5.4 convient parfaitement aux flux de travail professionnels qui nécessitent un raisonnement et une action fiables dans des systèmes métier complexes. Pour plus d'informations sur le développement et les performances des modèles, consultez la model/service fiche.

  • Date de lancement du modèle : 1er juin 2026

  • EOL au plus tôt le 1er juin 2027

  • Période d'héritage : au moins 6 mois

  • Politique de cycle de vie des modèles : cycle de vie des modèles (pour les modèles lancés avant le 7 septembre 2026)

  • Date de fin de vie du modèle : N/A

  • Contrats de licence utilisateur final et conditions d'utilisation : Afficher

  • Cycle de vie du modèle : actif

  • Fenêtre contextuelle : 1 million de jetons

  • Nombre maximum de jetons de sortie : N/A

  • Identifiant du produit Marketplace : prod-3bbohv3635iau

Modalités de saisie Modalités de sortie
Red circle with white X icon indicating error, cancel, or close action.AudioRed circle with white X icon indicating error, cancel, or close action.Intégration
Green circle with white checkmark icon.ImageRed circle with white X icon indicating error, cancel, or close action.Image
Red circle with white X icon indicating error, cancel, or close action.DiscoursRed circle with white X icon indicating error, cancel, or close action.Discours
Green circle with white checkmark icon.TexteGreen circle with white checkmark icon.Texte
Red circle with white X icon indicating error, cancel, or close action.VidéoRed circle with white X icon indicating error, cancel, or close action.Vidéo

Endpoints et API pris en charge

Les tableaux suivants indiquent pour quels points de terminaison et quelles API sont pris en charge GPT-5.4. Pour plus d’informations, consultez API prises en charge par Amazon Bedrock et Points de terminaison pris en charge par Amazon Bedrock.

Prise en charge des terminaux

Point de terminaison Supporté
bedrock-runtime not-supported
bedrock-mantle supported

API prises en charge sur les bedrock-runtime terminaux

Messages Réponses Achèvement du chat Converse Invoke
not-supported not-supported not-supported not-supported not-supported

API prises en charge sur les bedrock-mantle terminaux

Messages Réponses Achèvement du chat Converse Invoke
not-supported supported supported not-supported not-supported
Note

Activébedrock-mantle, les deux API utilisent le chemin /openai/v1 de base, mais non/v1. Utilisez l'une ou l'autre des API avec ce modèle :

  • Pour les réponses, utilisez/openai/v1/responses.

  • Pour compléter le chat, utilisez/openai/v1/chat/completions.

Capacités et fonctionnalités

Caractéristiques de Bedrock

Fonctionnalités prises en charge via bedrock-mantle Endpoint

Tarification

Tous les prix sont en dollars américains pour 1 million de jetons pour le niveau Standard.

In-Region Les prix commerciaux incluent des frais de 10 % par rapport aux tarifs OpenAI. Vous n'avez pas besoin d'ajouter ces frais.

Long-context les taux s'appliquent à tous les jetons d'entrée et de sortie, pas seulement aux jetons supérieurs à 272 000.

Les niveaux Priority et Flex ne sont pas pris en charge pour ce modèle.

Régions commerciales : contexte court (272 000 jetons d'entrée ou moins)

Option d'inférence Entrée Entrée : 30 Mo de cache (écriture) Entrée — lecture du cache Sortie
In-Region2,75$0,275$16,50$

Régions commerciales — contexte long (plus de 272 000 jetons d'entrée)

Option d'inférence Entrée Entrée : 30 Mo de cache (écriture) Entrée — lecture du cache Sortie
In-Region5,50$0,55$24,75$

AWS GovCloud (US-West) — contexte court (272 000 jetons d'entrée ou moins)

Option d'inférence Entrée Entrée : 30 Mo de cache (écriture) Entrée — lecture du cache Sortie
In-Region3,30$0,33$19,80$

Accès programmatique

Utilisez les ID de modèle et les URL de point de terminaison suivants pour accéder à ce modèle par programmation. Pour plus d'informations sur les API et les points de terminaison disponibles, consultez les sections API prises en charge et Points de terminaison pris en charge.

Point de terminaison ID du modèle In-Region URL du terminal ID d'inférence géographique ID d'inférence global
bedrock-mantle openai.gpt-5.4 https://bedrock-mantle.{region}.api.aws/openai/v1 Non pris en charge Non pris en charge

Par exemple, si la région est us-east-2 (Ohio), l'URL du point de terminaison du manteau rocheux sera « ». https://bedrock-mantle.us-east-2.api.aws/openai/v1

Niveaux de service

Amazon Bedrock propose plusieurs niveaux de service pour répondre à vos exigences en matière de charge de travail. Standard fournit un accès au paiement par jeton sans engagement (définissez "service_tier": "default" ou omettez le champ). Priority offre les temps de réponse les plus rapides pour un prix plus élevé (fixe"service_tier": "priority"). Flex fournit un accès à moindre coût pour des charges de travail flexibles et non sensibles au facteur temps (set). "service_tier": "flex" Reserved fournit un débit dédié assorti d'un engagement à terme pour des charges de travail prévisibles ; il est défini au niveau du compte plutôt que par demande (contactez l'équipe chargée de votre compte AWS pour l'activer). Pour plus d'informations, consultez la section Niveaux de service.

Standard Priorité Flexible Réservé
Green circle with white checkmark icon. Red circle with white X icon indicating error, cancel, or close action. Red circle with white X icon indicating error, cancel, or close action. Red circle with white X icon indicating error, cancel, or close action.

Disponibilité par région

La disponibilité régionale en un coup d'œil

Amazon Bedrock propose trois options d'inférence : In-Region conserve les demandes dans une seule région pour des raisons de stricte conformité, géolocalise Cross-Region les itinéraires entre les régions d'une même zone géographique (comme les États-Unis, l'UE et l'APAC) tout en respectant la résidence des données, et les Cross-Region itinéraires mondiaux partout dans le monde lorsqu'il n'y a aucune contrainte de résidence. Consultez la Disponibilité régionale par modèle page pour plus de détails.

La disponibilité varie selon le terminal.

Disponibilité à l'aide du bedrock-mantle terminal

Région In-Region Géo Solution internationale
us-east-1(Virginie du Nord)Green circle with white checkmark icon.Red circle with white X icon indicating error, cancel, or close action.Red circle with white X icon indicating error, cancel, or close action.
us-east-2(Ohio)Green circle with white checkmark icon.Red circle with white X icon indicating error, cancel, or close action.Red circle with white X icon indicating error, cancel, or close action.
us-west-2(Oregon)Green circle with white checkmark icon.Red circle with white X icon indicating error, cancel, or close action.Red circle with white X icon indicating error, cancel, or close action.
us-gov-west-1 (GovCloud)Green circle with white checkmark icon.Red circle with white X icon indicating error, cancel, or close action.Red circle with white X icon indicating error, cancel, or close action.

Quotas et limites

Votre AWS compte possède des quotas par défaut afin de maintenir les performances du service et de garantir une utilisation appropriée d'Amazon Bedrock. Les quotas par défaut attribués à un compte peuvent être mis à jour en fonction de facteurs régionaux, de l'historique des paiements, d'une utilisation frauduleuse ou de and/or l'approbation d'une demande d'augmentation de quota. Pour plus d'informations, consultez Quotas pour Amazon Bedrock la documentation et consultez les limites du modèle.

Exemple de code

Étape 1 - AWS Compte : Si vous avez déjà un AWS compte, ignorez cette étape. Si vous êtes nouveau sur AWS AWS, créez un compte AWS.

Étape 2 - Clé API : Accédez à la console Amazon Bedrock et générez une clé API à long terme.

Étape 3 - Téléchargez le SDK : pour utiliser ce guide de démarrage, Python doit déjà être installé. Installez ensuite le logiciel approprié en fonction des API que vous utilisez.

Pour les deux API, choisissez l'onglet OpenAI SDK.

OpenAI SDK
pip install openai

Étape 4 - Définir les variables d'environnement

Configurez votre environnement pour utiliser la clé API pour l'authentification.

bedrock-mantle
OPENAI_API_KEY="<provide your Bedrock API key>" OPENAI_BASE_URL="https://bedrock-mantle.us-west-2.api.aws/openai/v1"

Étape 5 - Exécutez votre première demande d'inférence

Enregistrez le fichier sous bedrock-first-request.py

manteau rocheux

Utilisez les paramètres de l'étape 4 - Définir les variables d'environnement. Cliquez sur l'onglet bedrock-mantle. L'onglet Chat utilise l'API Chat Completions.

Responses API
from openai import OpenAI client = OpenAI() response = client.responses.create( model="openai.gpt-5.4", input="Can you explain the features of Amazon Bedrock?" ) print(response)
Chat
from openai import OpenAI client = OpenAI() response = client.chat.completions.create( model="openai.gpt-5.4", messages=[{"role": "user", "content": "Can you explain the features of Amazon Bedrock?"}] ) print(response)