Les traductions sont fournies par des outils de traduction automatique. En cas de conflit entre le contenu d'une traduction et celui de la version originale en anglais, la version anglaise prévaudra.
GPT-5.6 Luna
OpenAI — Lune GPT-5.6
Détails du modèle
GPT-5.6 Luna est le modèle rapide et abordable d'OpenAI. Utilisez Luna pour les tâches d'inférence à volume élevé telles que la classification, le résumé, le routage et les applications en temps réel où la latence et le coût par jeton sont les plus importants. Pour plus d'informations sur le développement et les performances des modèles, consultez la model/service fiche
Date de lancement du modèle : 13 juillet 2026
EOL au plus tôt : 13 juillet 2027
Période d'héritage : au moins 6 mois
Politique de cycle de vie des modèles : cycle de vie des modèles (pour les modèles lancés avant le 7 septembre 2026)
Date de fin de vie du modèle : N/A
Contrats de licence utilisateur final et conditions d'utilisation : Afficher
Cycle de vie du modèle : actif
Fenêtre contextuelle : 1 million de jetons
Identifiant du produit Marketplace :
prod-bpeu2ptegwjfa
| Modalités de saisie | Modalités de sortie |
|---|---|
Endpoints et API pris en charge
Les tableaux suivants indiquent quels points de terminaison et quelles API sont pris en charge pour GPT-5.6 Luna. Pour plus d’informations, consultez API prises en charge par Amazon Bedrock et Points de terminaison pris en charge par Amazon Bedrock.
Prise en charge des terminaux
| Point de terminaison | Supporté |
|---|---|
bedrock-runtime |
|
bedrock-mantle |
API prises en charge sur les bedrock-runtime terminaux
| Messages | Réponses | Achèvement du chat | Converse | Invoke |
|---|---|---|---|---|
API prises en charge sur les bedrock-mantle terminaux
| Messages | Réponses | Achèvement du chat | Converse | Invoke |
|---|---|---|---|---|
Note
Activébedrock-mantle, les deux API utilisent le chemin /openai/v1 de base, mais non/v1. Utilisez l'une ou l'autre des API avec ce modèle :
Pour les réponses, utilisez
/openai/v1/responses.Pour compléter le chat, utilisez
/openai/v1/chat/completions.
Astuce
Dans la mesure du possible, nous vous recommandons d'utiliser le bedrock-runtime terminal pour les nouvelles applications. Consultez Points de terminaison pris en charge par Amazon Bedrock pour plus de détails.
Capacités et fonctionnalités
Caractéristiques de Bedrock
Fonctionnalités prises en charge via bedrock-runtime Endpoint
| Supporté | Non pris en charge |
|---|---|
|
Fonctionnalités prises en charge via bedrock-mantle Endpoint
| Supporté | Non pris en charge |
|---|---|
|
|
Tarification
Tous les prix sont en dollars américains pour 1 million de jetons pour le niveau Standard.
In-Region Les prix commerciaux incluent des frais de 10 % par rapport aux tarifs OpenAI. Vous n'avez pas besoin d'ajouter ces frais.
Les niveaux Priority et Flex ne sont pas pris en charge pour ce modèle.
Régions commerciales : contexte court (272 000 jetons d'entrée ou moins)
| Option d'inférence | Entrée | Entrée : 30 Mo de cache (écriture) | Entrée — lecture du cache | Sortie |
|---|---|---|---|---|
| In-Region | 0,22$ | 0,275$ | 0,022$ | 1,32$ |
| Géo CRIS | 0,22$ | 0,275$ | 0,022$ | 1,32$ |
| CRIS mondial | 0,20$ | 0,25$ | 0,02$ | 1,20$ |
Régions commerciales — contexte long (plus de 272 000 jetons d'entrée)
| Option d'inférence | Entrée | Entrée : 30 Mo de cache (écriture) | Entrée — lecture du cache | Sortie |
|---|---|---|---|---|
| In-Region | 0,44$ | 0,55$ | 0,044$ | 1,98$ |
| Géo CRIS | 0,44$ | 0,55$ | 0,044$ | 1,98$ |
| CRIS mondial | 0,40$ | 0,50$ | 0,04$ | 1,80$ |
AWS GovCloud (US-East et US-West)
Contexte court (272 000 jetons d'entrée ou moins)
| Option d'inférence | Entrée | Entrée : 30 Mo de cache (écriture) | Entrée — lecture du cache | Sortie |
|---|---|---|---|---|
| In-Region | 0,264$ | 0,33$ | 0,0264$ | 1,584$ |
Contexte long (plus de 272 000 jetons d'entrée)
| Option d'inférence | Entrée | Entrée : 30 Mo de cache (écriture) | Entrée — lecture du cache | Sortie |
|---|---|---|---|---|
| In-Region | 0,528$ | 0,66$ | 0,0528$ | 2,376$ |
Accès programmatique
Utilisez les ID de modèle et les URL de point de terminaison suivants pour accéder à ce modèle par programmation. Pour plus d'informations sur les API et les points de terminaison disponibles, consultez les sections API prises en charge et Points de terminaison pris en charge.
| Point de terminaison | ID du modèle | In-Region URL du terminal | ID d'inférence géographique | ID d'inférence global |
|---|---|---|---|---|
bedrock-mantle |
openai.gpt-5.6-luna |
https://bedrock-mantle.{region}.api.aws/openai/v1 |
Non pris en charge | Non pris en charge |
bedrock-runtime |
openai.gpt-5.6-luna |
Non pris en charge | us.openai.gpt-5.6-lunadans le secteur commercial Régions AWS, in.openai.gpt-5.6-luna dans les régions de l'Inde |
global.openai.gpt-5.6-luna |
Par exemple, si la région est us-east-1 (Virginie du Nord), l'URL du point de terminaison du manteau rocheux sera « ». https://bedrock-mantle.us-east-1.api.aws/openai/v1 Surbedrock-runtime, l'URL de base est "https://bedrock-runtime.{region} .amazonaws. com/openai/v1 "et les demandes doivent désigner l'ID d'inférence géographique interrégional us.openai.gpt-5.6-luna comme modèle.
Niveaux de service
Amazon Bedrock propose plusieurs niveaux de service pour répondre à vos exigences en matière de charge de travail. Standard fournit un accès au paiement par jeton sans engagement (définissez "service_tier": "default" ou omettez le champ). Priority offre les temps de réponse les plus rapides pour un prix plus élevé (fixe"service_tier": "priority"). Flex fournit un accès à moindre coût pour des charges de travail flexibles et non sensibles au facteur temps (set). "service_tier": "flex" Reserved fournit un débit dédié assorti d'un engagement à terme pour des charges de travail prévisibles ; il est défini au niveau du compte plutôt que par demande (contactez l'équipe responsable de votre compte AWS pour l'activer). Pour plus d'informations, consultez la section Niveaux de service.
| Standard | Priorité | Flexible | Réservé |
|---|---|---|---|
Disponibilité par région
La disponibilité régionale en un coup d'œil
Amazon Bedrock propose trois options d'inférence : In-Region conserve les demandes dans une seule région pour des raisons de stricte conformité, géolocalise Cross-Region les itinéraires entre les régions d'une même zone géographique (comme les États-Unis, l'UE et l'APAC) tout en respectant la résidence des données, et les Cross-Region itinéraires mondiaux partout dans le monde lorsqu'il n'y a aucune contrainte de résidence. Consultez la Disponibilité régionale par modèle page pour plus de détails.
La disponibilité varie selon le terminal.
Disponibilité à l'aide du bedrock-mantle terminal
| Région | In-Region | Géo | Solution internationale |
|---|---|---|---|
us-east-1(Virginie du Nord) | |||
us-east-2(Ohio) | |||
us-west-2(Oregon) | |||
us-gov-west-1(GovCloud Ouest) | |||
us-gov-east-1(GovCloud Est) |
Disponibilité à l'aide du bedrock-runtime terminal
| Région | In-Region | Géo | Solution internationale |
|---|---|---|---|
us-east-1(Virginie du Nord) | |||
us-east-2(Ohio) | |||
us-west-1(Californie du Nord) | |||
us-west-2(Oregon) | |||
ca-central-1(Canada) | |||
ca-west-1(Calgary) | |||
eu-central-1(Francfort) | |||
eu-central-2(Zürich) | |||
eu-north-1(Stockholm) | |||
eu-south-1(Milan) | |||
eu-south-2(Espagne) | |||
eu-west-1(Irlande) | |||
eu-west-2(Londres) | |||
eu-west-3(Paris) | |||
ap-east-2(Taipei) | |||
ap-northeast-1(Tōkyō) | |||
ap-northeast-2(Séoul) | |||
ap-northeast-3(Osaka) | |||
ap-south-1(Bombay) | |||
ap-south-2(Hyderabad) | |||
ap-southeast-1(Singapour) | |||
ap-southeast-2(Sydney) | |||
ap-southeast-3(Jakarta) | |||
ap-southeast-4(Melbourne) | |||
ap-southeast-5(Malaisie) | |||
ap-southeast-6(Nouvelle-Zélande) | |||
ap-southeast-7(Thaïlande) | |||
il-central-1(Tel-Aviv) | |||
me-central-1(Émirats arabes unis) | |||
me-south-1(Bahreïn) | |||
af-south-1(Le Cap) | |||
sa-east-1(São Paulo) |
Quotas et limites
Votre AWS compte possède des quotas par défaut afin de maintenir les performances du service et de garantir une utilisation appropriée d'Amazon Bedrock. Les quotas par défaut attribués à un compte peuvent être mis à jour en fonction de facteurs régionaux, de l'historique des paiements, d'une utilisation frauduleuse ou de and/or l'approbation d'une demande d'augmentation de quota. Pour plus d'informations, consultez Quotas pour Amazon Bedrock la documentation et consultez les limites du modèle.
Sur le bedrock-runtime terminal, les limites sont gérées sous forme de jetons par minute (TPM) avec un taux de combustion de 10 fois, où 1 jeton de sortie consomme 10 jetons.
Exemple de code
Étape 1 - AWS Compte : Si vous avez déjà un AWS compte, ignorez cette étape. Si vous êtes nouveau sur AWS AWS, créez un compte AWS
Étape 2 - Clé API : Accédez à la console Amazon Bedrock
Étape 3 - Téléchargez le SDK : pour utiliser ce guide de démarrage, Python doit déjà être installé. Installez ensuite le logiciel approprié en fonction des API que vous utilisez.
Pour les deux API, choisissez l'onglet OpenAI SDK.
Étape 4 - Définir les variables d'environnement
Configurez votre environnement pour utiliser la clé API pour l'authentification.
Note
Activébedrock-runtime, nommez un profil d'inférence interrégional comme modèle — us.openai.gpt-5.6-luna ou. global.openai.gpt-5.6-luna Ce modèle n'est pas disponible pour l'inférence intra-région sur ce point final. Votre identité IAM doit également figurer bedrock:InvokeModel sur le projet par défaut de votre compte (arn:aws:bedrock:{region}:{account-id}:project/default) en plus du profil d'inférence.
Étape 5 - Exécutez votre première demande d'inférence
Enregistrez le fichier sous bedrock-first-request.py
manteau rocheux
Utilisez les paramètres de l'étape 4 - Définir les variables d'environnement. Cliquez sur l'onglet bedrock-mantle. L'onglet Chat utilise l'API Chat Completions.
bedrock-runtime : SDK OpenAI
Utilisez les paramètres de l'étape 4 - Définir les variables d'environnement. Cliquez sur l'onglet bedrock-runtime. Envoyez votre demande via l'API Responses.