Die vorliegende Übersetzung wurde maschinell erstellt. Im Falle eines Konflikts oder eines Widerspruchs zwischen dieser übersetzten Fassung und der englischen Fassung (einschließlich infolge von Verzögerungen bei der Übersetzung) ist die englische Fassung maßgeblich.
Größe 4,6
XaI — Gork 46.
Modelldetails
Grok 4.6 ist das Pioniermodell von Xai, das für Programmieren, Agentenaufgaben und Wissensarbeit entwickelt wurde. Es baut auf früheren Generationen von Grok auf und konzentriert sich besonders auf Langzeitagenten und anspruchsvollere interaktive Arbeit. Es bietet ein Kontext-Fenster von 500K und einen konfigurierbaren Denkansatz (niedrig, mittel, hoch, xhigh).
Startdatum des Modells: 18. August 2026
EOL frühestens: 18. August 2027
Legacy-Zeitraum: mindestens 6 Monate
Richtlinie zum Modelllebenszyklus: Modelllebenszyklus (für Modelle, die vor dem 7. September 2026 auf den Markt gebracht wurden)
EOL-Datum des Modells: N/A
Endbenutzer-Lizenzverträge und Nutzungsbedingungen: Ansehen https://aws.amazon.com/legal/bedrock/third-party-models/
Lebenszyklus des Modells: Aktiv
Kontextfenster: 500.000 Token
Begründung: Unterstützt (konfigurierbar: niedrig, mittel, hoch, xhigh)
| Eingabemodalitäten | Modalitäten der Ausgabe | Unterstützte APIs | Unterstützte Endpunkte |
|---|---|---|---|
Responses | bedrock-runtime | ||
Chat Completions | bedrock-mantle | ||
Converse | |||
Invoke | |||
Fähigkeiten und Funktionen
Funktionen von Bedrock
Funktionen, die mithilfe bedrock-runtime von Endpoint unterstützt werden
| Unterstützt | Nicht unterstützt |
|---|---|
|
Funktionen, die mithilfe von bedrock-mantle Endpoint unterstützt werden
| Unterstützt | Nicht unterstützt |
|---|---|
|
|
Preisgestaltung
| Option „Inferenz“ | Eingabe | Ausgabe | Cache gelesen |
|---|---|---|---|
| In-Region | 2,20$ | 6,60$ | 0,55$ |
| GEO CRIS | 2,20$ | 6,60$ | 0,55$ |
| Globales CRIS | 2,00$ | 6,00$ | 0,50$ |
Alle Preise verstehen sich pro 1 Million Token. Die angegebenen Preise beziehen sich auf die Standard-Stufe.
Priority- und Flex-Tier-Support: Zusätzlich zu Standard unterstützt Grok 4.6 die Servicestufen Priority und Flex. Priority wird zum 1,75-fachen des Standardtarifs pro Token (eine Prämie von 75%) und für Flex zum 0,5-fachen des Standardtarifs (ein Rabatt von 50%) in Rechnung gestellt. Wenden Sie diese Multiplikatoren auf die oben angegebenen Standardtarife an. Einzelheiten zu den einzelnen Servicestufen finden Sie unter Servicestufen. service-tiers-inference.html
Programmatischer Zugriff
Verwenden Sie die folgenden Modell-IDs und Endpunkt-URLs, um programmgesteuert auf dieses Modell zuzugreifen. Weitere Informationen zu den verfügbaren APIs und Endpunkten finden Sie unter Unterstützte APIs und Unterstützte Endpunkte.
| Endpunkt | Modell-ID | In-Region URL des Endpunkts | Geoinferenz-ID | Globale Inferenz-ID |
|---|---|---|---|---|
bedrock-mantle |
xai.grok-4.6 |
https://bedrock-mantle.{region}.api.aws/openai/v1 |
Nicht unterstützt | Nicht unterstützt |
bedrock-runtime |
xai.grok-4.6 |
Nicht unterstützt | us.xai.grok-4.6 |
global.xai.grok-4.6 |
Wenn die Region beispielsweise US-West-2 (Oregon) ist, lautet die Bedrock-Mantle-Endpunkt-URL "“. https://bedrock-mantle.us-west-2.api.aws/openai/v1 Aufbedrock-runtime, die Basis-URL lautet "https://bedrock-runtime.{region} .amazonaws. com/openai/v1 "und Anfragen müssen die geografische regionsübergreifende Inferenz-ID us.xai.grok-4.6 oder als Modell angeben. global.xai.grok-4.6
Servicestufen
Amazon Bedrock bietet mehrere Servicestufen, um Ihren Workload-Anforderungen gerecht zu werden. Standard bietet Pay-per-Token-Zugriff ohne Verpflichtung (setzen Sie das Feld ein "service_tier": "default" oder lassen Sie es weg). Priority bietet eine schnellere, priorisierte Verarbeitung gegen einen Preisaufschlag (Set). "service_tier": "priority" Flex bietet kostengünstigen Zugriff auf flexible, nicht zeitkritische Workloads (Set). "service_tier": "flex" Weitere Informationen finden Sie unter Servicestufen. service-tiers-inference.html
| Standard | Priorität | Flex | Reserviert |
|---|---|---|---|
Regionale Verfügbarkeit
Regionale Verfügbarkeit auf einen Blick
Amazon Bedrock bietet drei Ableitungsoptionen: In-Region Es werden Anfragen innerhalb einer einzigen Region zur strikten Einhaltung der Vorschriften gespeichert, Cross-Region Geo-Routen zwischen Regionen innerhalb einer Region (z. B. USA, EU und APAC) unter Berücksichtigung der Datenresidenz, und globale Cross-Region Routen überall auf der Welt, wenn keine Wohnsitzbeschränkungen bestehen. Weitere Informationen finden Sie auf der SeiteRegionale Verfügbarkeit nach Modellen.
Die Verfügbarkeit ist je nach Endpunkt unterschiedlich.
Verfügbarkeit unter Verwendung des bedrock-mantle Endpunkts
| Region | In-Region | Geo | Global |
|---|---|---|---|
us-west-2(Oregon) | |||
us-gov-east-1(GovCloud Ost) |
Verfügbarkeit mithilfe des bedrock-runtime Endpunkts
| Region | In-Region | Geo | Global |
|---|---|---|---|
us-east-1(Nord-Virginia) | |||
us-east-2(Ohio) | |||
us-west-1(Nordkalifornien) | |||
us-west-2(Oregon) | |||
us-gov-west-1(GovCloud Westen) | |||
us-gov-east-1(GovCloud Ost) | |||
ca-central-1(Kanada) | |||
ca-west-1(Calgary) | |||
eu-central-1(Frankfurt) | |||
eu-central-2(Zürich) | |||
eu-north-1(Stockholm) | |||
eu-south-1(Mailand) | |||
eu-south-2(Spanien) | |||
eu-west-1(Irland) | |||
eu-west-2(London) | |||
eu-west-3(Paris) | |||
ap-east-2(Taipeh) | |||
ap-northeast-1(Tokio) | |||
ap-northeast-2(Seoul) | |||
ap-northeast-3(Ōsaka) | |||
ap-south-1(Mumbai) | |||
ap-south-2(Hyderabad) | |||
ap-southeast-1(Singapur) | |||
ap-southeast-2(Sydney) | |||
ap-southeast-3(Jakarta) | |||
ap-southeast-4(Melbourne) | |||
ap-southeast-5(Malaysien) | |||
ap-southeast-6(Neuseeland) | |||
ap-southeast-7(Thailand) | |||
il-central-1(Tel Aviv) | |||
me-central-1(VAE) | |||
me-south-1(Bahrein) | |||
af-south-1(Kapstadt) | |||
sa-east-1(São Paulo) |
Kontingente und Einschränkungen
Ihr AWS Konto verfügt über Standardkontingente, um die Leistung des Dienstes aufrechtzuerhalten und eine angemessene Nutzung von Amazon Bedrock sicherzustellen. Die einem Konto zugewiesenen Standardkontingente können je nach regionalen Faktoren, Zahlungsverlauf, betrügerischer Nutzung und and/or Genehmigung einer Anfrage zur Kontingenterhöhung aktualisiert werden. Weitere Informationen finden Sie in der Kontingente für Amazon Bedrock Dokumentation und in den Grenzwerten für das Modell.
Beispiel-Code
Schritt 1 — AWS Konto: Wenn Sie bereits ein AWS Konto haben, überspringen Sie diesen Schritt. Wenn Sie neu bei uns sind AWS, registrieren Sie sich für ein AWS-Konto
Schritt 2 — API-Schlüssel: Gehen Sie zur Amazon Bedrock-Konsole
Anmerkung
Grok 4.6 ist ein XAPI-Modell. Amazon Bedrock stellt seine APIs für Antworten und Chat-Abschlüsse über OpenAI-compatible Endpunkte bereit, sodass in diesen Beispielen das OpenAI Python SDK als Client verwendet wird. Konfigurieren Sie das SDK mit Ihrem Amazon Bedrock-API-Schlüssel und einer Amazon Bedrock-Basis-URL, wie unten dargestellt. Die Anfragen rufen das xAI-Modell auf Amazon Bedrock auf und werden nicht an OpenAI gesendet.
Schritt 3 — Holen Sie sich das SDK: Um dieses Handbuch für die ersten Schritte verwenden zu können, muss Python bereits installiert sein. Installieren Sie dann die entsprechende Software je nach den von Ihnen verwendeten APIs.
Schritt 4 — Umgebungsvariablen festlegen: Konfigurieren Sie Ihre Umgebung so, dass der API-Schlüssel für die Authentifizierung verwendet wird.
Anmerkung
Aktiviertbedrock-runtime, benennen Sie ein regionsübergreifendes Inferenzprofil als Modell — us.xai.grok-4.6 oder. global.xai.grok-4.6 Dieses Modell ist für regionsinterne Inferenz an diesem Endpunkt nicht verfügbar. Ihre IAM-Identität muss zusätzlich bedrock:InvokeModel zum Inferenzprofil auch im Standardprojekt (arn:aws:bedrock:{region}:{account-id}:project/default) Ihres Kontos enthalten sein.
Schritt 5 — Führen Sie Ihre erste Inferenzanfrage aus: Speichern Sie die Datei unter bedrock-first-request.py
Überlegungen und Einschränkungen bei der Verwendung
Argumentationsaufwand — Die Argumentation ist standardmäßig immer aktiv. Sie können den Aufwand mithilfe der folgenden
reasoningParameter konfigurieren:"low"(Standard),"medium""high", oder."xhigh"Der Inhalt der Argumentation ist verschlüsselt und kann zurückgegeben werden, indem die Responses API-Anforderung übergebeninclude: ["reasoning.encrypted_content"]wird. Sie können den verschlüsselten Inhalt in aufeinanderfolgenden Runden zurücksenden, um den Argumentationskontext für Konversationen mit mehreren Runden bereitzustellen. Die Chat Completions API gibt keine Argumentations-Tokens zurück.response = client.responses.create( model="us.xai.grok-4.6", reasoning={"effort": "high"}, include=["reasoning.encrypted_content"], input="Explain quantum entanglement simply." ) print(response.output_text)