View a markdown version of this page

Adaptives Denken - Amazon Bedrock

Die vorliegende Übersetzung wurde maschinell erstellt. Im Falle eines Konflikts oder eines Widerspruchs zwischen dieser übersetzten Fassung und der englischen Fassung (einschließlich infolge von Verzögerungen bei der Übersetzung) ist die englische Fassung maßgeblich.

Adaptives Denken

Adaptives Denken ist die empfohlene Methode zur Verwendung Erweitertes Denken mit Claude Opus 4.6. Anstatt manuell ein Budget für Denkmuster festzulegen, können wir bei adaptivem Denken anhand der Komplexität jeder Anfrage Claude dynamisch entscheiden, wann und wie viel nachgedacht werden soll. Adaptives Denken führt zuverlässig zu einer besseren Leistung als erweitertes Denken mit einem festen Wert. Wir empfehlen daherbudget_tokens, auf adaptives Denken umzusteigen, um die intelligentesten Antworten von Claude Opus 4.6 zu erhalten. Es ist kein Beta-Header erforderlich.

Es werde folgende Modelle unterstützt:

Modell Modell-ID

Claude, Opus 5

anthropic.claude-opus-5

Claude Mythos 5

anthropic.claude-mythos-5

Claude Fable 5

anthropic.claude-fable-5

Claude Opus4.7

anthropic.claude-opus-4-7

Claude Mythos Vorschau

anthropic.claude-mythos-preview

Claude Opus4.6

anthropic.claude-opus-4-6-v1

Claude Sonett 4.6

anthropic.claude-sonnet-4-6

Anmerkung

Claude Mythos 5, Claude Fable 5, Claude Opus 4.7 und Claude Mythos Preview unterstützen nur adaptives Denken. Manuelles erweitertes Denken (thinking.type: "enabled"mitbudget_tokens) und deaktiviertes Denken (thinking.type: "disabled") werden auf diesen Modellen nicht unterstützt und geben den Fehler 400 zurück. Verwenden Sie thinking.type: "adaptive" withoutput_config.effort, um das Denkverhalten zu kontrollieren.

thinking.type: "enabled"und budget_tokens sind in Claude Opus 4.6 und Claude Sonnet 4.6 veraltet und werden in einer zukünftigen Modellversion entfernt. Verwenden Sie stattdessen thinking.type: "adaptive" den Effort-Parameter.

Ältere Modelle (Claude Sonnet 4.5, Claude Opus 4.5 usw.) unterstützen adaptives Denken nicht und erfordern thinking.type: "enabled" Mitarbeitbudget_tokens.

Wie funktioniert adaptives Denken

ClaudeEvaluiert im adaptiven Modus die Komplexität jeder Anfrage und entscheidet, ob und wie viel nachgedacht werden soll. ClaudeWird bei der Standardaufwandsstufe (high) fast immer nachdenken. Bei niedrigerem Aufwand überspringt Claude möglicherweise das Denken für einfachere Probleme.

Adaptives Denken ermöglicht dies ebenfalls automatischVerschachteltes Denken (Beta). Das bedeutet, dass zwischen den Toolaufrufen nachgedacht werden Claude kann, was es besonders effektiv für agentische Arbeitsabläufe macht.

Stellen Sie "adaptive" in thinking.type Ihrer API-Anfrage Folgendes ein:

CLI
aws bedrock-runtime invoke-model \ --model-id "us.anthropic.claude-opus-4-6-v1" \ --body '{ "anthropic_version": "bedrock-2023-05-31", "max_tokens": 16000, "thinking": { "type": "adaptive" }, "messages": [ { "role": "user", "content": "Three players A, B, C play a game. Each has a jar with 100 balls numbered 1-100. Simultaneously, each draws one ball. A beats B if As number > Bs number (mod 100, treating 100 as 0 for comparison). Similarly for B vs C and C vs A. The overall winner is determined by majority of pairwise wins (ties broken randomly). Is there a mixed strategy Nash equilibrium where each player draws uniformly? If not, characterize the equilibrium." } ] }' \ --cli-binary-format raw-in-base64-out \ output.json && cat output.json | jq '.content[] | {type, thinking: .thinking[0:200], text}'
Python
import boto3 import json bedrock_runtime = boto3.client( service_name='bedrock-runtime', region_name='us-east-2' ) response = bedrock_runtime.invoke_model( modelId="us.anthropic.claude-opus-4-6-v1", body=json.dumps({ "anthropic_version": "bedrock-2023-05-31", "max_tokens": 16000, "thinking": { "type": "adaptive" }, "messages": [{ "role": "user", "content": "Explain why the sum of two even numbers is always even." }] }) ) response_body = json.loads(response["body"].read()) for block in response_body["content"]: if block["type"] == "thinking": print(f"\nThinking: {block['thinking']}") elif block["type"] == "text": print(f"\nResponse: {block['text']}")
TypeScript
import { BedrockRuntimeClient, InvokeModelCommand } from "@aws-sdk/client-bedrock-runtime"; async function main() { const client = new BedrockRuntimeClient({}); const command = new InvokeModelCommand({ modelId: "us.anthropic.claude-opus-4-6-v1", body: JSON.stringify({ anthropic_version: "bedrock-2023-05-31", max_tokens: 16000, thinking: { type: "adaptive" }, messages: [{ role: "user", content: "Explain why the sum of two even numbers is always even." }] }) }); const response = await client.send(command); const responseBody = JSON.parse(new TextDecoder().decode(response.body)); for (const block of responseBody.content) { if (block.type === "thinking") { console.log(`\nThinking: ${block.thinking}`); } else if (block.type === "text") { console.log(`\nResponse: ${block.text}`); } } } main().catch(console.error);

Adaptives Denken mit dem Aufwandsparameter

Sie können adaptives Denken mit dem Leistungsparameter kombinieren, um festzulegen, wie viel Denken erforderlich Claude ist. Das Aufwandsniveau dient als Orientierungshilfe für die Verteilung Claude des Denkens:

Aufwand-Ebene Denkverhalten
max Claudedenkt immer ohne Einschränkungen in der Denktiefe. Claude OpusNur 4.6 und Claude Opus 5 — Anfragen, die max auf anderen Modellen verwendet werden, geben einen Fehler zurück.
xhigh Claudedenkt immer mit erweiterter Tiefe. Nur Claude Opus 5 und Claude Opus 4.6.
high (Standard) Claudedenkt immer. Bietet fundierte Überlegungen zu komplexen Aufgaben.
medium Claudeverwendet gemäßigtes Denken. Kann bei sehr einfachen Abfragen das Nachdenken überspringen.
low Claudeminimiert das Denken. Überspringt das Denken für einfache Aufgaben, bei denen Geschwindigkeit am wichtigsten ist.
Wichtig

Der effort Parameter muss in einem separaten output_config Objekt in Ihrem Anforderungstext platziert werden — nicht innerhalb des thinking Objekts. Das Platzieren effort im Inneren thinking führt zu einemValidationException.

Wichtig

Leistungsobergrenze bei Denkschwäche (Claude Opus 5): Claude Opus 5 unterstützt"thinking": {"type": "disabled"}, aber wenn das Denken behindert ist, output_config.effort ist sie begrenzt auf. high Anfragen, bei denen xhigh unsere max Anstrengung und das Denken behindert sind, geben eine Antwort zurück. invalid_request_error Diese Obergrenze gilt auch für den Aufwand pro Runde, der durch eine Systemnachricht während der Konversation festgelegt wird. Um unseren max Aufwand zu nutzenxhigh, aktiviere adaptives Denken (Standardeinstellung) oder lasse den thinking Parameter ganz weg.

Das folgende Beispiel zeigt, wie das Aufwandsniveau bei Verwendung der InvokeModel API festgelegt wird:

{ "anthropic_version": "bedrock-2023-05-31", "max_tokens": 16000, "thinking": { "type": "adaptive" }, "output_config": { "effort": "high" }, "messages": [{ "role": "user", "content": "Your prompt here" }] }

Verwendung von adaptivem Denken mit der Converse-API

Wenn Sie die Converse-API verwenden, übergeben Sie die effort Parameter thinking und darin. additionalModelRequestFields Das folgende Beispiel zeigt adaptives Denken mit der Standardaufwandsstufe:

import boto3, json bedrock_runtime = boto3.client(service_name='bedrock-runtime', region_name='us-east-2') response = bedrock_runtime.converse( modelId="us.anthropic.claude-opus-4-6-v1", messages=[{ "role": "user", "content": [{"text": "Explain why the sum of two even numbers is always even."}] }], additionalModelRequestFields={ "thinking": { "type": "adaptive" } } ) print(json.dumps(response["output"], indent=2, default=str))

Um eine Aufwandsstufe anzugeben, fügen Sie das effort Feld in einem separaten output_config Objekt hinzu inadditionalModelRequestFields:

response = bedrock_runtime.converse( modelId="us.anthropic.claude-opus-4-6-v1", messages=[{ "role": "user", "content": [{"text": "What is 2 + 2?"}] }], additionalModelRequestFields={ "thinking": { "type": "adaptive" }, "output_config": { "effort": "low" } } )

Prompt-Caching

Bei aufeinanderfolgenden Anfragen, die adaptive Thinking verwenden, werden die Cache-Breakpoints der Aufforderung beibehalten. Beim Umschalten zwischen den Modi adaptive undenabled/disabledthinking werden jedoch die Cache-Breakpoints für Nachrichten unterbrochen. Systemaufforderungen und Werkzeugdefinitionen bleiben unabhängig von Modusänderungen zwischengespeichert.

Optimierung des Denkverhaltens

Wenn Claude Sie mehr oder weniger oft nachdenken, als Sie möchten, können Sie Ihrer Systemaufforderung eine Anleitung hinzufügen:

Extended thinking adds latency and should only be used when it will meaningfully improve answer quality — typically for problems that require multi-step reasoning. When in doubt, respond directly.
Warnung

Wenn Claude Sie weniger oft nachdenken, kann dies die Qualität von Aufgaben beeinträchtigen, bei denen logisches Denken von Vorteil ist. Messen Sie die Auswirkungen auf Ihre spezifischen Workloads, bevor Sie die zeitnahe Optimierung in der Produktion einsetzen. Erwägen Sie, zuerst mit geringerem Aufwand zu testen.

Zusammenfassung des Connector-Textes (Beta)

In Claude Fable 5 wird Text, den das Modell zwischen den Toolaufrufen ausgibt (manchmal auch als „Konnektortext“ bezeichnet — zum Beispiel „Lassen Sie mich die Datei als Nächstes überprüfen...“), serverseitig zusammengefasst und als Denkblock und nicht als reiner Text-Inhaltsblock zurückgegeben. Der Denkblock verwendet dieselbe Form wie jeder andere Denkblock (leerer Text mit einer Signatur unter der omitted Standardanzeige).

Auswirkung auf den Kunden:

  • Form der Antwort: Tool-use Die Antworten von Claude Fable 5 können zusätzliche Denkblöcke enthalten, bei denen frühere Modelle Klartext zwischen den tool_use Blöcken ausgegeben haben. Es gibt keinen neuen Inhaltsblocktyp. Die endgültigen Antworten des Assistenten (nachdem die gesamte Verwendung des Tools abgeschlossen ist) bleiben davon unberührt und bleiben im Klartext.

  • Multi-turn Bearbeitung: Geben Sie diese Denkblockaden in Gesprächen, die mehrere Runden lang sind, unverändert weiter — dieselbe Vorgehensweise wie bei geschütztem Denken (die Signatur wird bei der Weiterleitung validiert; wird stillschweigend entfernt, wenn sie an ein anderes Modell gesendet wird).

  • Umfang: Die Zusammenfassung des Connectors gilt erst, wenn eine tool_result in der Konversation existiert. Die Erzählung vor dem ersten Tool-Call in einer neuen Konversation bleibt im Klartext. Kurze Textsegmente können ohne Zusammenfassung als Klartext durchgehen.

Diese Funktion ist serverseitig für Claude Fable 5 aktiviert. Es gibt kein Opt-In oder Opt-Out für Kunden.