本文為英文版的機器翻譯版本,如內容有任何歧義或不一致之處,概以英文版為準。
適應性思維
自適應思考可讓 根據每個請求的複雜性Claude動態決定何時和多大的思考,而不需要固定的思維字符預算。其支援 Claude Fable 5.1、Claude Mythos 5.1、Claude Opus 5、Claude Sonnet 5 和其他具有思考能力的模型。與使用固定 的延伸思維相比,適應性思維可靠地驅動更好的效能budget_tokens。不需要 Beta 版標頭。
支援的模型如下:
| 模型 | 模型 ID |
|---|---|
Claude Fable 5.1 |
|
Claude Mythos 5.1 |
|
Claude Opus 5 |
|
Claude Sonnet 5 |
|
Claude Mythos 5 |
|
Claude Fable 5 |
|
Claude Opus 4.7 |
|
Claude Mythos 預覽 |
|
Claude Opus 4.6 |
|
Claude Sonnet 4.6 |
|
注意
Claude Fable 5.1、Claude Mythos 5.1、Claude Mythos 5、Claude Fable 5 和 Claude Mythos Preview 僅支援適應性思維。這些模型不支援手動延伸思考 (thinking.type: "enabled" 搭配 budget_tokens) 和停用思考 (thinking.type: "disabled"),並會傳回 400 錯誤。使用 thinking.type: "adaptive"搭配 output_config.effort來控制思考行為。
Claude Opus 4.7 支援適應性和已停用的思維。若要關閉思維,請使用 thinking.type: "disabled"。不支援手動延伸思考 (thinking.type: "enabled" 搭配 budget_tokens),並會傳回 400 錯誤。
thinking.type: "enabled" 和 budget_tokens 已在 Claude Opus 4.6 和 Claude Sonnet 4.6 上棄用,並將在未來的模型版本中移除。請改為使用 thinking.type: "adaptive"搭配 工作量參數。
較舊的模型 Claude Opus (Claude Sonnet 4.5、4.5 等) 不支援適應性思維,需要使用 thinking.type: "enabled" budget_tokens。
重要
根據預設,Claude Sonnet 5 和 Claude Opus 5 會開啟自適應思維。省略 thinking 欄位以適應性思維執行的請求。這是來自 Claude Sonnet 4.6 的變更,其中相同的請求執行時沒有考慮,因此從 Claude Sonnet 4.6 遷移而沒有變更的應用程式會產生思維輸出,並針對那些思維權杖作為輸出權杖計費,即使請求內文沒有變更。
若要完全關閉這些模型的思維,"thinking": {"type": "disabled"}請明確傳遞 。省略 thinking 欄位不會關閉思考,它會選擇適應性思考。將「無思維」表達為零或減少思維權杖預算的用戶端設定也不會將其關閉:Claude Sonnet 5 budget_tokens不支援 thinking.type: "enabled" 搭配 並傳回 ValidationException。只有明確disabled類型會關閉思考。
因為 max_tokens 是總輸出的硬性限制 - 思考加上回應文字 - max_tokens 重新檢視之前在未思考的情況下執行的工作負載。如果您在 Claude Sonnet 4.6 上使用已停用的思維,請考慮在 Claude Sonnet 5 上使用較低output_config.effort層級的適應性思維,而不是停用它。
適應性思維的運作方式
在自適應模式中, 會Claude評估每個請求的複雜性,並決定是否要考慮和考慮多少。在預設的工作量層級 (high) 中, 幾乎一律Claude會考慮。在較低的工作量層級, Claude 可能會略過思考更簡單的問題。
自適應思維也會自動啟用 交錯思考 (Beta 版)。這表示Claude可以在工具呼叫之間進行思考,讓它對客服人員工作流程特別有效。
在您的 API 請求"adaptive"中thinking.type將 設定為 :
使用工作量參數進行適應性思考
您可以將適應性思維與工作量參數結合,以引導思考Claude的進行程度。工作量層級可做為 思維配置Claude的軟性指引:
| 投入程度 | 思考行為 |
|---|---|
max |
Claude 一律在思考深度方面沒有限制的情況下思考。 Claude Opus4.6、Claude Sonnet 4.6 和 Claude Opus 5 支援 max。在不支援的模型max上使用 的請求會傳回錯誤。 |
xhigh |
Claude 一律以延伸深度思考。僅限 Claude Opus 5 和 Claude Opus 4.6。 |
high (default) |
Claude 一律會思考。提供複雜任務的深入推理。 |
medium |
Claude 使用中度思考。可能會略過思考非常簡單的查詢。 |
low |
Claude 將思維降至最低。跳過思考速度最重要的簡單任務。 |
重要
effort 參數必須放置在請求內文中的個別output_config物件內,而不是thinking物件內。放入 effort thinking 會導致 ValidationException。
重要
停用思維時的努力上限 (Claude Opus 5):Claude Opus 5 支援 "thinking": {"type": "disabled"},但在停用思維時,output_config.effort上限為 high。具有 xhigh或 max嘗試結合已停用思維的請求將傳回 invalid_request_error。此上限也適用於透過對話中系統訊息設定的每轉工作量。若要使用 xhigh或 max 工作,請啟用適應性思考 (預設) 或完全省略 thinking 參數。
下列範例示範如何在使用 InvokeModel API 時設定工作量等級:
{ "anthropic_version": "bedrock-2023-05-31", "max_tokens": 16000, "thinking": { "type": "adaptive" }, "output_config": { "effort": "high" }, "messages": [{ "role": "user", "content": "Your prompt here" }] }
搭配 Converse API 使用自適應思維
使用 Converse API 時,請在 內傳遞 thinking和 effort 參數additionalModelRequestFields。下列範例顯示具有預設工作量層級的適應性思維:
import boto3, json bedrock_runtime = boto3.client(service_name='bedrock-runtime', region_name='us-east-2') response = bedrock_runtime.converse( modelId="us.anthropic.claude-opus-4-6-v1", messages=[{ "role": "user", "content": [{"text": "Explain why the sum of two even numbers is always even."}] }], additionalModelRequestFields={ "thinking": { "type": "adaptive" } } ) print(json.dumps(response["output"], indent=2, default=str))
若要指定工作量層級,請在 中的個別output_config物件內新增 effort 欄位additionalModelRequestFields:
response = bedrock_runtime.converse( modelId="us.anthropic.claude-opus-4-6-v1", messages=[{ "role": "user", "content": [{"text": "What is 2 + 2?"}] }], additionalModelRequestFields={ "thinking": { "type": "adaptive" }, "output_config": { "effort": "low" } } )
設定每個回合的工作量 (測試版)
此功能是 AWS 服務條款中定義的 Beta 服務。在 Claude Fable 5.1 和 Claude Mythos 5.1 上,您可以透過對話中途變更工作量層級,而不是針對整個請求設定一次。插入在messages陣列中任何時間點攜帶output_config.effort值的系統訊息。新的工作量層級會套用至其後續的轉彎。請求會傳回 200,而不會變更回應形狀。
若要使用每轉努力,請包含下列其中一個anthropic_beta值:mid-conversation-output-config-2026-07-01、per-turn-control-2026-07-01、 mid-conversation-effort-2026-08-01或 per-message-effort-2026-07-01。
{ "anthropic_version": "bedrock-2023-05-31", "anthropic_beta": ["mid-conversation-effort-2026-08-01"], "max_tokens": 16000, "output_config": {"effort": "high"}, "messages": [ {"role": "user", "content": "First question"}, {"role": "assistant", "content": "First answer"}, {"role": "system", "content": [], "output_config": {"effort": "low"}}, {"role": "user", "content": "A simpler follow-up question"} ] }
注意
如果沒有列出的其中一個 Beta 值,或在不支援每一回合工作的模型上,系統訊息output_config中包含 的請求會傳回 400 messages.N.output_config: Extra inputs are not permitted。task_budget 不支援每圈,也會傳回 400。
提示快取
使用adaptive思維的連續請求會保留提示快取中斷點。不過,在 adaptive和 enabled/disabled 思維模式之間切換會中斷訊息的快取中斷點。無論模式變更為何,系統提示和工具定義都會保持快取。
調校思考行為
如果 Claude 的思考頻率高於或低於您想要的頻率,您可以在系統提示中新增指引:
Extended thinking adds latency and should only be used when it will meaningfully improve answer quality — typically for problems that require multi-step reasoning. When in doubt, respond directly.
警告
轉向不常Claude思考可能會降低受惠於推理的任務品質。在將提示型調校部署到生產環境之前,測量對特定工作負載的影響。請考慮先以較低的工作量層級進行測試。
連接器文字摘要 (Beta 版)
在 Claude Fable 5 上,模型在工具呼叫之間發出的文字 (有時稱為「連接器文字」,例如「讓我檢查下一個檔案...」) 摘要了伺服器端,並以思維區塊的形式傳回,而不是純文字內容區塊。思維區塊使用與任何其他思維區塊相同的形狀 (空白文字,預設omitted顯示下有簽章)。
客戶影響:
回應形狀:Claude Fable 5 的工具使用回應可能包含額外的思維區塊,其中先前的模型會在
tool_use區塊之間發出純文字。沒有新的內容區塊類型。最終助理答案 (在所有工具使用完成後) 不受影響並保持純文字。多迴轉處理:在多迴轉對話中傳遞這些思維區塊,與受保護思維的處理方式相同 (傳遞時驗證簽章;如果傳送至不同的模型,則無提示地分割)。
範圍: 連接器摘要僅適用於對話中
tool_result存在 之後。在新對話中第一次工具呼叫前的旁白會保留純文字。短文字區段可以純文字形式傳遞,無需摘要。
此功能已啟用 Claude Fable 5 的伺服器端。沒有客戶選擇加入或選擇退出。