本文為英文版的機器翻譯版本,如內容有任何歧義或不一致之處,概以英文版為準。
GPT-5.6 特拉
OpenAI — GPT-5.6 特拉
模型詳細資訊
GPT-5.6 Terra 是日常生產工作的平衡模型。它以較低的成本提供優於 GPT-5.5 的效能,以較少的輸出字符完成任務,以提高每一美元的效能。使用 Terra 產生程式碼、內容工作流程、結構化資料擷取和一般用途代理程式任務。如需模型開發和效能的詳細資訊,請參閱模型/服務卡
模型啟動日期:2026 年 7 月 13 日
EOL 不得早於:2027 年 7 月 13 日
舊版期間:至少 6 個月
模型生命週期政策:模型生命週期 (適用於 2026 年 9 月 7 日之前啟動的模型)
模型 EOL 日期:不適用
最終使用者授權合約和使用條款:檢視
模型生命週期:作用中
內容視窗:1M個字符
Marketplace 產品 ID:
prod-oxu3iqwrwktjm
| 輸入模式 | 輸出模式 |
|---|---|
支援的端點和 APIs
下表顯示 GPT-5.6 Terra 支援哪些端點和 APIs。如需詳細資訊,請參閱Amazon Bedrock 支援的 APIs及Amazon Bedrock 支援的端點。
端點支援
| 端點 | 支援的 |
|---|---|
bedrock-runtime |
|
bedrock-mantle |
bedrock-runtime端點上支援的 APIs
| 訊息 | 回應 | 聊天完成 | Converse | Invoke |
|---|---|---|---|---|
bedrock-mantle端點上支援的 APIs
| 訊息 | 回應 | 聊天完成 | Converse | Invoke |
|---|---|---|---|---|
注意
在 上bedrock-mantle,兩個 APIs都使用/openai/v1基本路徑,而不是 /v1。搭配此模型使用任一 API:
對於回應,請使用
/openai/v1/responses。對於聊天完成,請使用
/openai/v1/chat/completions。
提示
我們建議您盡可能將bedrock-runtime端點用於新應用程式。如需詳細資訊,請參閱 Amazon Bedrock 支援的端點。
功能和功能
Bedrock 功能
使用bedrock-runtime端點支援的功能
使用bedrock-mantle端點支援的功能
定價
標準方案的所有價格均以每 100 萬個字符美元為單位。
商業區域價格包含比 OpenAI 費率多 10% 的費用。您不需要新增此費用。
此模型不支援 Priority 和 Flex 方案。
商業區域 — 短內容 (27 萬個輸入字符或更少)
| 推論選項 | 輸入 | 輸入 — 30 公尺快取寫入 | 輸入 — 快取讀取 | 輸出 |
|---|---|---|---|---|
| 區域內 | 2.20 美元 | 2.75 美元 | 0.22 美元 | 13.20 美元 |
| Geo CRIS | 2.20 美元 | 2.75 美元 | 0.22 美元 | 13.20 美元 |
| 全域 CRIS | 2.00 美元 | 2.50 美元 | 0.20 美元 | 12.00 美元 |
商業區域 — 長內容 (超過 272K個輸入字符)
| 推論選項 | 輸入 | 輸入 — 30 公尺快取寫入 | 輸入 — 快取讀取 | 輸出 |
|---|---|---|---|---|
| 區域內 | 4.40 美元 | 5.50 美元 | 0.44 美元 | 19.80 美元 |
| Geo CRIS | 4.40 美元 | 5.50 美元 | 0.44 美元 | 19.80 美元 |
| 全域 CRIS | 4.00 美元 | 5.00 美元 | 0.40 美元 | 18.00 美元 |
AWS GovCloud (美國東部和美國西部)
短內容 (27 萬個輸入字符或更少)
| 推論選項 | 輸入 | 輸入 — 30 公尺快取寫入 | 輸入 — 快取讀取 | 輸出 |
|---|---|---|---|---|
| 區域內 | 2.64 美元 | 3.30 美元 | 0.264 美元 | 15.84 美元 |
長內容 (超過 272K個輸入字符)
| 推論選項 | 輸入 | 輸入 — 30 公尺快取寫入 | 輸入 — 快取讀取 | 輸出 |
|---|---|---|---|---|
| 區域內 | 5.28 美元 | 6.60 美元 | 0.528 美元 | 23.76 美元 |
程式設計存取
使用以下模型 IDs和端點 URLs以程式設計方式存取此模型。如需可用 APIs和端點的詳細資訊,請參閱支援的 APIs和支援的端點。
| 端點 | 模型 ID | 區域端點 URL | 地理推論 ID | 全域推論 ID |
|---|---|---|---|---|
bedrock-mantle |
openai.gpt-5.6-terra |
https://bedrock-mantle.{region}.api.aws/openai/v1 |
不支援 | 不支援 |
bedrock-runtime |
openai.gpt-5.6-terra |
不支援 | us.openai.gpt-5.6-terra 商業 AWS 區域、in.openai.gpt-5.6-terra印度區域 |
global.openai.gpt-5.6-terra |
例如,如果區域是 us-east-1 (維吉尼亞北部),則 bedrock-mantle 端點 URL 將為 "https://bedrock-mantle.us-east-1.api.aws/openai/v1"。在 上bedrock-runtime,基本 URL 為「https://bedrock-runtime.{region}.amazonaws.com/openai/v1」,請求必須將地理跨區域推論 ID 命名us.openai.gpt-5.6-terra為模型。
服務層
Amazon Bedrock 提供多種服務層,以符合您的工作負載需求。Standard 提供pay-per-token存取 (設定"service_tier": "default"或省略 欄位)。Priority 提供價格溢價最快的回應時間 (設定 "service_tier": "priority")。Flex 為彈性、non-time-sensitive的工作負載提供較低成本的存取 (設定 "service_tier": "flex")。預留會提供專用輸送量與可預測工作負載的期限承諾;它會在帳戶層級設定,而不是根據請求設定 (請聯絡您的 AWS 帳戶團隊啟用)。如需詳細資訊,請參閱 服務方案。
| 標準 | 優先順序 | Flex | 預留 |
|---|---|---|---|
區域可用性
區域可用性一目了然
Amazon Bedrock 提供三種推論選項:為嚴格合規,區域內將請求保留在單一區域內、在遵守資料駐留時跨區域 (例如美國、歐洲和亞太區域) 的地理跨區域路由,以及在沒有駐留限制的情況下在全球任何地方進行全球跨區域路由。如需詳細資訊,請參閱 依模型的區域可用性頁面。
可用性因端點而異。
使用bedrock-mantle端點的可用性
| 區域 | 區域內 | 地理 | 全域 |
|---|---|---|---|
us-east-1 (維吉尼亞北部) | |||
us-east-2 (俄亥俄) | |||
us-west-2 (奧勒岡) | |||
us-gov-west-1 (GovCloud 西部) | |||
us-gov-east-1 (GovCloud East) |
使用bedrock-runtime端點的可用性
| 區域 | 區域內 | 地理 | 全域 |
|---|---|---|---|
us-east-1 (維吉尼亞北部) | |||
us-east-2 (俄亥俄) | |||
us-west-1 (加利佛尼亞北部) | |||
us-west-2 (奧勒岡) | |||
ca-central-1 (加拿大) | |||
ca-west-1 (卡加利) | |||
eu-central-1 (法蘭克福) | |||
eu-central-2 (蘇黎世) | |||
eu-north-1 (斯德哥爾摩) | |||
eu-south-1 (米蘭) | |||
eu-south-2 (西班牙) | |||
eu-west-1 (愛爾蘭) | |||
eu-west-2 (倫敦) | |||
eu-west-3 (巴黎) | |||
ap-east-2 (台北) | |||
ap-northeast-1 (東京) | |||
ap-northeast-2 (首爾) | |||
ap-northeast-3 (大阪) | |||
ap-south-1 (孟買) | |||
ap-south-2 (海德拉巴) | |||
ap-southeast-1 (新加坡) | |||
ap-southeast-2 (雪梨) | |||
ap-southeast-3 (雅加達) | |||
ap-southeast-4 (墨爾本) | |||
ap-southeast-5 (馬來西亞) | |||
ap-southeast-6 (紐西蘭) | |||
ap-southeast-7 (泰國) | |||
il-central-1 (特拉維夫) | |||
me-central-1 (阿拉伯聯合大公國) | |||
me-south-1 (巴林) | |||
af-south-1 (開普敦) | |||
sa-east-1 (聖保羅) |
配額和限制
AWS 您的帳戶具有預設配額來維持服務的效能,並確保適當使用 Amazon Bedrock。指派給帳戶的預設配額可能會根據區域因素、付款歷史記錄、詐騙使用量和/或配額增加請求的核准而更新。如需詳細資訊,請參閱 Amazon Bedrock 的配額 文件並參閱模型的限制。
在bedrock-runtime端點上,限制會以每分鐘字符數 (TPM) 管理,燒毀率為 10 倍,其中 1 個輸出字符會耗用 10 個字符。
範例程式碼
步驟 1 - AWS 帳戶:如果您已經有 AWS 帳戶,請略過此步驟。如果您是新手 AWS,請註冊 AWS 帳戶
步驟 2 - API 金鑰:前往 Amazon Bedrock 主控台
步驟 3 - 取得 SDK:若要使用此入門指南,您必須已安裝 Python。然後,根據您使用的 APIs相關軟體。
針對這兩個 APIs,選擇 OpenAI 開發套件索引標籤。
步驟 4 - 設定環境變數
設定您的環境以使用 API 金鑰進行身分驗證。
注意
在 上bedrock-runtime,將跨區域推論描述檔命名為模型 - us.openai.gpt-5.6-terra或 global.openai.gpt-5.6-terra。此模型不適用於該端點的區域內推論。除了推論設定檔之外,您帳戶的預設專案 bedrock:InvokeModel (arn:aws:bedrock:{region}:{account-id}:project/default) 還需要您的 IAM 身分。
步驟 5 - 執行您的第一個推論請求
將檔案儲存為 bedrock-first-request.py
bedrock-mantle
使用步驟 4 - 設定環境變數中的設定。選擇 bedrock-mantle () 索引標籤。聊天索引標籤使用聊天完成 API。
bedrock-runtime:OpenAI 開發套件
使用步驟 4 - 設定環境變數中的設定。選擇 bedrock-runtime () 索引標籤。使用回應 API 傳送您的請求。