本文属于机器翻译版本。若本译文内容与英语原文存在差异,则一律以英文原文为准。
Grok 4.3
xAi — Grok 4.3
模型详细信息
Grok 4.3 是一种推理优先模型,提供永不间断且可配置的推理工作(无、低、中、高)。由于推理始终是活跃的,而不是可选的,因此与可以跳过思考的模型相比,推理在多步代理循环中的表现更加一致。它还提供强大的工具使用和指令跟踪功能,用于构建多步代理,并提供令牌效率,以帮助保持大批量推理的成本效益。Grok 4.3 特别适合合同审查、判例法研究、信用协议分析和财务文件问答等企业工作负载,同时在对话式 AI、搜索、聊天和多轮工作流程中提供一致、高质量的结果。Grok 4.3 在 Amazon Bedrock 的新推理引擎 Mantle 上运行,专为性价比而设计,支持工具调用、结构化输出和响应流。
模型发布日期:2026 年 6 月 15 日
EOL 不早于:2027 年 6 月 15 日
遗产期:至少 6 个月
模型生命周期政策:模型生命周期(适用于 2026 年 9 月 7 日之前发布的模型)
模特停产日期: N/A
最终用户许可协议和使用条款:查看
模型生命周期:活跃
上下文窗口:100 万个代币
推理:支持(可配置:无、低、中、高)
开启bedrock-mantle,此模型的服务/openai/v1/responses地址不是默认模式/v1/responses。
能力和特性
基岩特征
使用bedrock-mantle终端节点支持的功能
| 支持的 | 不支持 |
|---|---|
|
— |
定价
| 推理选项 | 输入 | 输出 | 缓存读取 |
|---|---|---|---|
| In-Region | 1.25 美元 | 2.50 美元 | 0.20 美元 |
AWS GovCloud (US-West)
| 推理选项 | 输入 | 输出 | 缓存读取 |
|---|---|---|---|
| In-Region | 1.50 USD | 3.00 美元 | 0.24 美元 |
所有价格均为每100万个代币。显示的定价是标准套餐的价格。Grok 4.3 仅支持 In-Region 推理。
优先级和灵活级别支持:除标准级别外,Grok 4.3 还支持优先级和灵活服务等级。优先级按每个代币标准费率的 1.75倍(75%的溢价)计费,Flex按标准费率的 0.5倍(50%的折扣)计费;将这些乘数应用于上面显示的标准费率。有关每个服务等级的详细信息,请参阅服务等级。
以编程方式访问
使用以下模型 ID 和端点 URL 以编程方式访问此模型。有关可用 API 和终端节点的更多信息,请参阅支持的 API 和支持的终端节点。
| Endpoint | 模特 ID | In-Region 端点 URL | 地理推断 ID | 全局推理 ID |
|---|---|---|---|---|
bedrock-mantle |
xai.grok-4.3 |
https://bedrock-mantle.{region}.api.aws/openai/v1 |
不支持 | 不支持 |
例如,如果区域为 us-west-2(俄勒冈州),则基岩地堡终端节点 URL 将为 “”。https://bedrock-mantle.us-west-2.api.aws/openai/v1
服务等级
Amazon Bedrock 提供多个服务等级以满足您的工作负载要求。Standard 提供按代币付费的访问权限,无需承诺(设置"service_tier": "default"或省略该字段)。Priority 以溢价(套装"service_tier": "priority")提供最快的响应时间。Flex 为灵活、非时间敏感的工作负载(套装)提供更低成本的访问权限。"service_tier": "flex"预留为可预测的工作负载提供专用吞吐量和期限承诺;它是在账户级别设置的,而不是根据每个请求设置的(请联系您的 AWS 账户团队来启用)。有关更多信息,请参阅服务等级。
| Standard | 优先级 | Flex | 已保留 |
|---|---|---|---|
区域可用性
区域可用性一览
Amazon Bedrock 提供三种推理选项:将请求In-Region保留在单一区域内以确保严格合规;在尊重数据驻留的前提下跨地理区域(例如美国、欧盟和亚太地区)进行地理路由;在没有居住限制的情况下,全球 Cross-Region路由到全球任何地方。 Cross-Region 有关更多详细信息,请参阅该按型号划分的区域可用性页面。
| 区域 | In-Region | 地理 | Global |
|---|---|---|---|
us-west-2(俄勒冈州) | |||
us-east-1(弗吉尼亚北部) | |||
us-east-2(俄亥俄州) | |||
us-gov-west-1(GovCloud 西部) |
配额和限制
您的 AWS 账户有默认配额,以维持服务的性能并确保适当使用 Amazon Bedrock。分配给账户的默认配额可能会根据地区因素、付款历史记录、欺诈性使用、配额增加请求的 and/or 批准情况进行更新。有关更多信息,请参阅Amazon Bedrock 的配额文档并查看模型的限制。
在bedrock-mantle终端上消耗按需吞吐量时,可用吞吐量会随着时间的推移而增加。在需求旺盛的时期,并非所有配额内的请求都能保证成功,因此逐步增加很重要。在此模型中,默认限制不是通过服务配额直接显示的,因此我们建议您以此为指导。
示例代码
第 1 步- AWS 账户:如果您已经有 AWS 账户,请跳过此步骤。如果您是新手 AWS,请注册一个 A WS 账户
第 2 步-API 密钥:前往亚马逊 Bedrock 控制台
第 3 步-获取 SDK:要使用此入门指南,必须已安装 Python。然后根据您使用的 API 安装相关软件。
第 4 步-设置环境变量:将您的环境配置为使用 API 密钥进行身份验证。
第 5 步-运行您的第一个推理请求:将文件另存为 bedrock-first-request.py
使用注意事项和限制
推理工作 — 默认情况下,推理始终处于活动状态。您可以通过以下
reasoning参数配置工作量:{"effort": "none"}(禁用推理)、"low"(默认)"medium"、或"high"。推理内容是加密的,可以通过传include: ["reasoning.encrypted_content"]入响应 API 请求来返回。您可以在后续回合中将加密内容发送回去,为多回合对话提供推理背景。聊天完成 API 不返回推理令牌。response = client.responses.create( model="xai.grok-4.3", reasoning={"effort": "high"}, include=["reasoning.encrypted_content"], input="Explain quantum entanglement simply." ) print(response.output_text)默认参数 — Grok 4.3 使用的默认值与标准 OpenAI API 规范不同:
temperature默认为(不是),默认为0.7(不是1),top_p默认为(不是),默认为0.95(不是1),max_completion_tokens默认为。131072如果您的应用程序需要不同的行为,请明确调整这些值。