Las traducciones son generadas a través de traducción automática. En caso de conflicto entre la traducción y la version original de inglés, prevalecerá la version en inglés.
Grok 4.3
xAi — Versión 4.3
Detalles del modelo
Grok 4.3 es un modelo que prioriza el razonamiento y ofrece un esfuerzo de razonamiento siempre activo y configurable (ninguno, bajo, medio, alto). Como el razonamiento siempre está activo y no es opcional, se comporta de manera más uniforme en los ciclos de agentes de varios pasos que en los modelos en los que se puede dejar de pensar. También ofrece capacidades sólidas de uso de herramientas y seguimiento de instrucciones para crear agentes de varios pasos, así como una eficiencia simbólica que ayuda a mantener la rentabilidad de las inferencias de gran volumen. Grok 4.3 es especialmente adecuado para cargas de trabajo empresariales, como la revisión de contratos, la investigación de jurisprudencia, el análisis de contratos crediticios y las preguntas y respuestas sobre documentos financieros, al tiempo que ofrece resultados consistentes y de alta calidad en flujos de trabajo con IA conversacional, búsqueda, chat y varios turnos. Grok 4.3 funciona con Mantle, un nuevo motor de inferencias de Amazon Bedrock diseñado pensando en la relación precio-calidad, que admite la llamada mediante herramientas, la producción estructurada y la transmisión de respuestas.
Fecha de lanzamiento del modelo: 15 de junio de 2026
Fecha de fin de vida útil del modelo: N/A
Contratos de licencia de usuario final y condiciones de uso: Ver https://aws.amazon.com/legal/bedrock/third-party-models/
Ciclo de vida del modelo: activo
Ventana de contexto: 1 millón de tokens
Razonamiento: compatible (configurable: bajo, medio, alto)
| Modalidades de entrada | Modalidades de salida | API compatibles | Endpoints compatibles |
|---|---|---|---|
Chat Completions | bedrock-runtime | ||
Responses | bedrock-mantle | ||
Invoke | |||
Converse | |||
Síbedrock-mantle, se utiliza este modelo/openai/v1/responses, no el predeterminado/v1/responses.
Capacidades y características
Características de Bedrock
Funciones compatibles con el punto final bedrock-mantle
| Soportado | No es compatible |
|---|---|
|
— |
Precios
Para obtener información sobre precios, consulte la página de precios de
Acceso programático
Utilice los siguientes ID de modelo y URL de punto final para acceder a este modelo mediante programación. Para obtener más información sobre las API y los puntos de conexión disponibles, consulte las API compatibles y los puntos de conexión compatibles. bedrock/latest/userguide/endpoints.html
| Punto de conexión | ID del modelo | In-Region URL de punto final | ID de inferencia geográfica | ID de inferencia global |
|---|---|---|---|---|
bedrock-mantle |
xai.grok-4.3 |
https://bedrock-mantle.{region}.api.aws/openai/v1 |
No admitido | No admitido |
Por ejemplo, si la región es us-west-2 (Oregón), la URL del punto final de Bedrock-mantle será "». https://bedrock-mantle.us-west-2.api.aws/openai/v1
Niveles de servicio
Amazon Bedrock ofrece varios niveles de servicio para adaptarse a sus requisitos de carga de trabajo. La versión estándar proporciona acceso de pago por token sin compromiso (defina "service_tier": "default" u omita el campo). Priority ofrece los tiempos de respuesta más rápidos por un precio superior (fijo). "service_tier": "priority" Flex proporciona un acceso de menor costo para cargas de trabajo flexibles y que no requieren tiempo (conjunto). "service_tier": "flex" Reserved proporciona un rendimiento dedicado con un compromiso temporal para cargas de trabajo predecibles; se establece a nivel de cuenta y no por solicitud (póngase en contacto con su equipo de cuentas de AWS para habilitarlo). Para obtener más información, consulte los niveles de servicio.
| Estándar | Priority (Prioridad) | Flex | Reservado |
|---|---|---|---|
Disponibilidad regional
La disponibilidad regional de un vistazo
Amazon Bedrock ofrece tres opciones de inferencia: In-Region mantiene las solicitudes en una sola región para garantizar un cumplimiento estricto, Cross-Region rutas geográficas entre regiones de una misma geografía (como EE. UU., UE y APAC) respetando la residencia de los datos, y Cross-Region rutas globales a cualquier parte del mundo cuando no hay restricciones de residencia. Consulte la Disponibilidad regional por modelos página para obtener más información.
| Region | In-Region | Geo | Global |
|---|---|---|---|
us-west-2(Oregón) | |||
us-east-1(Virginia del Norte) | |||
us-east-2(Ohio) |
Cuotas y límites
Su AWS cuenta tiene cuotas predeterminadas para mantener el rendimiento del servicio y garantizar el uso adecuado de Amazon Bedrock. Las cuotas predeterminadas asignadas a una cuenta pueden actualizarse en función de factores regionales, el historial de pagos, el uso fraudulento y la and/or aprobación de una solicitud de aumento de cuota. Para obtener más información, consulta la Cuotas para Amazon Bedrock documentación y los límites del modelo.
Cuando se consume el rendimiento bajo demanda en el bedrock-mantle terminal, el rendimiento disponible aumenta con el tiempo. No se garantiza que todas las solicitudes que estén dentro de su cuota tengan éxito durante los períodos de alta demanda, por lo que es importante aumentarlas gradualmente. En este modelo, los límites predeterminados no se determinan directamente a través de las cuotas de servicio, por lo que te recomendamos que sigas esta rampa como guía.
Código de muestra
Paso 1: AWS Cuenta: Si ya tienes una AWS cuenta, omite este paso. Si es la primera vez que lo AWS hace, regístrese para obtener una cuenta de AWS
Paso 2: clave de API: vaya a la consola de Amazon Bedrock
Paso 3: Obtenga el SDK: para utilizar esta guía de inicio, debe tener Python ya instalado. A continuación, instale el software correspondiente en función de las API que esté utilizando.
Paso 4: Configure las variables de entorno: configure su entorno para usar la clave de API para la autenticación.
Paso 5: Ejecute su primera solicitud de inferencia: guarde el archivo como bedrock-first-request.py
Consideraciones y limitaciones de uso
Esfuerzo de razonamiento: el razonamiento siempre está activo de forma predeterminada. Puede configurar el esfuerzo mediante los
reasoningparámetros:{"effort": "none"}(desactiva el razonamiento),"low"(predeterminado) o"high"."medium"El contenido de Reasoning está cifrado y se puede devolver enviando lainclude: ["reasoning.encrypted_content"]solicitud a la API de respuestas. Puedes devolver el contenido cifrado en turnos posteriores para proporcionar un contexto de razonamiento para las conversaciones de varios turnos. La API Chat Completions no devuelve fichas de razonamiento.response = client.responses.create( model="xai.grok-4.3", reasoning={"effort": "high"}, include=["reasoning.encrypted_content"], input="Explain quantum entanglement simply." ) print(response.output_text)Parámetros predeterminados: Grok 4.3 usa valores predeterminados que difieren de la especificación estándar de la API de OpenAI:
temperaturepor defecto es0.7(no1), por defecto es (no)top_py por defecto es1.0.95max_completion_tokens131072Ajusta estos valores de forma explícita si tu aplicación requiere un comportamiento diferente.