As traduções são geradas por tradução automática. Em caso de conflito entre o conteúdo da tradução e da versão original em inglês, a versão em inglês prevalecerá.
MiniMax M2.5
MiniMax — MiniMax M2.5
Detalhes do modelo
MiniMax M2.5 é um modelo de fronteira nativo do agente treinado explicitamente para raciocinar com eficiência, decompor tarefas de maneira ideal e concluir fluxos de trabalho complexos sob restrições reais de tempo e custo. Ele atinge velocidades de conclusão de tarefas comparáveis ou mais rápidas do que os principais modelos de fronteira proprietários, combinando alta taxa de transferência de inferência com aprendizado por reforço focado no raciocínio eficiente de tokens e na melhor tomada de decisões em estruturas agentes. Para obter mais informações sobre desenvolvimento e desempenho do modelo, consulte o model/service cartão
Data de lançamento do modelo: 12 de fevereiro de 2026
Data EOL do modelo: N/A
Contratos de licença de usuário final e termos de uso: Visualizar
Ciclo de vida do modelo: Ativo
Janela de contexto: 196 mil tokens
Tokens de saída máximos: 8K
| Modalidades de entrada | Modalidades de saída | APIs suportadas | Endpoints suportados |
|---|---|---|---|
Responses | bedrock-runtime | ||
Chat Completions | bedrock-mantle | ||
Invoke | |||
Converse | |||
nota
Sempre que possível, recomendamos que você use o bedrock-runtime endpoint.
dica
Sempre que possível, recomendamos usar o bedrock-runtime endpoint para novos aplicativos. Para mais detalhes, consulte Endpoints compatíveis com o Amazon Bedrock.
Capacidades e características
Características do Bedrock
Recursos compatíveis com o uso do bedrock-mantle endpoint
| Suportado | Não suportado |
|---|---|
Recursos compatíveis com o uso do bedrock-runtime endpoint
Preços
Para obter informações sobre preços, consulte a página de preços do
Acesso programático
Use os seguintes IDs de modelo e URLs de endpoint para acessar esse modelo de forma programática. Para obter mais informações sobre as APIs e endpoints disponíveis, consulte APIs suportadas e Endpoints suportados.
| Endpoint | ID do modelo | In-Region URL do endpoint | ID de inferência geográfica | ID de inferência global |
|---|---|---|---|---|
bedrock-runtime |
minimax.minimax-m2.5 |
https://bedrock-runtime.{region}.amazonaws.com |
Sem compatibilidade | Sem compatibilidade |
bedrock-mantle |
minimax.minimax-m2.5 |
https://bedrock-mantle.{region}.api.aws/v1 |
Sem compatibilidade | Sem compatibilidade |
Por exemplo, se a região for us-east-1 (Norte da Virgínia), a URL do endpoint bedrock-runtime será "" e para bedrock-mantle será https://bedrock-runtime.us-east-1.amazonaws.com "”. https://bedrock-mantle.us-east-1.api.aws/v1
Níveis de serviço
O Amazon Bedrock oferece vários níveis de serviço para atender às suas necessidades de carga de trabalho. O Standard fornece acesso pago por token sem compromisso (defina "service_tier": "default" ou omita o campo). O Priority oferece os tempos de resposta mais rápidos por um preço premium (conjunto"service_tier": "priority"). O Flex fornece acesso de baixo custo para cargas de trabalho flexíveis e não sensíveis ao tempo (conjunto). "service_tier": "flex" O Reserved fornece uma taxa de transferência dedicada com um compromisso de prazo para cargas de trabalho previsíveis; ela é definida no nível da conta e não por solicitação (entre em contato com sua equipe de contas da AWS para habilitar). Para obter mais informações, consulte os níveis bedrock/latest/userguide/service-tiers-inference.html de serviço.
| Padrão | Priority | Flexionar | Reservado |
|---|---|---|---|
Disponibilidade regional
Visão geral da disponibilidade regional
O Amazon Bedrock oferece três opções de inferência: In-Region mantém as solicitações em uma única região para conformidade estrita, Cross-Region rotas geográficas entre regiões dentro de uma geografia (como EUA, UE e APAC), respeitando a residência de dados, e Cross-Region rotas globais em qualquer lugar do mundo, quando não há restrições de residência. Consulte a Disponibilidade regional por modelos página para obter mais detalhes.
| Região | In-Region | Geo | Global |
|---|---|---|---|
us-east-1(Norte da Virgínia) | |||
us-east-2(Ohio) | |||
us-west-2(Oregon) | |||
eu-central-1(Frankfurt) | |||
eu-north-1(Estocolmo) | |||
eu-south-1(Milão) | |||
eu-west-1(Irlanda) | |||
eu-west-2(Londres) | |||
ap-northeast-1(Tóquio) | |||
ap-south-1(Mumbai) | |||
ap-southeast-2(Sidney) | |||
ap-southeast-3(Jacarta) | |||
sa-east-1(São Paulo) | |||
ap-southeast-4(Melbourne) |
Cotas e limites
Sua AWS conta tem cotas padrão para manter o desempenho do serviço e garantir o uso adequado do Amazon Bedrock. As cotas padrão atribuídas a uma conta podem ser atualizadas dependendo de fatores regionais, histórico de pagamentos, uso fraudulento e and/or aprovação de uma solicitação de aumento de cota. Para obter mais informações, consulte a Cotas do Amazon Bedrock documentação e os limites do modelo.
Código de exemplo
Etapa 1 - AWS Conta: Se você já tem uma AWS conta, pule esta etapa. Se você não conhece AWS, cadastre-se em uma conta da AWS
Etapa 2 - Chave de API: acesse o console do Amazon Bedrock
Etapa 3 - Obtenha o SDK: para usar este guia de introdução, você deve ter o Python já instalado. Em seguida, instale o software relevante, dependendo das APIs que você está usando.
Etapa 4 - Definir variáveis de ambiente: configure seu ambiente para usar a chave de API para autenticação.
Etapa 5 - Execute sua primeira solicitação de inferência: salve o arquivo como bedrock-first-request.py