As traduções são geradas por tradução automática. Em caso de conflito entre o conteúdo da tradução e da versão original em inglês, a versão em inglês prevalecerá.
Nova Premier
Amazon — Nova Premier
Detalhes do modelo
O Nova Premier é o modelo multimodal da Amazon para raciocínio complexo, fluxos de trabalho agentes e destilação de modelos. Para obter mais informações sobre desenvolvimento e desempenho do modelo, consulte o model/service cartão.
Data de lançamento do modelo: 31 de outubro de 2025
Data do EOL do modelo: 14 de setembro de 2026
Contratos de licença de usuário final e termos de uso: Visualizar
Ciclo de vida do modelo: Legacy
Janela de contexto: 1 milhão de tokens
Tokens de saída máximos: 25K
Raciocínio: Suportado
Limite de conhecimento: outubro de 2024
| Modalidades de entrada | Modalidades de saída | APIs suportadas | Endpoints suportados |
|---|---|---|---|
Responses | bedrock-runtime | ||
Chat Completions | bedrock-mantle | ||
Invoke | |||
Converse | |||
dica
Sempre que possível, recomendamos usar o bedrock-runtime endpoint para novos aplicativos. Para mais detalhes, consulte Endpoints compatíveis com o Amazon Bedrock.
Capacidades e características
Características do Bedrock
Recursos compatíveis com o uso do bedrock-runtime endpoint
| Suportado | Não suportado |
|---|---|
Armazenamento imediato em cache usando o endpoint bedrock-runtime
Para obter mais informações, consulte Armazenamento em cache imediato para uma inferência de modelo mais rápida.
| Suporte para cache imediato | Número mínimo de tokens por ponto de verificação de cache | Máximo de pontos de verificação de cache por solicitação | TTL suportado | Campos que aceitam pontos de verificação de cache instantâneos |
|---|---|---|---|---|
| Sim | 1 K* | 4 | 5 minutos | system e messages |
* Os modelos Amazon Nova suportam um máximo de 20.000 tokens para armazenamento imediato em cache. O cache de avisos serve principalmente para pedidos de texto.
Preços
Para obter informações sobre preços, consulte a página de preços do
Acesso programático
Use os seguintes IDs de modelo e URLs de endpoint para acessar esse modelo de forma programática. Para obter mais informações sobre as APIs e endpoints disponíveis, consulte APIs suportadas e Endpoints suportados.
| Endpoint | ID do modelo | In-Region URL do endpoint | ID de inferência geográfica | ID de inferência global |
|---|---|---|---|---|
bedrock-runtime |
amazon.nova-premier-v1:0 |
https://bedrock-runtime.{region}.amazonaws.com |
us.amazon.nova-premier-v1:0 |
Não compatível |
Por exemplo, se a região for us-east-1 (Norte da Virgínia), a URL do endpoint bedrock-runtime será "" e para bedrock-mantle será https://bedrock-runtime.us-east-1.amazonaws.com "”. https://bedrock-mantle.us-east-1.api.aws/v1
Níveis de serviço
O Amazon Bedrock oferece vários níveis de serviço para atender às suas necessidades de carga de trabalho. O Standard fornece acesso pago por token sem compromisso (defina "service_tier": "default" ou omita o campo). O Priority oferece os tempos de resposta mais rápidos por um preço premium (conjunto"service_tier": "priority"). O Flex fornece acesso de baixo custo para cargas de trabalho flexíveis e não sensíveis ao tempo (conjunto). "service_tier": "flex" O Reserved fornece uma taxa de transferência dedicada com um compromisso de prazo para cargas de trabalho previsíveis; ela é definida no nível da conta e não por solicitação (entre em contato com sua equipe de contas da AWS para habilitar). Para obter mais informações, consulte os níveis bedrock/latest/userguide/service-tiers-inference.html de serviço.
| Padrão | Priority | Flexionar | Reservado |
|---|---|---|---|
Disponibilidade regional
Visão geral da disponibilidade regional
O Amazon Bedrock oferece três opções de inferência: In-Region mantém as solicitações em uma única região para conformidade estrita, Cross-Region rotas geográficas entre regiões dentro de uma geografia (como EUA, UE e APAC), respeitando a residência de dados, e Cross-Region rotas globais em qualquer lugar do mundo, quando não há restrições de residência. Consulte a Disponibilidade regional por modelos página para obter mais detalhes.
| Região | In-Region | Geo | Global |
|---|---|---|---|
us-east-1(Norte da Virgínia) | |||
us-east-2(Ohio) | |||
us-west-2(Oregon) |
Detalhes da inferência geográfica
Geolocalização: EUA
ID de inferência geográfica: us.amazon.nova-premier-v1:0
| Região de origem | Regiões de destino |
|---|---|
| us-east-1 (N. Virginia) | us-east-1 (Norte da Virgínia), us-east-2 (Ohio), us-west-2 (Oregon) |
| us-east-2 (Ohio) | us-east-1 (Norte da Virgínia), us-east-2 (Ohio), us-west-2 (Oregon) |
| us-west-2 (Oregon) | us-east-1 (Norte da Virgínia), us-east-2 (Ohio), us-west-2 (Oregon) |
Cotas e limites
Sua AWS conta tem cotas padrão para manter o desempenho do serviço e garantir o uso adequado do Amazon Bedrock. As cotas padrão atribuídas a uma conta podem ser atualizadas dependendo de fatores regionais, histórico de pagamentos, uso fraudulento e and/or aprovação de uma solicitação de aumento de cota. Para obter mais informações, consulte a Cotas do Amazon Bedrock documentação e os limites do modelo.
Código de exemplo
Etapa 1 - AWS Conta: Se você já tem uma AWS conta, pule esta etapa. Se você não conhece AWS, cadastre-se em uma conta da AWS
Etapa 2 - Chave de API: acesse o console do Amazon Bedrock
Etapa 3 - Obtenha o SDK: para usar este guia de introdução, você deve ter o Python já instalado. Em seguida, instale o software relevante, dependendo das APIs que você está usando.
pip install boto3
Etapa 4 - Definir variáveis de ambiente: configure seu ambiente para usar a chave de API para autenticação.
AWS_BEARER_TOKEN_BEDROCK="<provide your Bedrock API key>"
Etapa 5 - Execute sua primeira solicitação de inferência: salve o arquivo como bedrock-first-request.py