View a markdown version of this page

Perfiles de inferencia de aplicaciones - Amazon Bedrock

Las traducciones son generadas a través de traducción automática. En caso de conflicto entre la traducción y la version original de inglés, prevalecerá la version en inglés.

Perfiles de inferencia de aplicaciones

Los perfiles de inferencia de aplicaciones (API) permiten atribuir los costos de Amazon Bedrock por aplicación, equipo o carga de trabajo para las API de Amazon Bedrock InvokeModel y Converse en el punto final. bedrock-runtime Cada API es específica de un modelo e incluye etiquetas de asignación de costos que van al Explorador de costos y a los informes de AWS AWS costo y uso (tanto el CUR clásico como el CUR 2.0).

Para las cargas de trabajo en las que las respuestas y los chats se completan en el punto final, utilízalo en su lugar. bedrock-mantle Proyectos

importante

Las API de respuestas y finalización del chat no admiten los perfiles de inferencia de aplicaciones en ninguno de los terminales. Una solicitud dirigida a esas API en la que se nombra un perfil de inferencia de una aplicación como objetivo de inferencia se rechaza con un error 400. Utilice una API con las API InvokeModel y Converse, y atribuya el uso de las respuestas y las terminaciones de chat a o en su lugar. Atribución principal de IAM Per-request etiquetado de metadatos Los perfiles de inferencia globales, geográficos y del sistema funcionan con normalidad con todas estas API.

Cómo funciona la atribución de costos

El perfil de inferencia de una aplicación es un recurso que hace referencia a un modelo específico de Amazon Bedrock. Cree el perfil, adjunte etiquetas de asignación de costos y, a continuación, utilice el ARN del perfil en lugar del ID del modelo en las llamadas a la API. Las etiquetas del perfil se adjuntan al registro de facturación de cada solicitud.

El siguiente ejemplo muestra cómo usar el ARN del perfil de inferencia de una aplicación en lugar de un ID de modelo al llamar a la API de Converse:

import boto3 client = boto3.client("bedrock-runtime") response = client.converse( modelId="arn:aws:bedrock:us-east-1:123456789012:inference-profile/my-team-profile", messages=[ {"role": "user", "content": [{"text": "Hello"}]} ] )

Para obtener más información sobre la creación de perfiles, consulte. Creación de un perfil de inferencia de aplicaciones

nota

Los perfiles de inferencia de aplicaciones entregan el importe total facturado a AWS Cost Explorer y CUR (CUR y CUR 2.0 clásicos). El grano más fino se obtiene por tipo de uso y día; no se produce por pedido. Para obtener información detallada sobre el token por mensaje, úselo Per-request etiquetado de metadatos con los registros de invocación de su modelo.

Ver los costos del perfil

Tras crear y etiquetar tus perfiles, activa las etiquetas como etiquetas de asignación de costes en la consola de AWS facturación y gestión de costes:

  1. Abra la consola AWS de facturación y gestión de costes.

  2. En el panel de navegación, seleccione Cost Allocation Tags (Etiquetas de asignación de costos).

  3. Selecciona las etiquetas que has aplicado a tus perfiles.

  4. Seleccione Activar.

Una vez activadas, las etiquetas pueden tardar hasta 24 horas en aparecer en Cost Explorer y CUR. Las etiquetas de asignación de costos no son retroactivas. Solo se etiquetan los costos incurridos después de la activación. Para obtener más información, consulte Activar las etiquetas de asignación de costos definidas por el usuario.

Tras la activación de las etiquetas, puede analizar los costos de Amazon Bedrock según el perfil de inferencia de la aplicación en las siguientes herramientas:

  • AWS Explorador de costos: filtre por etiquetas de perfil para ver las tendencias de los costos a lo largo del tiempo. Agrupe por etiqueta para comparar los costos entre los perfiles.

  • AWS Informes de costos y uso: consulte los datos de CUR para ver el desglose de los costos de las partidas por etiqueta de perfil. Las etiquetas aparecen tanto en las exportaciones clásicas de CUR como en las de CUR 2.0.

Consideraciones de escalado

Cada perfil de inferencia de la aplicación está vinculado a un modelo específico. Esto significa que necesita un perfil independiente para cada combinación única de modelo, equipo y conjunto de etiquetas. A medida que las organizaciones crecen, el número de perfiles puede aumentar rápidamente, especialmente cuando las nuevas versiones del modelo requieren nuevos perfiles.

Para reducir la proliferación de perfiles:

  • Recomendado: Úselo Proyectos para mayor flexibilidad y facilidad a la hora de hacer un seguimiento de los costos.

  • Etiquete a nivel de equipo o centro de costos, en lugar de hacerlo por usuario.

  • Para atribuir costos por usuario sin crear perfiles adicionales, utilice. Atribución principal de IAM El seguimiento principal de IAM funciona junto con los perfiles de inferencia de las aplicaciones y atribuye automáticamente los costes a nivel de identidad.

  • Para obtener información detallada sobre los tokens por mensaje en lugar de en dólares acumulados, utilízalo Per-request etiquetado de metadatos con los registros de invocación de tu modelo. No necesita recursos por modelo.