Terjemahan disediakan oleh mesin penerjemah. Jika konten terjemahan yang diberikan bertentangan dengan versi bahasa Inggris aslinya, utamakan versi bahasa Inggris.
Cara kerjanya
Amazon Bedrock AgentCore Evaluations menyediakan kemampuan untuk menilai kinerja agen AI. Ini dapat menghitung metrik seperti kebenaran penyelesaian tugas ujung ke ujung (pencapaian tujuan) agen, keakuratan alat yang dipanggil oleh agen saat menangani permintaan pengguna, dan metrik khusus apa pun yang ditentukan untuk mengevaluasi dimensi tertentu dari perilaku agen. AgentCore Evaluasi dapat mengevaluasi agen AI yang dihosting di bawah AgentCore Runtime serta agen AI yang dihosting di luar AgentCore.
Anda dapat membuat dan mengelola evaluasi atau sumber daya yang relevan menggunakan AgentCore CLI, AgentCore Python SDK, AWS Management Console atau langsung melalui AWS SDK.