К содержанию
Выпуск №80 · 27 августа 2026 / Новости

Amazon Bedrock AgentCore Evaluations отделяет оценку ИИ-агентов от выбора фреймворка

Как сообщает AWS Machine Learning Blog, Amazon Bedrock AgentCore Evaluations оценивает работу агентов, передающих телеметрию через OpenTelemetry.

Редакция 26 августа 2026 г., 00:28 MSK

В Telegram

Как сообщает AWS Machine Learning Blog, Amazon Bedrock AgentCore Evaluations оценивает работу агентов, передающих телеметрию через OpenTelemetry. Сервис поддерживает LangGraph, LlamaIndex, OpenAI Agents SDK, Google ADK, Claude Agent SDK и Strands Agents.

OpenTelemetry представляет выполнение агента в виде трассы из спанов. Каждый спан относится к отдельному этапу запроса и содержит временные метки и атрибуты. В AgentCore runtime инфраструктура ADOT отправляет спаны и записи событий в Amazon CloudWatch.

Сервис различает три роли спанов: верхнеуровневый цикл запроса и ответа, отдельные обращения к модели и вызовы инструментов. Спаны поиска документов, ранжирования, проверки ограничений и работы с памятью отдельно настраивать не требуется. Сервис обрабатывает такие трассы, хотя оценщикам эти дополнительные данные не нужны.

Ключевые факты

  • Подход охватывает LangGraph, LlamaIndex, OpenAI Agents SDK, Google ADK, Claude Agent SDK и Strands Agents.

  • В AgentCore runtime инфраструктура ADOT направляет спаны и записи событий в Amazon CloudWatch.

  • Оценщики используют три роли спанов: цикл запроса и ответа, обращения к модели и вызовы инструментов.

  • Трассы со спанами поиска документов, ранжирования, проверки ограничений и работы с памятью не требуют специальной настройки.

Вопросы и ответы

Какие агентные стеки можно подключить к оценке?

Поддерживаются LangGraph, LlamaIndex, OpenAI Agents SDK, Google ADK, Claude Agent SDK и Strands Agents при передаче телеметрии через OpenTelemetry.

Как данные агента попадают в сервис оценки?

В AgentCore runtime инфраструктура ADOT направляет OpenTelemetry-спаны и записи событий в Amazon CloudWatch.

Нужно ли отдельно настраивать трассировку поиска, ранжирования и памяти?

Нет. Трассы со спанами поиска документов, ранжирования, проверки ограничений и работы с памятью обрабатываются без специальной настройки; оценщики используют три основные роли спанов: цикл запроса и ответа, обращения к модели и вызовы инструментов.

Контекст по теме

Как процитировать

«Amazon Bedrock AgentCore Evaluations отделяет оценку ИИ-агентов от выбора фреймворка». hegai.media, 26 августа 2026 г.. https://hegai.media/novosti/amazon-bedrock-agentcore-evaluations-otdelyaet-otsenku-ii-agentov-ot-v--10be4b02-bdb5-4b95-8311-5d89938ac8a1

так материал выглядит в мессенджере