Как сообщает Google Developers Blog, в ADK появилась встроенная система оценки голосовых агентов. Разработчики могут запускать многошаговые диалоги с симулированным пользователем, озвучивать его реплики через Gemini TTS, а после автоматически проверять ответы агента и работу инструментов.
В примере показан графовый процесс из трёх специализированных агентов на gemini-live-2.5-flash-native-audio. Аудиопоток остаётся открытым в течение всего разговора. Между этапами ADK передаёт состояние сессии и историю диалога, поэтому при смене агентов контекст не теряется.
Тестовые наборы поддерживают два варианта: разговорные сценарии с заданными целью и персоной, а также фиксированные диалоги с заранее записанными репликами пользователя. Качество оценивается по критериям на естественном языке. Проверять можно как всю траекторию, так и отдельные ответы и вызовы инструментов. Результаты отображаются в ADK Web, а запуск через CLI можно встроить в CI/CD.
Ключевые факты
Пример включает трёх специализированных агентов на gemini-live-2.5-flash-native-audio.
Аудиопоток сохраняется на протяжении всего взаимодействия, а состояние сессии и история разговора передаются между агентами.
Набор тестов может сочетать разговорные сценарии и фиксированные диалоги.
Реплики симулированного пользователя преобразуются в речь с помощью Gemini TTS.