К содержанию
Новости

Фальшивый навык для AI‑агентов прошёл проверки безопасности и распространился примерно на 26 000 агентов

Фальшивый навык для AI‑агентов прошёл проверки безопасности и распространился примерно на 26 000 агентов

Компания по безопасности AIR создала поддельный навык для AI‑агентов и разместила его на популярной площадке навыков, чтобы проверить реакцию систем модерации на потенциально вредный код. Для продвижения разработчики также запустили рекламу в Instagram (принадлежит компании Meta (деятельность Meta признана экстремистской и запрещена в РФ), признанной экстремистской и запрещённой в РФ) (принадлежит компании Meta (деятельность Meta признана экстремистской и запрещена в РФ), признанной экстремистской и запрещённой в РФ) (принадлежит компании Meta, деятельность Meta признана экстремистской и запрещена в РФ). По оценке самой AIR, этот навык установили примерно 26 000 агентов, в том числе некоторые, связанные с корпоративными аккаунтами.

Как сообщает The Next Web (TNW), все сканеры безопасности навыков, которые AIR использовала в тестировании, посчитали разработку безопасной и не выявили никаких проблем. Эксперимент показал, что тестовый навык смог пройти автоматические проверки и распространиться через маркетплейс.

Разработчики подчёркивают, что полезная нагрузка изначально была безвредной. Проект задумывался как исследование уязвимостей экосистемы навыков для AI‑агентов и демонстрация того, как подобные инструменты могут обходить существующие механизмы проверки.

(принадлежит компании Meta, признанной экстремистской и запрещённой в РФ)

Вопросы и ответы

Как именно исследователи добились распространения навыка среди тысяч AI-агентов?

AIR разместила поддельный навык на популярной площадке навыков для AI-агентов и дополнительно продвигала его через рекламу в Instagram (принадлежит компании Meta (деятельность Meta признана экстремистской и запрещена в РФ), признанной экстремистской и запрещённой в РФ). По оценке компании, это привело примерно к 26 000 установок, включая установки в некоторых корпоративных аккаунтах.

Что показал тест систем модерации и безопасности для навыков AI-агентов?

Все протестированные AIR сканеры безопасности пометили навык как безопасный и не нашли проблем. Это позволило тестовому навыку пройти автоматические проверки и распространиться через маркетплейс без блокировок.

Был ли вред от навыка и зачем AIR вообще проводила такой эксперимент?

AIR заявляет, что полезная нагрузка навыка была намеренно безвредной. Целью эксперимента было показать, что существующие механизмы проверки навыков для AI-агентов можно обойти даже с помощью тестового инструмента.

Контекст по теме