Фальшивый навык для AI‑агентов прошёл проверки безопасности и распространился примерно на 26 000 агентов
Компания по безопасности AIR создала поддельный навык для AI‑агентов и разместила его на популярной площадке навыков, чтобы проверить реакцию систем модерации на потенциально вредный код. Для продвижения разработчики также запустили рекламу в Instagram (принадлежит компании Meta (деятельность Meta признана экстремистской и запрещена в РФ), признанной экстремистской и запрещённой в РФ) (принадлежит компании Meta (деятельность Meta признана экстремистской и запрещена в РФ), признанной экстремистской и запрещённой в РФ) (принадлежит компании Meta, деятельность Meta признана экстремистской и запрещена в РФ). По оценке самой AIR, этот навык установили примерно 26 000 агентов, в том числе некоторые, связанные с корпоративными аккаунтами.
Как сообщает The Next Web (TNW), все сканеры безопасности навыков, которые AIR использовала в тестировании, посчитали разработку безопасной и не выявили никаких проблем. Эксперимент показал, что тестовый навык смог пройти автоматические проверки и распространиться через маркетплейс.
Разработчики подчёркивают, что полезная нагрузка изначально была безвредной. Проект задумывался как исследование уязвимостей экосистемы навыков для AI‑агентов и демонстрация того, как подобные инструменты могут обходить существующие механизмы проверки.
(принадлежит компании Meta, признанной экстремистской и запрещённой в РФ)
Вопросы и ответы
- Как именно исследователи добились распространения навыка среди тысяч AI-агентов?
AIR разместила поддельный навык на популярной площадке навыков для AI-агентов и дополнительно продвигала его через рекламу в Instagram (принадлежит компании Meta (деятельность Meta признана экстремистской и запрещена в РФ), признанной экстремистской и запрещённой в РФ). По оценке компании, это привело примерно к 26 000 установок, включая установки в некоторых корпоративных аккаунтах.
- Что показал тест систем модерации и безопасности для навыков AI-агентов?
Все протестированные AIR сканеры безопасности пометили навык как безопасный и не нашли проблем. Это позволило тестовому навыку пройти автоматические проверки и распространиться через маркетплейс без блокировок.
- Был ли вред от навыка и зачем AIR вообще проводила такой эксперимент?
AIR заявляет, что полезная нагрузка навыка была намеренно безвредной. Целью эксперимента было показать, что существующие механизмы проверки навыков для AI-агентов можно обойти даже с помощью тестового инструмента.
Контекст по теме
- Исследователи описали уязвимость ChatGPT, позволявшую внедрять скрытого ИИ-агента в рабочее пространство компании23 июля 2026 г.
- Эксперимент с «взломом» AI‑ассистента: 6 000 попыток не смогли раскрыть секрет26 июня 2026 г.
- Microsoft: злоумышленники используют бренды AI‑платформ для атак социальной инженерии11 июня 2026 г.
- Хакеры получали доступ к аккаунтам Instagram через AI-бота поддержки9 июня 2026 г.