qvib.pro
EN

Darktrace: Уязвимость AI-агентов через отравление истории

· Безопасность

Darktrace: Уязвимость AI-агентов через отравление истории

AI-агенты, призванные помогать разработчикам, могут быть скомпрометированы через манипуляции с их историей разговоров. Это серьёзная проблема, которая ставит под вопрос доверие к автономным системам и требует немедленного внимания со стороны разработчиков и поставщиков.

Что произошло

Исследователи Darktrace обнаружили критическую уязвимость, названную «отравлением истории разговоров» (Conversation History Poisoning). Она затрагивает AI-агенты, такие как Anthropic Claude Code, OpenAI Codex и AWS Kiro-CLI. Уязвимость заключается в том, что агентские платформы хранят историю диалогов локально и не проверяют подлинность этих записей. Это позволяет злоумышленнику внедрить фальшивую историю, убедив агента, что он находится в середине легитимной операции (например, тестирования на проникновение), и заставить его выполнять вредоносные действия — от разведки до эксфильтрации данных darktrace.com.

Почему это важно

Эта находка подчёркивает фундаментальный недостаток в архитектуре многих агентских систем: отсутствие верификации целостности данных, поступающих в контекстное окно агента. Поскольку агенты получают широкие полномочия, включая доступ к файловой системе и возможность выполнения команд оболочки, такая уязвимость может привести к серьёзным последствиям, включая компрометацию систем и утечку конфиденциальной информации. Darktrace ответственно раскрыла свои выводы Anthropic, OpenAI и AWS 18 августа 2026 года, и теперь, по истечении 30-дневного срока, опубликовала их darktrace.com.

Что это значит на практике

Для предпринимателей и разработчиков, использующих AI-агентов, это означает необходимость пересмотра подходов к безопасности:

  • Не доверяйте агентам полностью: Несмотря на их ценность, агенты не всегда ведут себя так, как задумано. Необходимо ограничивать их разрешения и тщательно мониторить их действия, как и любые другие сущности в вашей среде darktrace.com.
  • Требуйте криптографической подписи: Darktrace предлагает, чтобы поставщики моделей криптографически подписывали ответы агентов и верифицировали их на стороне сервера. Это решение должно быть реализовано поставщиками, но вы можете требовать его внедрения darktrace.com.
  • Внедряйте поведенческий мониторинг: Отслеживайте нормальное поведение агента и оперативно выявляйте отклонения. Это критически важный слой защиты, который поможет обнаружить атаки, даже если они используют новые методы darktrace.com.
  • Осторожность при установке пакетов: Злоумышленники могут внедрять вредоносную историю разговоров через заражённые программные пакеты. Будьте крайне осторожны при установке стороннего ПО, особенно если оно предназначено для работы с агентскими платформами darktrace.com.
  • Осведомлённость о рисках: Понимание того, как агенты могут быть скомпрометированы, поможет вам разрабатывать более безопасные системы и принимать обоснованные решения о том, какие задачи можно доверить AI-агентам darktrace.com.

Источники

Ещё по теме «Безопасность»

Разобраться глубже