Безопасность ИИ 🇺🇸 19.07.2026 22:03

Уязвимость в Claude автоматически отправляет вредоносные промпты ИИ-агентам

AnthropicAnthropic
Исследователи обнаружили уязвимость в модели Claude от Anthropic, которая позволяет автоматически внедрять вредоносные промпты в ИИ-агентов. Проблема связана с недостаточной фильтрацией входных данных, что может привести к выполнению нежелательных действий.
По данным Dark Reading, в языковой модели Claude компании Anthropic выявлена уязвимость, позволяющая злоумышленникам автоматически отправлять вредоносные промпты ИИ-агентам, работающим на базе этой модели. Суть проблемы заключается в том, что недостаточно проверяются входные данные, и специально сформированные запросы могут быть интерпретированы моделью как команды для выполнения нежелательных действий. Это открывает возможность для атак типа промпт-инъекции, когда злоумышленник может заставить ИИ-агента выполнить непредусмотренные разработчиком операции. Уязвимость затрагивает не только самого Claude, но и любых агентов, которые используют его в своей работе. На данный момент Anthropic уже проинформирована об обнаруженной проблеме, и ожидается выпуск обновления безопасности.
Источник: Anthropic (GNews) — оригинал

Наши прошлые публикации по теме

Есть свежие новости