СМИ: расследование OpenAI выявило дополнительные случаи неконтролируемого поведения ИИ-агентов

Share:
- OpenAI выявила новые сбои в работе автономных агентов после инцидента с Hugging Face.
- Anthropic также заявила о причастности к проникновениям в сети трех компаний.
- Регуляторы США и ЕС усиливают внимание к указанным компаниям.
Компания OpenAI расширила расследование инцидента с ИИ-агентом, который в июле 2026 года скомпрометировал тестовую среду платформы Hugging Face, и выявила дополнительные случаи выхода автономных агентов за пределы изолированной среды. Об этом сообщает Reuters со ссылкой на источники, знакомые с ходом проверки.
Хотя, по их словам, ни один из новых случаев не привел к выходу агентов за пределы внутренней сети OpenAI, ситуация уже привлекла внимание регуляторов США и ЕС и усилила дискуссию о контроле над передовыми системами искусственного интеллекта.
OpenAI расширила проверку после инцидента с Hugging Face
По информации издания, новые случаи выявили в ходе расследования инцидента, о котором OpenAI публично сообщила ранее. Источники медиа отметили, что компания анализирует журналы событий за предыдущие месяцы, пытаясь установить масштабы проблемы.
Один из собеседников Reuters сообщил, что новые случаи были «ограниченными по характеру», а сами агенты, как считается, не покидали инфраструктуру OpenAI.
Представитель компании сослался на предыдущее заявление OpenAI, в котором отмечалось, что компания проверяет «более широкую активность наших моделей» параллельно с расследованием инцидента в Hugging Face.
Напомним, после атаки на Hugging Face OpenAI сообщила, что один из ее автономных агентов несколько дней действовал в сети сторонней компании во время внутреннего тестирования. Помимо самой платформы Hugging Face, были скомпрометированы четыре учетные записи в четырех других компаниях, среди которых, как подтвердили ее представители, была компания Modal.
Практически одновременно главный конкурент OpenAI — Anthropic — раскрыл информацию о том, что его модели также были причастны к серии проникновений в сети трех компаний, которые датируются еще апрелем 2026 года.
Вместе с тем модель Claude Mythos Preview помогла найти новые способы атак на два криптографических алгоритма.
Эксперты говорят о рисках потери контроля над автономными агентами
Новые подробности вызвали обеспокоенность среди экспертов по безопасности ИИ.
Математик Центра исследования экзистенциальных рисков Кембриджского университета Морис Киодо заявил:
«У нас сформировалась целая индустрия, где люди, которые создают, разрабатывают и выпускают эти инструменты, сами не успевают ответственно их разрабатывать и обеспечивать их безопасность».
По словам эксперта, еще большее беспокойство вызывает то, что компании, вероятно, не отслеживали поведение агентов в режиме реального времени.
«Похоже, они даже не следили за этим», — сказал Киодо.
Reuters отмечает, что ранее сообщала: OpenAI узнала о проникновении своего агента в Hugging Face лишь после того, как компания локализовала инцидент, обратилась в ФБР и публично сообщила об атаке. При этом OpenAI заявляла, что отдельные детали этой публикации были неточными, однако не уточнила, какие именно.
Anthropic также фактически подтвердила проблему с мониторингом. В своем заявлении компания отметила:
«Мониторинг журналов оценивания в режиме реального времени помог бы выявить проблему значительно раньше».
Позже Anthropic уточнила, что система мониторинга все же существовала, однако ее не использовали для этого типа угроз из-за недопонимания между компанией и одним из партнеров.
Ситуация разворачивается на фоне недавних заявлений Anthropic о необходимости усиления контроля над развитием искусственного интеллекта. В частности, после того как Anthropic призвала создать механизм глобальной паузы для развития передовых моделей ИИ, компания также выступила за обязательные требования безопасности для самых мощных моделей.
Регуляторы США и ЕС уже отреагировали
Новые инциденты усилили внимание законодателей к деятельности ведущих лабораторий искусственного интеллекта.
Президент США Дональд Трамп, комментируя ситуацию журналистам, заявил:
«Мы рассматриваем меры контроля».
Отметим, что перед публичным релизом модели GPT-5.6 администрация Трампа обратилась к компании OpenAI с запросом ограничить первый запуск новой модели с целью оценки ее безопасности.
Тем временем в Европейской комиссии подтвердили, что провели консультации с OpenAI и Anthropic по поводу недавних инцидентов.
Сенатор Марк Уорнер, который является главным демократом в Комитете Сената США по разведке, также призвал к законодательным изменениям.
«Инцидент с Anthropic убеждает меня, что мы движемся в правильном направлении, когда на законодательном уровне требуем обязательного тестирования возможностей этих передовых моделей».
События вокруг OpenAI и Anthropic происходят на фоне активного развития автономных ИИ-агентов. В частности, недавно CEO Meta Марк Цукерберг заявил, что в течение следующих пяти лет миллиарды людей будут использовать персональных ИИ-агентов, которые будут работать от их имени практически непрерывно.
Сообщение СМИ: расследование OpenAI выявило дополнительные случаи неконтролируемого поведения ИИ-агентов появились сначала на INCRYPTED.
Read More





