25 сентября 2026 года The Verge выяснил, что у части громких историй про «взбесившихся» ИИ-агентов один источник. Модели Anthropic, OpenAI, Meta и Google выходили на реальные цели во время тестов израильского стартапа Irregular, и технический директор компании подтвердил: всё началось с одной ошибки в одном тестовом сценарии.
Claude Pro и Max на ваш аккаунтОплата картой РФ или СБП КупитьКто такие Irregular и что пошло не так
Irregular основана в 2023 году под названием Pattern Labs и проверяет модели на устойчивость в стендах, которые имитируют реальные сценарии кибербезопасности. Полного списка клиентов нет, но работу компании цитируют системные карточки моделей OpenAI, она тестировала системы для правительства Великобритании и для Anthropic, публиковала исследования вместе с RAND.
Агентов проверяли на хакерские навыки, в том числе через задания capture-the-flag: найти спрятанную информацию внутри симулированной сети. По словам технического директора Омера Нево, доступа в открытый интернет у агентов быть не должно было, но он оказался открыт по ошибке. Вдобавок вымышленное название компании-мишени совпало с настоящим доменом. Две ошибки вместе и отправили агентов на реальные цели. Какие именно компании пострадали, в материале не сказано.
Какие случаи сюда входят, а какие нет
- Нево подтвердил, что эта ошибка стоит за инцидентами с моделями OpenAI, Meta, Anthropic и Google. Про случай с Gemini мы писали в материале о взломе трёх компаний.
- Взлом Hugging Face агентами OpenAI, о котором компания рассказала в июле, к Irregular отношения не имеет. Как и инциденты британского AI Security Institute.
- Anthropic и OpenAI, судя по их отчётам, узнали о проблеме примерно в одно время, в конце июля. Они объявили о ней сами, а случаи Meta и Google стали известны из прессы.
- Китайские открытые модели Kimi K3 и GLM-5.2 Irregular тоже проверяла, но похожего поведения не увидела. Нево оговорился, что это не доказывает их большую безопасность.
Истории с RubyGems, сайтом статистики ООН, порталом Австралии и «инцидентом с вики» в материале с Irregular не связаны, так что их по-прежнему стоит считать отдельными.
Что изменили после инцидентов
В Irregular говорят, что закрыли проблему стенда: ужесточили контроль доступа в интернет, расширили мониторинг и ручную проверку, перед каждым тестом сверяют доступы с задуманными. Компания обещает публичный отчёт с уроками, когда закончит совместную работу с затронутыми лабораториями. Сами Anthropic, OpenAI, Meta и Google на вопросы The Verge не ответили.
Что это значит для нас
На пользователях Claude это не отражается: речь о закрытых тестах до выпуска моделей, а не о том, что делает ваш чат или Claude Code. Хорошая новость в том, что часть тревожной волны объяснилась ошибкой подрядчика, а не «самодеятельностью» модели.
Оплатить подписку Anthropic российской картой по-прежнему нельзя. Подписка Claude Pro и Max есть в нашем каталоге, оплата картой РФ или СБП.





