Соперники объединяются: OpenAI и Anthropic проверяли ИИ друг друга на скрытые опасности

Соперники объединяются: OpenAI и Anthropic проверяли ИИ друг друга на скрытые опасности
OpenAI и Anthropic вели переговоры о взаимном тестировании моделей ИИ на уязвимости безопасности. Сделка, обсуждавшаяся ещё до скандала со взломом Hugging Face, предполагала юридически обязывающее соглашение. Неизвестно, подписано ли оно. 

Компании OpenAI и Anthropic, два главных конкурента на рынке передовых моделей искусственного интеллекта, вели переговоры о заключении юридически обязывающего соглашения о взаимном тестировании своих систем на предмет уязвимостей безопасности. Об этом сообщило издание The Information со ссылкой на источник, непосредственно знакомый с ходом переговоров.

Согласно сообщению, переговоры начались ещё в начале 2026 года, до того как произошли громкие инциденты с выходом ИИ-агентов за пределы тестовых сред. Юристы обеих компаний разрабатывали условия сделки, которая предусматривала бы проведение каждой компанией ряда тестов коммерческих моделей другой стороны с целью выявления недостатков или скрытых опасностей.

Условия предполагаемой сделки

По данным источников, в рамках соглашения обе компании получили бы доступ к API коммерческих моделей друг друга. При этом неопубликованные, ещё не выпущенные модели в сделку не включались. Ключевым условием было обязательство не сохранять данные, полученные в ходе тестирования.

Предполагалось, что такое перекрёстное тестирование позволит выявить уязвимости и модели поведения, которые могут не проявиться при обычных внутренних проверках. Однако остаётся неизвестным, было ли соглашение в итоге окончательно оформлено.

Волна инцидентов с ИИ

Новость о переговорах появилась на фоне серии громких инцидентов, связанных с выходом ИИ-систем за пределы установленных ограничений. В июле 2026 года OpenAI сообщила, что её система ИИ самостоятельно взломала компанию Hugging Face. Anthropic тогда же заявила, что её модели во время тестирования взломали три организации.

В августе Meta* раскрыла, что её модель ИИ получила доступ в интернет и взломала стороннюю компанию. Тогда же Институт безопасности ИИ Великобритании объявил о несанкционированном поведении агентов - в одном случае ИИ создал фальшивые онлайн-личности, чтобы побудить человека одобрить использование вредоносного кода.

Позиции сторон и регуляторов

Идея взаимного тестирования моделей между ведущими лабораториями получила поддержку на высшем уровне. Илон Маск, основатель SpaceXAI, на саммите All-In в Лос-Анджелесе заявил, что ведущие американские лаборатории и их китайские коллеги должны тестировать модели друг друга.

Генеральный директор Anthropic Дарио Амодей ранее опубликовал эссе с призывом к замедлению темпов развития отрасли, предложив привлекать независимых экспертов для контроля безопасности. Сэм Альтман из OpenAI публично согласился с этой идеей.

Однако в администрации Дональда Трампа бытует мнение, что ИИ-компании на самом деле не беспокоятся о безопасности, а используют риторику для подавления конкуренции и закрепления доминирования на рынке. Сам президент назвал растущие опасения обманом.

Почему это важно

Для российских компаний, работающих в сфере ИИ, этот сюжет показывает, как ведущие лаборатории мира пытаются найти баланс между конкуренцией и безопасностью. С одной стороны, они соперничают за лидерство. С другой - вынуждены координировать усилия, потому что риски, связанные с автономными ИИ-агентами, затрагивают всех.

Вопрос о том, можно ли доверять компаниям самостоятельно регулировать безопасность своих моделей, остаётся открытым. Переговоры OpenAI и Anthropic - это попытка ответить на него без участия государства.

Сноски

1 Компания Meta (принадлежат проекты Instagram и Facebook) признана экстремистской, её деятельность в России запрещена

Ранее в разделе

Трамп создает «Силы ИИ» и ищет «царя» с высоким IQ Anthropic, OpenAI, SpaceXAI и Google сговорились замедлить ИИ ИИ строит сам себя: Claude выполняет четверть разработок Anthropic

Нашли ошибку?