Компания Anthropic заявляет, что ученые использовали ее ИИ для создания биологического оружия

Компания Anthropic заявляет, что ученые использовали ее ИИ для создания биологического оружия
Anthropic признала, что ученые использовали ее ИИ Claude для биологических исследований, которые могут быть применены для создания оружия. Компания заблокировала учетные записи, но не смогла установить намерения исследователей. Откровения прозвучали через день после ухода бывшего сотрудника Джейкоба Коксона, предупредившего об угрозе вымирания человечества. 

Компания Anthropic, разработчик чат-бота Claude, признала, что ее искусственный интеллект использовался учеными для деликатных биологических исследований, которые, по опасениям компании, могли найти применение в разработке оружия. Отчет опубликован в четверг, 10 сентября. Речь идет о работе по усилению функций вирусов и экспериментах с патогенами, обладающими пандемическим потенциалом.

Anthropic заявила, что не может определить истинные намерения исследователей, поскольку одна и та же научная работа может иметь как законное медицинское применение, так и опасные последствия. Компания заблокировала связанные учетные записи и ограничила доступ в тех случаях, когда выявила нарушения своих мер безопасности и политики.

Вирус чикунгунья и военный институт

Один из случаев, описанных в отчете, касается вируса чикунгунья, передаваемого комарами и способного вызывать сильную боль и лихорадку. Ученый обратился к Claude за помощью в подготовке заявки на грант для проведения исследований по усилению функций вируса. Предлагаемая работа была направлена на выявление мутаций, влияющих на трансмиссивность и уклонение от иммунного ответа, а затем на внедрение этих изменений в вирус.

Компания заявила, что результаты исследования могли найти законное применение, в том числе в разработке вакцин и терапевтических средств. Однако этот случай вызвал особую обеспокоенность, поскольку работы предполагалось проводить в военно-исследовательском институте в неизвестной стране. Anthropic не раскрыла названия учреждений, стран и конкретных биологических агентов, чтобы не подвергать ученых опасности.

ИИ как инструмент двойного назначения

Руководитель отдела анализа угроз Anthropic Джейкоб Кляйн отметил в беседе с The New York Times, что ситуация не является типичным сюжетом из комиксов, где кто-то прямо заявляет о желании создать биологическое оружие для уничтожения мира. По его словам, это невероятно сложная ситуация, поскольку грань между законными исследованиями и опасными применениями размыта.

Anthropic также описала случай, когда Claude использовался для исследований птичьего гриппа и его усиленного пандемического потенциала. Ученый, работающий за пределами США, просил ИИ проанализировать данные и помочь в написании научных результатов. В этом случае использовались модели Claude Sonnet 4 и Haiku 4.5, которые компания считает менее защищенными, чем более мощные модели.

По данным Anthropic, существующие меры безопасности на фронтирных моделях оказались достаточно надежными, чтобы вынудить исследователей использовать более слабые и менее защищенные версии. В компании отметили, что более мощные модели Claude Mythos и Fable имеют усиленные механизмы защиты и реже подвергаются злоупотреблениям.

Предупреждение изнутри компании

Отчет Anthropic появился всего через день после того, как бывший исследователь компании Джейкоб Коксон выступил с публичным предупреждением. 27-летний специалист, проработавший три года в OpenAI и Anthropic, заявил в интервью NBC News, что существует значительная вероятность того, что технология может убить всех людей, и подчеркнул, что это не преувеличение и не маркетинговый трюк.

Коксон уволился из Anthropic, опубликовав в социальной сети X пост, в котором обвинил обе компании в безответственности. По его словам, они мчатся к самосовершенствующемуся сверхинтеллекту и играют с жизнями людей. Он призвал коллег высказываться и предложил временный запрет на улучшение возможностей моделей ИИ, чтобы выиграть время для международной координации и контроля безопасности.

Руководитель направления Alignment Science в Anthropic Эван Хубингер поддержал предупреждения Коксона. Он признал, что оценивает вероятность катастрофы в течение десятилетия более чем в 10 процентов, и добавил, что у компании нет решения для согласования сверхразума.

Что это значит

Отчет Anthropic - первый публичный случай, когда компания в сфере ИИ признает реальные примеры потенциального злоупотребления своими моделями для разработки биологического оружия. В документе на 154 страницах компания также описывает другие категории угроз, включая разработку обычных вооружений и кибероперации с использованием ИИ.

Для России эти откровения имеют значение в контексте глобальных дискуссий о регулировании ИИ. Они показывают, что даже компании, декларирующие приверженность безопасности, сталкиваются с использованием их технологий в опасных целях. Вопрос о том, как контролировать двойное назначение ИИ-моделей, остается открытым и требует международного подхода.

Ранее в разделе

«ИИ может убить всех»: инсайдеры Anthropic бьют тревогу изнутри компании Дочь сенатора и «золотой парашют»: как OpenAI страхуется перед выборами в США MapQuest взлетел на первое место в App Store, отказавшись переименовывать озеро Онтарио по указу Трампа

Нашли ошибку?