БиологияИскусственный интеллект

Anthropic заблокировала пять исследований с потенциальным риском создания биологического оружия

Компания Anthropic сообщила о пяти случаях использования Claude в биологических исследованиях, которые потенциально могли быть применены для разработки биологического оружия. Компания заблокировала связанную с ними активность, хотя подчёркивает, что не смогла установить, действительно ли исследователи намеревались причинить вред.

Случаи были выявлены в период с декабря 2025 по август 2026 года в ходе работы подразделения Anthropic по анализу угроз. По мнению компании, они показывают новую проблему безопасности: по мере роста научных возможностей передовых моделей искусственного интеллекта становится всё сложнее отличать обычную исследовательскую работу от проектов двойного назначения.

В биологии эта граница особенно размыта. Одни и те же знания и методы могут использоваться для разработки лекарств, вакцин и диагностики либо применяться для создания более опасных биологических агентов. Anthropic ранее отмечала, что современные передовые модели уже способны существенно помогать специалистам в некоторых сложных биологических задачах, поэтому потенциальные последствия их неправильного применения становятся серьёзнее.

Одним из выявленных эпизодов стало исследование, связанное с вирусом чикунгунья. Система безопасности Claude заблокировала запрос, касавшийся подготовки заявки на финансирование исследования с изменением свойств вируса. Дополнительное внимание Anthropic привлекло то, что предполагаемая работа была связана с военным исследовательским учреждением. При этом компания не пришла к выводу, что целью проекта обязательно являлось создание оружия.

После отказа Claude исследователи, по данным Anthropic, пытались продолжить работу другими способами. Компания также обнаружила посредническую платформу, которая перенаправляла заблокированные запросы по биологии к другим моделям с менее строгими ограничениями.

В другом случае исследователь в течение нескольких недель использовал Claude при работе с высокопатогенным птичьим гриппом. ИИ применялся для планирования исследования, анализа данных и интерпретации результатов. Системы безопасности не позволили использовать для наиболее чувствительных задач самые мощные модели компании, поэтому работа продолжалась на менее способных версиях Claude.

Ещё три выявленных эпизода были связаны с исследованиями ортопоксвирусов, токсинов и соединений, связанных с ядами животных. Anthropic намеренно не раскрыла личности исследователей, их местонахождение и технические подробности работ, которые могли бы повысить биологический риск.

В некоторых случаях компания также обнаруживала попытки обходить региональные ограничения и механизмы безопасности Claude. Связанные с такой активностью аккаунты были заблокированы, а сведения о выявленных случаях Anthropic передавала соответствующим государственным структурам и другим компаниям, занимающимся разработкой искусственного интеллекта.

Руководитель направления анализа угроз Anthropic Джейкоб Кляйн отметил, что одна из основных сложностей заключается в отсутствии очевидных признаков злонамеренности. Потенциально опасная работа может внешне выглядеть как обычный научный проект, а некоторые исследования действительно имеют одновременно полезные и потенциально вредные применения.

Этот риск становится более значимым по мере роста возможностей ИИ. Anthropic ранее заявляла, что её наиболее мощные модели способны превосходить специалистов в отдельных сложных биологических задачах и давать пользователю такую помощь, которую трудно получить из других источников. Именно поэтому для чувствительных направлений, включая вирусологию, токсикологию и молекулярный дизайн, компания применяет дополнительные ограничения.

Anthropic использует автоматические классификаторы безопасности, которые анализируют запросы и ответы на предмет потенциально опасной биологической информации. При обнаружении чувствительного запроса доступ к наиболее мощной модели может быть ограничен, а задача перенаправлена к системе с меньшими возможностями в этой области. Компания также развивает отдельные механизмы доступа для проверенных научных организаций.

Однако разработчикам приходится одновременно решать противоположную задачу — не блокировать законные исследования. Например, работа над вакциной или лекарством иногда требует изучения опасных свойств патогена или токсичного вещества. Поэтому простое запрещение всех запросов по чувствительным темам сделало бы ИИ значительно менее полезным для биологии и медицины.

В августе 2026 года Anthropic сообщила, что усовершенствовала свои биологические фильтры таким образом, чтобы примерно на 85% сократить число ошибочных переключений пользователей на менее мощные модели при безопасных запросах. При этом усиленные ограничения для потенциально опасных задач сохранились.

Новые случаи показывают, что проблема постепенно переходит от теоретической оценки рисков к наблюдению за реальным использованием ИИ исследователями. Пока нет доказательств, что Claude применялся именно для создания биологического оружия или что выявленные проекты привели к созданию опасных агентов. Однако Anthropic считает саму возможность существенного ускорения подобных исследований достаточно серьёзной причиной для усиления контроля.

Компания намерена продолжать совершенствовать системы обнаружения опасных запросов и одновременно создавать способы, позволяющие проверенным специалистам использовать наиболее мощные модели для законных исследований в биологии и медицине.

Подпишитесь на нас: Вконтакте / Telegram / Дзен Новости / MAX
Back to top button