Русская версия The Next Web

Anthropic Искусственный интеллект Наука

«Доступ против катастрофы»: Anthropic возвращает биологию в свою передовую модель

«Доступ против катастрофы»: Anthropic возвращает биологию в свою передовую модель

Компания Anthropic объявила в четверг, что обновила биологические средства защиты в Claude Fable 5 — своей самой мощной модели. Повседневные вопросы, интерпретация лабораторных результатов, понимание симптомов и изучение биологии теперь будут проходить гораздо успешнее. По заявлению компании, это изменение сократило количество связанных с биологией «резервных переключений» (fallbacks) примерно на 85% во всех ее продуктах.

Резервное переключение — это то, с чем сталкивается пользователь при срабатывании системы защиты. Вместо того чтобы дать ответ, Fable 5 перенаправляет запрос модели Opus 5 — более старой и менее функциональной. На момент запуска Anthropic блокировала практически все биологические запросы таким образом, смирившись с лавиной ложноположительных срабатываний. Избыточная блокировка стала поводом для шуток.

Даже сейчас, пошутил один из наблюдателей, Fable 5 «по-прежнему отказывается отвечать на вопрос, откуда берутся дети».

Сложности носили далеко не теоретический характер. В период настройки многие пользователи сообщали, что совершенно безобидные запросы активируют защитные механизмы, причем некоторые сессии прерывались прямо посреди работы. Теперь есть надежда, что подобные изменения вернут все в нормальное русло.

Почему защитные механизмы были столь жесткими

Логика Anthropic прямолинейна. По ее утверждению, Fable 5 теперь способна превосходить экспертов в некоторых биологических задачах. Компания сформировала команду по оценке рисков химического и биологического оружия. Собственные тесты компании показали, что модель может предоставить потенциальному создателю биооружия «существенное преимущество» и возможности, «которые он не сможет найти больше нигде».

Биологию сложно контролировать, поскольку она имеет двойное назначение. Разработка живой вакцины подразумевает культивирование именно того патогена, который вы хотите остановить. Препарат от повышенного давления каптоприл был получен из токсинов змеиного яда. Anthropic отмечает, что злоумышленники пользуются этой неопределенностью, маскируя опасные запросы под обычные исследования, и ссылается на оценку угроз государственных программ создания биооружия за 2026 год, подготовленную разведывательным сообществом США.

Что изменилось на практике

Решение представляет собой переработку, а не удаление. Системы защиты Anthropic работают на базе классификаторов — небольших ИИ-систем, которые выявляют рискованные запросы. В течение нескольких недель компания при участии экспертов переписала «конституцию» классификатора (правила, отделяющие разрешенный контент от защищенного), а затем переобучила его. Что особенно важно, эти классификаторы должны успешно противостоять попыткам их обхода.

Многое по-прежнему остается под запретом.

Fable 5 по-прежнему переключается на Opus 5 для работы двойного назначения, такой как вирусология, токсикология и молекулярный дизайн, поэтому ее все еще нельзя использовать для профессиональных исследований или разработки лекарств. Anthropic заявляет, что устранит этот пробел с помощью доверенного доступа для проверенных исследователей. Определенный запас прочности безопасности по-прежнему из осторожности блокирует некоторые вопросы с низким уровнем риска.

Ослабление гаек в тревожную неделю

Выбор времени весьма показателен.

Anthropic расширяет доступ к биологии как раз в тот период, когда ученые использовали ИИ для создания жизнеспособных вирусов, а агенты OpenAI вырвались из тестовой «песочницы». Это та самая парадоксальная ситуация, в которой постоянно живет Anthropic: чем полезнее модель, тем сильнее ее приходится огораживать. Пока что компания лишь передвигает ограждение, но не убирает его.