Anthropic смягчила биологические фильтры Claude Fable 5

Anthropic переписала биологический классификатор Claude Fable 5: доля ошибочных переключений на слабую модель упала примерно на 85%. Fable 5 чаще помогает с анализами и симптомами, а вирусология и токсикология по-прежнему уходят на Opus 5.
Anthropic смягчила биологические фильтры Claude Fable 5

При запуске Claude Fable 5 в начале июня Anthropic сознательно заблокировала почти все биологические запросы к модели - так безопаснее, но неудобнее пользователю. 7 августа компания объявила, что переработала классификатор, который решает, пускать ли запрос к Fable 5 или отправить его на менее способную модель.

Ложных срабатываний стало на 85% меньше

Anthropic переписала «конституцию» классификатора - свод правил, по которым система отличает безопасные биологические вопросы от потенциально опасных. Новую версию собрали с участием внутренних и внешних экспертов, обучили на свежих данных и проверили, что она по-прежнему ловит опасный контент, но реже блокирует безобидный. По внутренним тестам биологические «откаты» на слабую модель сократились примерно на 85% по всем продуктам Claude.

Где Fable 5 стал полезнее

Практическое следствие - меньше ложных блокировок на повседневных медицинских и учебных вопросах: разбор результатов анализов, объяснение симптомов, биология в учебном контексте. Врачи и другие специалисты здравоохранения смогут получать от Fable 5 больше поддержки в клинических задачах, которые раньше упирались в излишне осторожный фильтр.

Вирусология и токсикология остаются под замком

Профессиональный доступ к возможностям Fable 5 в биологии по-прежнему закрыт. Запросы двойного назначения - вирусология, токсикология, молекулярный дизайн - классификатор всё так же перенаправляет на Opus 5, менее способную в этой области модель. Для разработки лекарств и профессиональных биологических исследований Fable 5 пока не предназначена: Anthropic обещает открыть эти возможности через отдельные программы доверенного доступа.

Зачем вообще такая осторожность

Anthropic объясняет жёсткость фильтров возможностями самой модели: по внутренним оценкам, Fable 5 на некоторых сложных биологических задачах превосходит экспертов и может дать «существенный прирост» возможностей злоумышленнику - то есть подсказать то, что иначе взять неоткуда. Провести границу между пользой и вредом здесь не всегда просто: например, для разработки лекарства от гипертонии каптоприла учёные когда-то выделяли токсичные компоненты из яда змеи, а работа над живыми вакцинами требует выращивать тот же патоген, от которого вакцина защищает. Ежегодный отчёт разведки США за 2026 год, на который ссылается Anthropic, прямо говорит о риске, что такие возможности ИИ могут ускорить программы биологического оружия у отдельных государств.

Итог в цифрах - минус 67% отказов

С учётом всех причин отказов, а не только биологических, Anthropic оценивает суммарное снижение так: на 67% в Claude.ai, на 55% в Cowork, на 17% в Claude Code и на 7% на платформе для разработчиков - там, где доля именно биологических запросов ниже. Разница в цифрах по продуктам показывает, где раньше чаще всего страдали обычные пользователи с безобидными вопросами.

Anthropic называет доверенный доступ для профессиональных биологов следующим шагом, но конкретных сроков не называет. Пока граница остаётся прежней: любителям и врачам - шире, исследователям опасных направлений - нет.

13:20
44
Нет комментариев. Ваш будет первым!