Anthropic снизил число ложных срабатываний фильтров биологии Fable 5 на 85%, но сохранил ограничения на вирусологию
Материал подготовлен искусственным интеллектом на основе нескольких источников — ссылки на оригиналы приведены ниже.

Anthropic сократил ложные срабатывания в фильтрах безопасности биологии модели Fable 5 примерно на 85%, что позволяет пользователям интерпретировать лабораторные анализы и отвечать на медицинские вопросы. Это изменение последовало за критикой учёных, считавших, что модель чрезмерно блокировала почти все биологические запросы. Ограничения сохраняются для тем двойного назначения, таких как вирусология и токсикология, где, по мнению Anthropic, Fable 5 может предоставить возможности, недоступные злоумышленникам.
Корректировка фильтров
Ранее почти все биологические запросы блокировались и перенаправлялись на менее способную модель Opus 5, что вызвало резкую критику учёных. Теперь Anthropic заявляет, что пользователи могут выполнять с Fable 5 гораздо больше биологических задач, включая интерпретацию лабораторных анализов, понимание симптомов и ответы на медицинские вопросы. Сокращение ложных срабатываний на 85% призвано улучшить удобство, сохраняя при этом защиту от злоупотреблений.
Оставшиеся ограничения
Ограничения сохраняются для тем двойного назначения, таких как вирусология, токсикология и молекулярный дизайн. Anthropic утверждает, что Fable 5 может дать злоумышленникам возможности, недоступные им где-либо ещё. Компания разрабатывает программы доступа для исследователей, чтобы в будущем использовать эти ограниченные функции в контролируемых условиях.
Обоснование и риски
Anthropic настаивает, что биологические риски сдержать сложнее, чем кибератаки, так как выпущенный вирус нельзя отключить, а контрмеры требуют времени. Компания ссылается на анализ разведывательных служб США, обзор чатов ChatGPT с запросами инструкций по биооружию, совместные предупреждения исследователей и проект Стэнфорда, в котором ИИ использовался для создания полностью синтетических вирусов, как на доказательство реальности угрозы.
Что дальше
Anthropic разрабатывает программы доступа для исследователей к ограниченным функциям, но сроки не объявлены. Остаётся неясным, как компания будет балансировать научную полезность и риски двойного назначения по мере развития возможностей ИИ.
1 источник
Anthropic снизил число ложных срабатываний фильтров биологии Fable 5 на 85%, но сохранил ограничения на вирусологию



