Anthropic выпустила Claude Fable 5.1 и Claude Mythos 5.1 — две версии одной модели с разными защитными ограничениями. В тесте на самостоятельное решение научных задач Fable 5.1 набрала 52,6% против 24,7% у предыдущей Fable 5.

Защитные фильтры прошлой версии иногда блокировали безопасные запросы, особенно в кибербезопасности и биологии. Anthropic сделала эти фильтры точнее, после чего открыла Fable 5.1 для широкой аудитории, а более свободный режим Mythos 5.1 оставила специалистам, которые прошли проверку.
Fable 5.1 рассчитана на программирование, поиск и анализ информации, подготовку материалов и задачи, которые модель выполняет самостоятельно в течение нескольких часов. По данным Anthropic, обновленная версия лучше находит причины программных сбоев, проверяет собственную работу и сохраняет связность при длинной последовательности действий. В тесте деловых задач ее результат вырос с 17,1% до 31,4%, а партнеры Glean выбирали ее ответы примерно вдвое чаще, чем ответы Fable 5.
Доступ к Fable 5.1 уже появился во всех сервисах Claude, а также на облачных платформах Amazon, Google и Microsoft. Модель разрешили использовать для поиска уязвимостей в программах, но запросы на создание инструментов для атак по-прежнему перенаправляют на версии с более строгими ограничениями. Anthropic ожидает, что обновленные фильтры будут вмешиваться в работу специалистов по кибербезопасности примерно на 60% реже.
Mythos 5.1 работает на той же основе, но получает меньше ограничений в профессиональных исследованиях. Сейчас ее предоставляют проверенным организациям в США, которые занимаются защитой компьютерных систем и биологией. В одном из экспериментов модель проектировала белковые молекулы для разработки лекарств: почти 50% вариантов сработали в лаборатории при обычном показателе 10–15%.
Источник: Anthropic