Anthropic представила Claude Opus 5.5 — первую модель нового семейства 5.5. Компания заявляет, что в большинстве рабочих задач она вышла на уровень более мощной Claude Fable 5.1, а основной прирост получила в программировании, самостоятельной работе с компьютером и длинных задачах.
Предыдущая Opus 5 вышла в июле, а в сентябре Anthropic представила Fable 5.1 как более производительную модель для сложной работы. В Opus 5.5 компания перенесла часть этого уровня возможностей в более быструю и экономичную модель, которая должна тратить меньше шагов и текста на выполнение одной задачи.
Сильнее всего изменения заметны в программировании. Один из ранних тестировщиков перенес кодовую базу из 680 тысяч строк менее чем за день. Другой поручил модели проверить и исправить проект на 200 тысяч строк: Opus 5.5 закончила работу меньше чем за три часа, тогда как Opus 5 потребовалось более 20 часов и в 2,5 раза больше обрабатываемого текста.
В тесте Terminal-Bench 4.0, где ИИ самостоятельно выполняет задачи через компьютерный терминал, Opus 5.5 набрала 66,4%. На FrontierCode для сложного программирования результат составил 54,4%. Anthropic сообщает, что ответы модели появляются более чем на 30% быстрее Opus 5, а отдельный Fast Mode может увеличить скорость до 2,5 раза.

Цена составляет $4 за миллион входных и $20 за миллион выходных токенов — на 20% меньше Opus 5. Однако Anthropic оценивает снижение стоимости типичной задачи примерно в 40%, поскольку новой модели требуется меньше токенов. Повторное чтение уже обработанного контекста подешевело на 60%, до $0,20 за миллион токенов.
Anthropic одновременно усилила ограничения для потенциально опасных запросов и до запуска передала модель на проверку независимым организациям METR и Frontier Design. В ближайшие недели компания планирует представить Sonnet 5.5 и Haiku 5.5.
Источник: Anthropic