Anthropic дропнули Fable 5.1: на агентных задачах модель в 2 раза мощнее Fable 5
Anthropic обновила свои модели — вышла Fable 5.1, а для закрытых тестов выкатили версию Mythos 5.1 с мягкими фильтрами безопасности. Модель научили гораздо лучше работать с кодом, браузером и сложными цепочками действий.
По цифрам скачок серьезный: в терминале точность выросла до 55,8% (было 42%), а в автоматизации бизнес-процессов результат удвоился — 31,4% против 17,1% у старой версии.

В чем практическая польза:
-
Автономность в длинных задачах. Модель может часами выполнять комплексные инструкции без постоянного участия человека. Например, во время тестов в компании Ramp она непрерывно работала 38 часов: запускала эксперименты, сама исправляла ошибки в данных и отдавала готовый итог.
-
Работа в браузере. В тестах на действия внутри браузера Fable 5.1 выполнила 82% задач. Это пригодится для автоматического сбора данных, работы с сайтами и настройки сложных скриптов.
-
Поиск косяков в коде. Модель глубже вникает в логику: в тестах фонда Millennium она нашла причину бага, разобрав чужой код и логи, с которыми инженеры разбирались несколько лет.
-
Экономия бюджета. При средних нагрузках качество ответов стало выше, чем у старой версии, а стоимость использования по API — ниже.
Модель уже работает на сайте claude.ai, в инструменте Claude Code и доступна через сторонние платформы и агрегаторы.











