Claude Fable 5.1: агент, который умеет сказать «я застрял»

Claude Fable 5.1: агент, который умеет сказать «я застрял»

1 сентября Anthropic выпустила Claude Fable 5.1 и Claude Mythos 5.1 — и судя по первой волне реакций в X, это тот редкий апдейт, где интереснее не бенчмарки, а то, как модель ведёт себя внутри длинной агентной задачи. Цена та же, что у Fable 5, но обращения к кешу подешевели на 75%, а поведение агента заметно изменилось.

Что нового в Claude Fable 5.1

Главная тема во всех постах от команды Anthropic — не сырой интеллект, а автономность. Модель, по словам Бориса Черни и Феликса Ризеберга, дальше продвигается в задаче до того, как ей понадобится подтверждение от человека, и — что важнее — умеет честно сказать, что застряла, вместо того чтобы делать вид, будто всё идёт по плану. Второй пункт из той же серии: она реже хватается за лёгкий обходной путь и чаще чинит первопричину проблемы, а не симптом. Для тех, кто гоняет Claude Code на реальных проектах, это не абстрактная похвала — это ровно то место, где агенты обычно теряют доверие: тихо застревают, накручивают костыли или рапортуют об успехе там, где его нет.

Отдельно команда отметила, что стиль письма модели стал заметнее естественнее — тоже деталь, которая важна не только для эссе и текстов, но и для агентных логов и объяснений, которые Claude Code выдаёт по ходу работы.

Дешёвый кеш и агентный кодинг

Техническая часть апдейта касается экономики длинных сессий. Cache reads подешевели на 75% при той же базовой цене — а это именно то, на чём держится стоимость длинных агентных задач: чем дольше живёт контекст, тем больше платится за повторные обращения к кешу, а не за новые токены. Отдельно важна деталь от разработчика @trq212: переключение уровня усилия (effort) больше не сбрасывает prompt cache. Раньше это было скрытой ловушкой — сменил режим ради более простой задачи и заплатил заново за весь контекст. Теперь можно спокойно понижать effort на задачах, где не нужна глубокая проверка или мало edge cases, не теряя кеш и не переплачивая.

Anthropic заодно обнулила 5-часовые и недельные лимиты для всех пользователей в день релиза — жест, который снимает часть боли у тех, кто уже упирался в лимиты на активном использовании Claude Code (эта боль хорошо знакома и владельцам подписки Max, где лимиты общие с интерактивной работой).

Как модель уже тестирует сообщество

Саймон Уиллисон, как обычно, прогнал новую модель через свой неофициальный бенчмарк — SVG пеликана на велосипеде. На максимальном уровне thinking Fable 5.1 выдал, по его словам, лучший результат из всех моделей Anthropic — ценой в 3,30 доллара за один запрос, после чего он же анимировал получившуюся картинку. Другие разработчики тестировали модель на менее формальных, но показательных задачах: анимированный промышленный робот, вдохновлённый постом коллеги про генерацию видео-обхода дома, и вполне утилитарная история от того же Уиллисона — вместо поиска готового инструмента для рендера GeoJSON-фигур в PNG он за несколько минут «vibe-coded» свой собственный. Это, пожалуй, лучшая иллюстрация практической ценности апдейта: не «модель стала умнее» абстрактно, а «дешевле и надёжнее написать одноразовый инструмент, чем искать готовый».

Кому это пригодится

Если Claude Code — рабочий инструмент, а не разовая игрушка, апдейт Claude Fable 5.1 стоит воспринимать прагматично: подешевевший кеш и возможность переключать effort без потери кеша напрямую снижают стоимость длинных агентных сессий, а честность модели по поводу застревания экономит время на ревью её работы. Революции в возможностях здесь нет — есть системное улучшение именно тех мелочей, которые определяют, приятно ли доверять модели длинную задачу без присмотра.

Источники дайджеста:

Комментарии

Добавить комментарий

Ваш адрес email не будет опубликован. Обязательные поля помечены *