Anthropic выпустила Claude Opus 5.5 — и новость разошлась по X не пресс-релизом, а обычным твитом с ретвитом: Саймон Уиллисон подхватил анонс Adiy Osmani и, как это у него заведено, тут же прогнал модель через свой фирменный тест. За шуткой про пеликана на велосипеде стоит вполне серьёзный сдвиг в экономике работы с большими моделями.
Что изменилось в Claude Opus 5.5
Главная цифра релиза — снижение цены на 40% по сравнению с Claude Opus 5, при этом чтение из кэша подешевело сразу на 60%. По уровню задач модель встаёт вровень с Claude Fable 5.1: для большинства практических сценариев разницы в качестве почти нет, а разница в счёте — есть, и заметная.
Почему кэш важнее, чем кажется
Для тех, кто пишет агентов и работает с Claude Code, стоимость кэш-чтения — не второстепенная деталь тарифа, а то, что определяет реальный расход токенов. Агентные пайплайны и subagent’ы постоянно перечитывают один и тот же системный промпт, контекст проекта, инструкции инструментов — именно это идёт через prompt caching. Скидка в 60% на этот трафик снижает стоимость не разовых запросов, а именно длинных рабочих сессий с многократными обращениями к модели, где чтение кэша происходит десятки раз за один диалог.
Почему снижение цены Claude Opus 5.5 важнее самого релиза
Обычно анонсы новых версий концентрируются на бенчмарках и новых способностях. Здесь же акцент — на экономике: та же мощь, но дешевле. Это симптом того, что рынок LLM для разработчиков переходит из фазы «кто умнее» в фазу «кто эффективнее по деньгам при сопоставимом качестве». Для тех, кто использует Claude Opus в связке с MCP-инструментами, множеством вызовов подряд и большими объёмами контекста — например, при ревью кода или генерации длинных документов — совокупная стоимость таких сессий может быть в разы выше стоимости самого запроса именно из-за многократного чтения кэша. Снижение цены на этот компонент означает, что дорогие модели становится реалистичнее использовать не точечно, а как рабочую лошадку в постоянных пайплайнах.
Пеликан на велосипеде как неформальный бенчмарк
Тест Уиллисона — «нарисуй пеликана на велосипеде» через SVG или Three.js — давно стал в комьюнити узнаваемым способом быстро оценить, не потеряла ли новая версия модели в базовых способностях к рассуждению и пространственному представлению при генерации кода. Это не строгий бенчмарк, а скорее лакмусовая бумажка: если модель справляется с абсурдной, но требующей понимания геометрии задачей так же уверенно, как предыдущая, — значит, снижение цены не пришло за счёт деградации качества. Судя по реакции, Claude Opus 5.5 тест прошла.
Что это значит на практике
Для команд, уже использующих Claude Opus в продакшене, апдейт — это повод пересчитать бюджет на инференс, а не переписывать промпты: судя по анонсу, модель ведёт себя как более дешёвая версия той же самой Opus, а не как принципиально другой инструмент. Для тех, кто раньше выбирал Claude Fable 5.1 ради экономии, разница в цене между линейками сокращается — а значит, выбор модели теперь чаще будет определяться не бюджетом, а конкретной задачей.
Главный вывод из этого небольшого, но показательного твита: Anthropic в очередной раз меняет не то, что модель умеет, а то, сколько стоит её использовать много и часто — а для agentic-разработки это часто важнее, чем ещё один процент к бенчмарку.
Добавить комментарий