К содержимому
Claude Code с 0:полный курс
Новости ClaudeАвтор: Михаил Кузьмицкий

Claude Opus 5.5: почему новая модель дешевле для длинных сессий кода

Русская адаптация материала Anthropic — подготовлена с участием AI, проверена автором.

Коротко

Разбираем, почему Claude Opus 5.5 обходится дешевле именно на длинных, насыщенных контекстом сессиях кодинга — и что это значит для тебя на практике.

Если ты пользуешься Claude Code уже пару месяцев, ты, наверное, заметил: сессии стали длиннее, а задачи — крупнее и более открытые. Anthropic подтверждает это цифрами и выпускает новую модель — Claude Opus 5.5 — которая специально заточена под такой стиль работы. Разберёмся, что изменилось и почему это должно тебя порадовать, даже если ты просто учишься программировать с помощью ИИ.

Токены памяти, стекающиеся в компактное хранилище кэша

Как изменился стиль работы с Claude Code за полгода

Anthropic собрала статистику по использованию Claude Code с марта по сентябрь и увидела любопытную картину. Количество промптов на сессию осталось прежним, но сама работа внутри каждого промпта заметно усложнилась.

МетрикаИзменение
Время работы Claude над одним промптомв 3,3 раза дольше
Количество вызовов модели на промпт+40%
Прерывания пользователем−68%
Подключён внешний инструмент или skillпочти в 2 раза чаще
Вставка текста вручную в промптна треть реже
Объём контекста на запросв 2,6 раза больше
Соотношение входных и выходных токеновбыло 189:1, стало 324:1

Проще говоря: разработчики всё чаще запускают Claude на крупные, открытые задачи и меньше вмешиваются по пути. Модель сама подключает инструменты, сама держит в голове больше контекста и реже нуждается в том, чтобы её прерывали и подправляли. А раз контекста стало больше — экономика работы с токенами (контекст-инжиниринг, о котором мы писали в материале про то, какую модель Claude выбрать) становится критически важной темой.

Три причины, почему длинные сессии стали дешевле

Anthropic называет три составляющие экономии на длинных, насыщенных контекстом сессиях: изменения в цене, изменения в поведении самой модели и улучшения в «харнессе» — той обвязке инструментов и логики, которая управляет Claude Code вокруг модели. По оценке Anthropic, Opus 5.5 стоит запускать примерно на 40% дешевле, чем Opus 5, при типичной нагрузке, оплачиваемой по токенам. Давай разберём каждую причину по порядку.

Иллюстрация из статьи Anthropic

Кэш стал дешевле

Начнём с самого важного изменения — цены. Если объяснять по-простому: когда Claude в диалоге повторно «читает» уже виденный им ранее текст (например, содержимое файла, которое не менялось между запросами), это называется чтением из кэша — и стоит значительно дешевле полноценной обработки нового текста заново.

Anthropic снизила цену обычных входных и выходных токенов на 20%, а цену чтения кэшированного токена — сразу на 60%. Это принципиально, потому что именно кэш-чтения составляют большую часть счёта за агентную и кодовую работу. А поскольку объём контекста на запрос вырос в 2,6 раза за полгода, снижение цены на кэш работает всё сильнее с каждым месяцем: чем больше твой промпт «перечитывает» старый контекст, тем заметнее экономия. На момент публикации кэшированный токен на Opus 5.5 стоит в пять раз дешевле, чем у конкурирующих моделей — при этом Opus 5.5 показывает лучшие результаты.

Что такое кэш простыми словами

Представь, что ты каждый раз заново объясняешь другу контекст задачи. Кэш — это как если бы он запомнил предыдущий разговор и не заставлял тебя пересказывать всё с начала. Именно за «пересказ по памяти» и платишь меньше.

Claude Code стал умнее использовать кэш

Второе изменение касается не только самой модели, но и всего Claude Code — тех улучшений, которые копились последние полгода. Логично было бы ожидать, что при более длинных и сложных сессиях кэш будет чаще «слетать» (промахиваться). Но случилось наоборот: доля контекста, не найденного в кэше, упала более чем на 50%.

Anthropic закрыла целый набор мелких и крупных причин, из-за которых кэш обычно ломается: от банального обновления логина до добавления новых инструкций посреди разговора или подгрузки инструментов по требованию. Для новых моделей — Opus 5.5 и Fable 5.1 — теперь можно менять уровень «усилий» модели прямо в процессе сессии, не сбрасывая кэш. Кроме того, кэш стал полезнее для долгих и делегированных сессий: пользователи API-ключей и облачных провайдеров теперь могут выставить время жизни кэша в один час (у подписчиков это уже было), а форкнутые субагенты стартуют не с нуля, а из кэша родительского процесса — то есть не платят за один и тот же контекст повторно.

Иллюстрация из статьи Anthropic

Та же задача — но за меньшее число шагов

Третья причина связана с самим поведением модели. Opus 5.5 в некоторых случаях справляется с задачей за меньшее количество «ходов» (turns) — то есть циклов «подумал → вызвал инструмент → получил результат», — чем ей требовалось раньше. Компания Zeta Labs, тестировавшая новую модель, зафиксировала меньше ходов и вызовов инструментов на задачу по сравнению с Opus 5, при этом стоимость упала почти в два раза, а число решённых самых сложных задач выросло вдвое.

Но это не универсальное правило. Как отмечает автор материала «What a task costs on Opus 5.5», на хорошо очерченной, понятной задаче обе модели укладываются в примерно одинаковое число ходов — и вся экономия там достигается только за счёт снижения цены. Разрыв в пользу Opus 5.5 максимален на открытых задачах, где модель может потратить много ходов, разрабатывая неверную гипотезу, прежде чем найти правильный путь. Ни одно универсальное число тут не сработает — нужно измерять на своей кодовой базе. Кстати, сокращённый ход экономит даже больше, чем дешёвый кэш-токен: ты просто не тратишь токены на неверный подход вообще. Дополнительный бонус — Opus 5.5 генерирует ответ более чем на 30% быстрее Opus 5, и хотя это напрямую не снижает счёт, ждать долгие автономные прогоны становится приятнее.

Как защитить свои кэш-чтения на практике

По мере того как агентный кодинг взрослеет, в компаниях сменился запрос: раньше просили разработчиков «масштабироваться любой ценой», теперь — «масштабироваться эффективно». Первый шаг простой: запусти команду /usage в Claude Code и посмотри, какая доля твоих расходов приходится на кэш-чтения. Дальше эту долю нужно защищать — вот несколько привычек, которые в этом помогают.

ПривычкаПочему это важно
Выбирай модель в начале сессии, а не переключай её посерединеСмена модели может сбросить накопленный кэш
Сжимай контекст (compact) перед тем, как отойти, а не послеИначе кэш «остывает» и приходится читать заново
На API-ключе или облачном провайдере ставь время жизни кэша в час для долгих сессийДлинная сессия чаще выигрывает от долгоживущего кэша

Если объединить эти привычки с тем, что Opus 5.5 направлен именно на открытые, насыщенные контекстом задачи, экономия начинает работать по накопительному эффекту: дешевле кэш, меньше промахов, меньше лишних ходов. Тем, кто хочет разобраться в теме контекста и кэша глубже, полезно будет посмотреть на подготовку к масштабной модернизации кода в материале про подготовку к ИИ-модернизации — там разбираются похожие принципы работы с большими кодовыми базами.

Почему это важно даже новичкам

Может показаться, что вся эта история про кэш и токены — тема для опытных разработчиков, которые следят за счетами по API. Но если ты только начинаешь путь с терминалом и Claude Code — например, на бесплатном курсе zero2claude — тебе тоже полезно понимать эту механику. Чем длиннее твои сессии и чем больше файлов ты просишь Claude держать в контексте, тем сильнее на итоговую стоимость и скорость влияет то, как ты выстраиваешь диалог: не меняешь модель посреди задачи, не заставляешь Claude каждый раз пересказывать код с нуля, сжимаешь контекст вовремя.

По сути, Anthropic подтверждает наблюдение, которое многие уже почувствовали интуитивно: агентный кодинг — это не серия коротких вопросов-ответов, а один длинный, разворачивающийся разговор, где память (кэш) работает как общая рабочая тетрадь между тобой и моделью. Чем аккуратнее ты её ведёшь, тем дешевле и быстрее выходит работа.

Частые вопросы

Что такое кэш-чтение и почему это дешевле обычного токена?

Кэш-чтение — это когда модель повторно «видит» текст, который она уже обрабатывала раньше в этом же диалоге (например, код файла, который не менялся). Поскольку модели не нужно заново анализировать этот текст с нуля, такое чтение стоит значительно дешевле — в Opus 5.5 цена кэш-токена снижена на 60% по сравнению с Opus 5.

На сколько именно дешевле Opus 5.5 по сравнению с Opus 5?

По оценке Anthropic, при типичной нагрузке, оплачиваемой по токенам, Opus 5.5 обходится примерно на 40% дешевле, чем Opus 5. Наибольшая экономия проявляется на длинных сессиях с большим объёмом контекста — именно тех, что сейчас становятся нормой в Claude Code.

Что значит «меньше ходов» и почему это выгодно?

«Ход» (turn) — это один цикл работы модели: подумала, вызвала инструмент, получила результат. На открытых, сложных задачах модель может потратить много ходов, пробуя неверные подходы. Opus 5.5 в среднем нуждается в меньшем числе таких ходов для той же задачи — а сокращённый ход экономит даже больше, чем дешёвый кэш-токен, потому что токены вообще не тратятся на ошибочный путь.

Как узнать, сколько я трачу на кэш прямо сейчас?

В Claude Code есть команда /usage, которая показывает, какая доля твоих расходов приходится на кэш-чтения. После этого стоит беречь эту долю: не переключать модель посреди сессии, сжимать (compact) контекст перед перерывом, а не после, и при работе через API или облачного провайдера выставлять время жизни кэша в один час для длинных сессий.

Главный вывод простой: если раньше экономия на токенах была приятным бонусом, то теперь, когда сессии кодинга стали длиннее и насыщеннее контекстом почти в три раза за полгода, аккуратная работа с кэшем и моделью напрямую превращается в реальные деньги и время. Opus 5.5 создана именно под этот новый стиль работы — но лучший результат она даёт только в паре с твоими собственными привычками: выбирать модель заранее, сжимать контекст вовремя и следить за метрикой /usage.

Если хочешь попробовать всё это руками — начни с бесплатного курса «Claude Code и терминал: с 0».

Источник

По мотивам статьи Anthropic «Coding sessions are longer and use more context. Claude Opus 5.5 is built with that in mind.». Пересказали по-русски для новичков.

Читайте также

Попробуй на практике

Бесплатные интерактивные курсы по теме — прямо в браузере, с нуля.