# Claude Opus 5.5: почему новая модель дешевле для длинных сессий кода

Канонический URL: https://zero2claude.ru/blog/claude-opus-5-5-longer-coding-sessions
Дата: 2026-09-25
Теги: claude-code, claude, автоматизация, api

Разбираем, почему Claude Opus 5.5 обходится дешевле именно на длинных, насыщенных контекстом сессиях кодинга — и что это значит для тебя на практике.

Если ты пользуешься Claude Code уже пару месяцев, ты, наверное, заметил: сессии стали длиннее, а задачи — крупнее и более открытые. Anthropic подтверждает это цифрами и выпускает новую модель — Claude Opus 5.5 — которая специально заточена под такой стиль работы. Разберёмся, что изменилось и почему это должно тебя порадовать, даже если ты просто учишься программировать с помощью ИИ.

<Cover src="/blog/claude-opus-5-5-longer-coding-sessions.jpg" alt="Токены памяти, стекающиеся в компактное хранилище кэша" />

## Как изменился стиль работы с Claude Code за полгода

Anthropic собрала статистику по использованию Claude Code с марта по сентябрь и увидела любопытную картину. Количество промптов на сессию осталось прежним, но сама работа внутри каждого промпта заметно усложнилась.

| Метрика | Изменение |
|---|---|
| Время работы Claude над одним промптом | в 3,3 раза дольше |
| Количество вызовов модели на промпт | +40% |
| Прерывания пользователем | −68% |
| Подключён внешний инструмент или skill | почти в 2 раза чаще |
| Вставка текста вручную в промпт | на треть реже |
| Объём контекста на запрос | в 2,6 раза больше |
| Соотношение входных и выходных токенов | было 189:1, стало 324:1 |

Проще говоря: разработчики всё чаще запускают Claude на крупные, открытые задачи и меньше вмешиваются по пути. Модель сама подключает инструменты, сама держит в голове больше контекста и реже нуждается в том, чтобы её прерывали и подправляли. А раз контекста стало больше — экономика работы с токенами (контекст-инжиниринг, о котором мы писали в материале про то, [какую модель Claude выбрать](/blog/which-claude-model)) становится критически важной темой.

## Три причины, почему длинные сессии стали дешевле

Anthropic называет три составляющие экономии на длинных, насыщенных контекстом сессиях: изменения в цене, изменения в поведении самой модели и улучшения в «харнессе» — той обвязке инструментов и логики, которая управляет Claude Code вокруг модели. По оценке Anthropic, Opus 5.5 стоит запускать примерно на 40% дешевле, чем Opus 5, при типичной нагрузке, оплачиваемой по токенам. Давай разберём каждую причину по порядку.

![Иллюстрация из статьи Anthropic](/blog/claude-opus-5-5-longer-coding-sessions-1.jpg)

## Кэш стал дешевле

Начнём с самого важного изменения — цены. Если объяснять по-простому: когда Claude в диалоге повторно «читает» уже виденный им ранее текст (например, содержимое файла, которое не менялось между запросами), это называется чтением из кэша — и стоит значительно дешевле полноценной обработки нового текста заново.

Anthropic снизила цену обычных входных и выходных токенов на 20%, а цену чтения кэшированного токена — сразу на 60%. Это принципиально, потому что именно кэш-чтения составляют большую часть счёта за агентную и кодовую работу. А поскольку объём контекста на запрос вырос в 2,6 раза за полгода, снижение цены на кэш работает всё сильнее с каждым месяцем: чем больше твой промпт «перечитывает» старый контекст, тем заметнее экономия. На момент публикации кэшированный токен на Opus 5.5 стоит в пять раз дешевле, чем у конкурирующих моделей — при этом Opus 5.5 показывает лучшие результаты.

<Callout type="tip" title="Что такое кэш простыми словами">
Представь, что ты каждый раз заново объясняешь другу контекст задачи. Кэш — это как если бы он запомнил предыдущий разговор и не заставлял тебя пересказывать всё с начала. Именно за «пересказ по памяти» и платишь меньше.
</Callout>

## Claude Code стал умнее использовать кэш

Второе изменение касается не только самой модели, но и всего Claude Code — тех улучшений, которые копились последние полгода. Логично было бы ожидать, что при более длинных и сложных сессиях кэш будет чаще «слетать» (промахиваться). Но случилось наоборот: доля контекста, не найденного в кэше, упала более чем на 50%.

Anthropic закрыла целый набор мелких и крупных причин, из-за которых кэш обычно ломается: от банального обновления логина до добавления новых инструкций посреди разговора или подгрузки инструментов по требованию. Для новых моделей — Opus 5.5 и Fable 5.1 — теперь можно менять уровень «усилий» модели прямо в процессе сессии, не сбрасывая кэш. Кроме того, кэш стал полезнее для долгих и делегированных сессий: пользователи API-ключей и облачных провайдеров теперь могут выставить время жизни кэша в один час (у подписчиков это уже было), а форкнутые субагенты стартуют не с нуля, а из кэша родительского процесса — то есть не платят за один и тот же контекст повторно.

![Иллюстрация из статьи Anthropic](/blog/claude-opus-5-5-longer-coding-sessions-2.jpg)

## Та же задача — но за меньшее число шагов

Третья причина связана с самим поведением модели. Opus 5.5 в некоторых случаях справляется с задачей за меньшее количество «ходов» (turns) — то есть циклов «подумал → вызвал инструмент → получил результат», — чем ей требовалось раньше. Компания Zeta Labs, тестировавшая новую модель, зафиксировала меньше ходов и вызовов инструментов на задачу по сравнению с Opus 5, при этом стоимость упала почти в два раза, а число решённых самых сложных задач выросло вдвое.

Но это не универсальное правило. Как отмечает автор материала «What a task costs on Opus 5.5», на хорошо очерченной, понятной задаче обе модели укладываются в примерно одинаковое число ходов — и вся экономия там достигается только за счёт снижения цены. Разрыв в пользу Opus 5.5 максимален на открытых задачах, где модель может потратить много ходов, разрабатывая неверную гипотезу, прежде чем найти правильный путь. Ни одно универсальное число тут не сработает — нужно измерять на своей кодовой базе. Кстати, сокращённый ход экономит даже больше, чем дешёвый кэш-токен: ты просто не тратишь токены на неверный подход вообще. Дополнительный бонус — Opus 5.5 генерирует ответ более чем на 30% быстрее Opus 5, и хотя это напрямую не снижает счёт, ждать долгие автономные прогоны становится приятнее.

## Как защитить свои кэш-чтения на практике

По мере того как агентный кодинг взрослеет, в компаниях сменился запрос: раньше просили разработчиков «масштабироваться любой ценой», теперь — «масштабироваться эффективно». Первый шаг простой: запусти команду `/usage` в Claude Code и посмотри, какая доля твоих расходов приходится на кэш-чтения. Дальше эту долю нужно защищать — вот несколько привычек, которые в этом помогают.

| Привычка | Почему это важно |
|---|---|
| Выбирай модель в начале сессии, а не переключай её посередине | Смена модели может сбросить накопленный кэш |
| Сжимай контекст (compact) перед тем, как отойти, а не после | Иначе кэш «остывает» и приходится читать заново |
| На API-ключе или облачном провайдере ставь время жизни кэша в час для долгих сессий | Длинная сессия чаще выигрывает от долгоживущего кэша |

Если объединить эти привычки с тем, что Opus 5.5 направлен именно на открытые, насыщенные контекстом задачи, экономия начинает работать по накопительному эффекту: дешевле кэш, меньше промахов, меньше лишних ходов. Тем, кто хочет разобраться в теме контекста и кэша глубже, полезно будет посмотреть на подготовку к масштабной модернизации кода в материале про [подготовку к ИИ-модернизации](/blog/ai-code-modernization-prep) — там разбираются похожие принципы работы с большими кодовыми базами.

## Почему это важно даже новичкам

Может показаться, что вся эта история про кэш и токены — тема для опытных разработчиков, которые следят за счетами по API. Но если ты только начинаешь путь с терминалом и Claude Code — например, на бесплатном курсе zero2claude — тебе тоже полезно понимать эту механику. Чем длиннее твои сессии и чем больше файлов ты просишь Claude держать в контексте, тем сильнее на итоговую стоимость и скорость влияет то, как ты выстраиваешь диалог: не меняешь модель посреди задачи, не заставляешь Claude каждый раз пересказывать код с нуля, сжимаешь контекст вовремя.

По сути, Anthropic подтверждает наблюдение, которое многие уже почувствовали интуитивно: агентный кодинг — это не серия коротких вопросов-ответов, а один длинный, разворачивающийся разговор, где память (кэш) работает как общая рабочая тетрадь между тобой и моделью. Чем аккуратнее ты её ведёшь, тем дешевле и быстрее выходит работа.

## Частые вопросы

<Faq>
<FaqItem q="Что такое кэш-чтение и почему это дешевле обычного токена?">

Кэш-чтение — это когда модель повторно «видит» текст, который она уже обрабатывала раньше в этом же диалоге (например, код файла, который не менялся). Поскольку модели не нужно заново анализировать этот текст с нуля, такое чтение стоит значительно дешевле — в Opus 5.5 цена кэш-токена снижена на 60% по сравнению с Opus 5.

</FaqItem>
<FaqItem q="На сколько именно дешевле Opus 5.5 по сравнению с Opus 5?">

По оценке Anthropic, при типичной нагрузке, оплачиваемой по токенам, Opus 5.5 обходится примерно на 40% дешевле, чем Opus 5. Наибольшая экономия проявляется на длинных сессиях с большим объёмом контекста — именно тех, что сейчас становятся нормой в Claude Code.

</FaqItem>
<FaqItem q="Что значит «меньше ходов» и почему это выгодно?">

«Ход» (turn) — это один цикл работы модели: подумала, вызвала инструмент, получила результат. На открытых, сложных задачах модель может потратить много ходов, пробуя неверные подходы. Opus 5.5 в среднем нуждается в меньшем числе таких ходов для той же задачи — а сокращённый ход экономит даже больше, чем дешёвый кэш-токен, потому что токены вообще не тратятся на ошибочный путь.

</FaqItem>
<FaqItem q="Как узнать, сколько я трачу на кэш прямо сейчас?">

В Claude Code есть команда `/usage`, которая показывает, какая доля твоих расходов приходится на кэш-чтения. После этого стоит беречь эту долю: не переключать модель посреди сессии, сжимать (compact) контекст перед перерывом, а не после, и при работе через API или облачного провайдера выставлять время жизни кэша в один час для длинных сессий.

</FaqItem>
</Faq>

Главный вывод простой: если раньше экономия на токенах была приятным бонусом, то теперь, когда сессии кодинга стали длиннее и насыщеннее контекстом почти в три раза за полгода, аккуратная работа с кэшем и моделью напрямую превращается в реальные деньги и время. Opus 5.5 создана именно под этот новый стиль работы — но лучший результат она даёт только в паре с твоими собственными привычками: выбирать модель заранее, сжимать контекст вовремя и следить за метрикой `/usage`.

Если хочешь попробовать всё это руками — начни с бесплатного курса [«Claude Code и терминал: с 0»](/learn/code-terminal).

<Callout type="note" title="Источник">
По мотивам статьи Anthropic «Coding sessions are longer and use more context. Claude Opus 5.5 is built with that in mind.». Пересказали по-русски для новичков.
</Callout>
