Если ты пользуешься Claude Code уже пару месяцев, ты, наверное, заметил: сессии стали длиннее, а задачи — крупнее и более открытые. Anthropic подтверждает это цифрами и выпускает новую модель — Claude Opus 5.5 — которая специально заточена под такой стиль работы. Разберёмся, что изменилось и почему это должно тебя порадовать, даже если ты просто учишься программировать с помощью ИИ.
Как изменился стиль работы с Claude Code за полгода
Anthropic собрала статистику по использованию Claude Code с марта по сентябрь и увидела любопытную картину. Количество промптов на сессию осталось прежним, но сама работа внутри каждого промпта заметно усложнилась.
| Метрика | Изменение |
|---|---|
| Время работы Claude над одним промптом | в 3,3 раза дольше |
| Количество вызовов модели на промпт | +40% |
| Прерывания пользователем | −68% |
| Подключён внешний инструмент или skill | почти в 2 раза чаще |
| Вставка текста вручную в промпт | на треть реже |
| Объём контекста на запрос | в 2,6 раза больше |
| Соотношение входных и выходных токенов | было 189:1, стало 324:1 |
Проще говоря: разработчики всё чаще запускают Claude на крупные, открытые задачи и меньше вмешиваются по пути. Модель сама подключает инструменты, сама держит в голове больше контекста и реже нуждается в том, чтобы её прерывали и подправляли. А раз контекста стало больше — экономика работы с токенами (контекст-инжиниринг, о котором мы писали в материале про то, какую модель Claude выбрать) становится критически важной темой.
Три причины, почему длинные сессии стали дешевле
Anthropic называет три составляющие экономии на длинных, насыщенных контекстом сессиях: изменения в цене, изменения в поведении самой модели и улучшения в «харнессе» — той обвязке инструментов и логики, которая управляет Claude Code вокруг модели. По оценке Anthropic, Opus 5.5 стоит запускать примерно на 40% дешевле, чем Opus 5, при типичной нагрузке, оплачиваемой по токенам. Давай разберём каждую причину по порядку.

Кэш стал дешевле
Начнём с самого важного изменения — цены. Если объяснять по-простому: когда Claude в диалоге повторно «читает» уже виденный им ранее текст (например, содержимое файла, которое не менялось между запросами), это называется чтением из кэша — и стоит значительно дешевле полноценной обработки нового текста заново.
Anthropic снизила цену обычных входных и выходных токенов на 20%, а цену чтения кэшированного токена — сразу на 60%. Это принципиально, потому что именно кэш-чтения составляют большую часть счёта за агентную и кодовую работу. А поскольку объём контекста на запрос вырос в 2,6 раза за полгода, снижение цены на кэш работает всё сильнее с каждым месяцем: чем больше твой промпт «перечитывает» старый контекст, тем заметнее экономия. На момент публикации кэшированный токен на Opus 5.5 стоит в пять раз дешевле, чем у конкурирующих моделей — при этом Opus 5.5 показывает лучшие результаты.
Что такое кэш простыми словами
Представь, что ты каждый раз заново объясняешь другу контекст задачи. Кэш — это как если бы он запомнил предыдущий разговор и не заставлял тебя пересказывать всё с начала. Именно за «пересказ по памяти» и платишь меньше.
Claude Code стал умнее использовать кэш
Второе изменение касается не только самой модели, но и всего Claude Code — тех улучшений, которые копились последние полгода. Логично было бы ожидать, что при более длинных и сложных сессиях кэш будет чаще «слетать» (промахиваться). Но случилось наоборот: доля контекста, не найденного в кэше, упала более чем на 50%.
Anthropic закрыла целый набор мелких и крупных причин, из-за которых кэш обычно ломается: от банального обновления логина до добавления новых инструкций посреди разговора или подгрузки инструментов по требованию. Для новых моделей — Opus 5.5 и Fable 5.1 — теперь можно менять уровень «усилий» модели прямо в процессе сессии, не сбрасывая кэш. Кроме того, кэш стал полезнее для долгих и делегированных сессий: пользователи API-ключей и облачных провайдеров теперь могут выставить время жизни кэша в один час (у подписчиков это уже было), а форкнутые субагенты стартуют не с нуля, а из кэша родительского процесса — то есть не платят за один и тот же контекст повторно.

Та же задача — но за меньшее число шагов
Третья причина связана с самим поведением модели. Opus 5.5 в некоторых случаях справляется с задачей за меньшее количество «ходов» (turns) — то есть циклов «подумал → вызвал инструмент → получил результат», — чем ей требовалось раньше. Компания Zeta Labs, тестировавшая новую модель, зафиксировала меньше ходов и вызовов инструментов на задачу по сравнению с Opus 5, при этом стоимость упала почти в два раза, а число решённых самых сложных задач выросло вдвое.
Но это не универсальное правило. Как отмечает автор материала «What a task costs on Opus 5.5», на хорошо очерченной, понятной задаче обе модели укладываются в примерно одинаковое число ходов — и вся экономия там достигается только за счёт снижения цены. Разрыв в пользу Opus 5.5 максимален на открытых задачах, где модель может потратить много ходов, разрабатывая неверную гипотезу, прежде чем найти правильный путь. Ни одно универсальное число тут не сработает — нужно измерять на своей кодовой базе. Кстати, сокращённый ход экономит даже больше, чем дешёвый кэш-токен: ты просто не тратишь токены на неверный подход вообще. Дополнительный бонус — Opus 5.5 генерирует ответ более чем на 30% быстрее Opus 5, и хотя это напрямую не снижает счёт, ждать долгие автономные прогоны становится приятнее.
Как защитить свои кэш-чтения на практике
По мере того как агентный кодинг взрослеет, в компаниях сменился запрос: раньше просили разработчиков «масштабироваться любой ценой», теперь — «масштабироваться эффективно». Первый шаг простой: запусти команду /usage в Claude Code и посмотри, какая доля твоих расходов приходится на кэш-чтения. Дальше эту долю нужно защищать — вот несколько привычек, которые в этом помогают.
| Привычка | Почему это важно |
|---|---|
| Выбирай модель в начале сессии, а не переключай её посередине | Смена модели может сбросить накопленный кэш |
| Сжимай контекст (compact) перед тем, как отойти, а не после | Иначе кэш «остывает» и приходится читать заново |
| На API-ключе или облачном провайдере ставь время жизни кэша в час для долгих сессий | Длинная сессия чаще выигрывает от долгоживущего кэша |
Если объединить эти привычки с тем, что Opus 5.5 направлен именно на открытые, насыщенные контекстом задачи, экономия начинает работать по накопительному эффекту: дешевле кэш, меньше промахов, меньше лишних ходов. Тем, кто хочет разобраться в теме контекста и кэша глубже, полезно будет посмотреть на подготовку к масштабной модернизации кода в материале про подготовку к ИИ-модернизации — там разбираются похожие принципы работы с большими кодовыми базами.
Почему это важно даже новичкам
Может показаться, что вся эта история про кэш и токены — тема для опытных разработчиков, которые следят за счетами по API. Но если ты только начинаешь путь с терминалом и Claude Code — например, на бесплатном курсе zero2claude — тебе тоже полезно понимать эту механику. Чем длиннее твои сессии и чем больше файлов ты просишь Claude держать в контексте, тем сильнее на итоговую стоимость и скорость влияет то, как ты выстраиваешь диалог: не меняешь модель посреди задачи, не заставляешь Claude каждый раз пересказывать код с нуля, сжимаешь контекст вовремя.
По сути, Anthropic подтверждает наблюдение, которое многие уже почувствовали интуитивно: агентный кодинг — это не серия коротких вопросов-ответов, а один длинный, разворачивающийся разговор, где память (кэш) работает как общая рабочая тетрадь между тобой и моделью. Чем аккуратнее ты её ведёшь, тем дешевле и быстрее выходит работа.
Частые вопросы
Что такое кэш-чтение и почему это дешевле обычного токена?
Кэш-чтение — это когда модель повторно «видит» текст, который она уже обрабатывала раньше в этом же диалоге (например, код файла, который не менялся). Поскольку модели не нужно заново анализировать этот текст с нуля, такое чтение стоит значительно дешевле — в Opus 5.5 цена кэш-токена снижена на 60% по сравнению с Opus 5.
На сколько именно дешевле Opus 5.5 по сравнению с Opus 5?
По оценке Anthropic, при типичной нагрузке, оплачиваемой по токенам, Opus 5.5 обходится примерно на 40% дешевле, чем Opus 5. Наибольшая экономия проявляется на длинных сессиях с большим объёмом контекста — именно тех, что сейчас становятся нормой в Claude Code.
Что значит «меньше ходов» и почему это выгодно?
«Ход» (turn) — это один цикл работы модели: подумала, вызвала инструмент, получила результат. На открытых, сложных задачах модель может потратить много ходов, пробуя неверные подходы. Opus 5.5 в среднем нуждается в меньшем числе таких ходов для той же задачи — а сокращённый ход экономит даже больше, чем дешёвый кэш-токен, потому что токены вообще не тратятся на ошибочный путь.
Как узнать, сколько я трачу на кэш прямо сейчас?
В Claude Code есть команда /usage, которая показывает, какая доля твоих расходов приходится на кэш-чтения. После этого стоит беречь эту долю: не переключать модель посреди сессии, сжимать (compact) контекст перед перерывом, а не после, и при работе через API или облачного провайдера выставлять время жизни кэша в один час для длинных сессий.
Главный вывод простой: если раньше экономия на токенах была приятным бонусом, то теперь, когда сессии кодинга стали длиннее и насыщеннее контекстом почти в три раза за полгода, аккуратная работа с кэшем и моделью напрямую превращается в реальные деньги и время. Opus 5.5 создана именно под этот новый стиль работы — но лучший результат она даёт только в паре с твоими собственными привычками: выбирать модель заранее, сжимать контекст вовремя и следить за метрикой /usage.
Если хочешь попробовать всё это руками — начни с бесплатного курса «Claude Code и терминал: с 0».
Источник
По мотивам статьи Anthropic «Coding sessions are longer and use more context. Claude Opus 5.5 is built with that in mind.». Пересказали по-русски для новичков.