Лимиты Claude в 2026: 9 приёмов растянуть подписку и не упереться в потолок
Claude выбивает лимит к обеду, а работать ещё полдня. Разбираю, как устроены окна Pro и Max, и даю 9 приёмов экономии токенов: компактные промпты, /clear, MarkItDown вместо PDF, Headroom, дешёвые модели на рутину, кэш инструкций, планирование, разбор расхода через /context и отключение лишних MCP-серверов. Плюс честно про то, что обойти лимит нельзя, а тратить меньше можно.
Claude показывает «лимит исчерпан» к обеду, а работать ещё половину дня. Обойти лимит нельзя, встроенного секретного тарифа не существует. Но расход токенов у двух людей на одной подписке отличается в разы, и разница тут в привычках. Ниже девять приёмов, которые растягивают ту же подписку Pro или Max на полный рабочий день.
Сначала коротко разберём, как устроены сами лимиты: почему они считаются в токенах, что такое пятичасовое и недельное окна и откуда взялся миф про «отдельный лимит у Claude Code». Потом девять конкретных приёмов экономии, каждый с ответом на вопрос «куда нажать». И честно про то, когда пора апгрейдиться на Max, а когда достаточно починить привычки. Если хочешь сначала понять саму механику расхода в цифрах, база лежит в гайде сколько токенов в Claude Pro, а тут мы про то, как этих токенов тратить меньше.
Лимит Claude считается в токенах и сбрасывается в двух окнах: скользящем 5-часовом и недельном. Обойти его нельзя, можно тратить меньше. Главная утечка это раздутый контекст, который модель перечитывает на каждый ответ. Девять приёмов бьют по утечкам: компактные промпты, чистка контекста через `/clear`, MarkItDown вместо PDF, Headroom, дешёвые модели на рутину, кэш повторяемых инструкций, планирование тяжёлых задач, разбор расхода через `/context` и отключение лишних MCP-серверов. Апгрейд на Max нужен, когда ты уже экономишь, а лимита всё равно не хватает по работе.
Обновление 4 августа 2026: добавлены приёмы 8 и 9. Восьмой про команду `/context`, которая показывает, куда именно утекают токены ещё до твоего первого сообщения. Девятый про сабагентов и мультиагентные схемы, которые в моде, но стоят кратно дороже обычного диалога. Плюс свежий факт про недельные лимиты, который действует до 19 августа.
токенов экономит MarkItDown, если грузить markdown вместо PDF
срезает Headroom на типовых сессиях с кодом
у Max 20x за $200 к базовому окну Pro
Как устроены лимиты Claude Pro и Max
Первое, что важно понять: Claude считает объём текста, а количество вопросов ему безразлично. Каждое слово в диалоге и каждый ответ модели разбиваются на токены, кусочки слов, и именно по ним идёт учёт. Короткий вопрос в конце длинного чата стоит дорого, потому что модель перечитывает всю переписку заново, чтобы ответить.
Лимит обнуляется в двух окнах одновременно. Первое это скользящее пятичасовое окно: отсчёт стартует с твоего первого сообщения и закрывается через пять часов, потом открывается снова. Второе это недельное окно, Anthropic ввела его в конце августа 2025 как страховку от совсем тяжёлых пользователей. У Pro недельного потолка на практике почти нет, он бьёт в основном по Max при очень плотной нагрузке.
Точных цифр в токенах Anthropic официально не публикует. В документации есть только множители: Pro это база (1x), Max 5x это пятикратный запас, Max 20x двадцатикратный. По независимым оценкам на июль 2026 пятичасовое окно Pro тянет примерно 45 сообщений среднего размера, Max 5x около 225, Max 20x около 900. Цифры приблизительные, реальный расход зависит от длины диалога, выбранной модели и подключённых инструментов.
6 мая 2026 Anthropic вдвое увеличила пятичасовые лимиты для Pro, Max, Team и Enterprise, и убрала отдельное урезание в пиковые часы. Так что если ты читал старые жалобы «Claude режет лимит вечером», это уже неактуально. Точные цифры всегда меняются, порядок величин смотри прямо на странице claude.com/pricing.
Свежее на август 2026: 18 июля Anthropic подняла недельные лимиты Claude Code на 50 процентов для Pro, Max, Team и посадочного Enterprise. Но это акция с датой окончания, объявленный срок 19 августа 2026. Если ты последние недели спокойно укладываешься в недельный потолок, не считай это новой нормой: после 19 августа он может вернуться к прежнему, и привычка жечь токены впустую вылезет разом. Свой остаток смотри в настройках, раздел Usage.
Развенчаем миф: «у Claude Code отдельный лимит»
По рунету гуляет совет: гоняй код в Claude Code, у него отдельный лимит от чата, получишь второй карман. Это устаревшая информация. С 2025 года использование считается из общего пула подписки. Сообщения на claude.ai, в Claude Desktop и в Claude Code тянут токены из одного счётчика. Выбьешь лимит в чате, он будет выбит и в Claude Code, и наоборот.
Раньше окна действительно считались раздельно, поэтому совет был рабочим. Сейчас нет. реальная экономия идёт через снижение расхода токенов на саму задачу. Именно этим занимаются семь приёмов ниже.
Цены на июль 2026 такие: Pro $20 в месяц, Max 5x $100, Max 20x $200. Все три тарифа считают токены по одной механике, разница только в размере окна.
Приём 1. Компактные промпты вместо простыней
Первый расход, который ты контролируешь напрямую, это длина собственного запроса. Каждый твой символ уходит в токены, и каждый лишний абзац «на всякий случай» ты оплачиваешь на каждом следующем ответе, потому что он остаётся в контексте.
Компактный промпт это плотный промпт, где нет ни одного лишнего слова. Убери вежливые обёртки вроде «пожалуйста, будь добр, если тебе не сложно». Убери повторы одной мысли разными словами. Оставь суть: что нужно, в каком формате, с какими ограничениями. Модель понимает сухую инструкцию не хуже развёрнутой.
Сравни два запроса на одну задачу. Раздутый вариант тратит втрое больше токенов и живёт в контексте до конца чата:
Составь мне, пожалуйста, если можешь, короткое резюме Текст ниже. Резюме нужно на русском языке. Оформи в виде списка. Формат: маркированный список из 5 пунктов. Каждый пункт одно предложение.
Тот же смысл в плотной форме:
Резюме текста ниже: 5 пунктов маркированным списком, одно предложение на пункт, русский.
Заведи привычку писать инструкции в телеграфном стиле, как заметку самому себе. «Перепиши абзац: короче, без штампов, тон деловой». Модель разбирает такое так же точно, как вежливую простыню, а токенов уходит в разы меньше, и это накапливается на каждом ответе в чате.
Приём 2. Чисти контекст через /clear и не тяни длинные чаты
Это главный приём по силе эффекта. Длинный чат это не память, это налог. К тридцатому сообщению один простой вопрос стоит десятки тысяч токенов, потому что модель каждый раз перечитывает всю ленту с начала. Так лимит и выгорает к обеду, хотя работы было на полчаса.
В Claude Code для этого есть команда /clear. Она сбрасывает контекст текущей сессии, оставляя проект на месте: файлы, CLAUDE.md и настройки никуда не деваются, стирается только накопленная история диалога. Правило простое: закончил одну логическую задачу, набери /clear перед следующей. Не тащи контекст починки бага в задачу про новую фичу, ему там не место.
В чат-приложении механики /clear нет, но есть аналог. Как накопилось 15-20 сообщений и тема в целом закрыта, начинай новый чат. Чтобы не потерять нить, попроси Claude подытожить:
Короткое резюме диалога: что делаем, что уже решили, что дальше. Перенесу в новый чат.
Скопируй ответ, открой новый чат, вставь резюме первым сообщением. Контекст с тобой, стокилограммовая лента осталась позади, и каждое следующее сообщение снова стоит копейки.
Не путай `/clear` с `/compact`. `/compact` сжимает историю в короткое резюме, но оставляет её в контексте, то есть экономит лишь частично. `/clear` стирает контекст полностью. Если после `/clear` окажется, что важная деталь из прошлого диалога всё же нужна, её придётся вводить заново. Поэтому чисти на границе между задачами, когда одна закрыта и начинается следующая.
Сама эта дисциплина, что держать в контексте, а что выкидывать, называется контекст-инжинирингом. Приём с /clear это её самая базовая часть, а полную картину, как готовить контекст под тяжёлые задачи, разбирает гайд контекст-инжиниринг: что это.
Приём 3. MarkItDown: переводи PDF в текст перед загрузкой
Когда ты кидаешь в Claude PDF, презентацию или скан, модель тратит уйму токенов на разбор оформления: рамки, колонки, картинки, служебную разметку. Полезного текста там может быть страница, а платишь ты за весь мусор вокруг.
Решение это MarkItDown, бесплатная утилита от Microsoft, которая превращает PDF, DOCX, PPTX и Excel в чистый markdown. Ты сначала прогоняешь файл через неё, а в Claude грузишь уже голый текст без оформления. Экономия доходит до 70 процентов токенов на том же документе, потому что модель читает суть вместо вёрстки.
Ставится одной командой, дальше конвертация в один заход:
pip install markitdown markitdown documents/otchet.pdf > otchet.md
Получившийся otchet.md и загружаешь в чат вместо исходного PDF. Особенно заметна разница на длинных отчётах и таблицах: то, что раньше выжигало половину окна за одну загрузку, теперь занимает четверть. Подробный разбор со всеми форматами и подводными камнями в гайде MarkItDown: PDF в текст для Claude.
Если файлов много и они повторяются от чата к чату, объедини два приёма: сначала прогони их через MarkItDown, потом загрузи готовый markdown один раз в Проект Claude (об этом ниже, приём 6). Тогда ты платишь за разбор документа один раз, при первой загрузке, и больше никогда.
Приём 4. Headroom: автоматическая экономия в Claude Code
Три предыдущих приёма ты делаешь руками. Headroom делает то же самое автоматически. Это внешний инструмент для Claude Code, который встаёт прослойкой между тобой и моделью и на лету срезает всё лишнее из контекста, прежде чем запрос уйдёт в API.
Он выкидывает дубли, сжимает повторяющиеся куски, отрезает то, что модели не нужно для текущего шага. Ты работаешь как обычно, а расход токенов падает без твоего участия. По замерам разработчиков экономия доходит до 60-95 процентов на типовых сессиях с кодом, где контекст особенно быстро раздувается.
Приём для тех, кто много кодит и не хочет постоянно следить за чистотой контекста руками. Ставишь один раз, дальше он молча бережёт лимит на каждой сессии. Полная инструкция по установке и настройке в гайде Headroom: экономия токенов Claude.
Экономить лимит важно, но ещё важнее собрать этим что-то рабочее. Пройди мини-курс «Claude за вечер»: от установки до первых результатов на твоих задачах, чтобы такие приёмы подключать себе без страха перед кодом и терминалом.
Пройти мини-курс →Приём 5. Вынеси рутину на дешёвые модели
У Claude несколько моделей, и они стоят по-разному в токенах. Opus самая мощная и самая прожорливая. Sonnet быстрее и заметно дешевле, тянет большинство задач. Haiku самая лёгкая и мгновенная для простых справок. Если гнать всё подряд через Opus, лимит сгорает в разы быстрее, чем нужно.
Правило простое: Opus береги для тяжёлого, где реально нужна голова. Сложное рассуждение, важный код, длинный аналитический текст. Всё остальное, черновики, короткие резюме, форматирование, быстрые вопросы, спокойно тянут Sonnet или Haiku почти без потери качества.
В чат-приложении модель переключается над полем ввода: жмёшь на её название и выбираешь из списка. В Claude Code это одна команда:
# показать список и выбрать /model # сразу переключиться /model sonnet /model haiku
Контекст диалога при переключении не теряется, меняется только мотор. Один час на Opus легко растягивается в несколько часов на Sonnet.
Отдельный уровень для совсем мелочёвки это локальная модель на своём компьютере. Брейншторм, черновое резюме, переформатировать список, для такого облачный Claude избыточен. Ставишь бесплатную Ollama с официального сайта, скачиваешь лёгкую модель, и вся черновая работа идёт мимо лимита, потому что крутится прямо у тебя на ноутбуке.
Локальная модель на ноутбуке слабее облачного Claude, и это нормально: ей и отдаём только черновую мелочь. Серьёзную задачу всё равно делает Claude, просто теперь его лимит не размазан на форматирование списков и болтовню, а тратится на работу, которой действительно нужна сильная модель.
Приём 6. Кэшируй повторяемые инструкции и файлы
Многие в каждом новом чате заново объясняют, кто они, чем занимаются и в каком формате хотят ответы. Эти три-пять сообщений на «знакомство» повторяются в каждом диалоге и тоже жгут лимит. Всё это можно задать один раз.
В чат-приложении для этого есть два места. Первое это Память: в настройках включаешь генерацию памяти из истории чатов, и Claude сам запоминает, кто ты и какие ответы любишь, подтягивая это в новые диалоги. Второе это Проекты, папки, где живёт общая база знаний. Один раз загружаешь туда брифы, регламенты, свой стиль, и все чаты внутри Проекта видят эти файлы без повторной загрузки. Файл оплачивается один раз вместо десяти.
В Claude Code роль кэша играет файл CLAUDE.md в корне проекта. Всё, что должно повторяться в каждом запросе, стек проекта, правила стиля, запреты, ты прописываешь туда один раз, и Claude подгружает это сам. Не нужно объяснять контекст заново в каждой сессии.
# CLAUDE.md Проект: телеграм-бот на Python, база PostgreSQL. Стиль: короткие функции, без лишних абстракций. Не использовать: длинное тире в текстах, хардкод цен. Отвечай по-русски, код комментируй кратко.
Держи `CLAUDE.md` коротким и по делу. Раздутый файл на 500 строк сам становится налогом на токены, ведь он подгружается в каждый запрос. Клади туда только то, что реально повторяется от сессии к сессии, а разовые детали задавай прямо в диалоге. Как собрать такой файл с нуля, разбирает отдельный гайд по `CLAUDE.md`.
Приём 7. Планируй тяжёлые задачи перед стартом
Последний приём про то, чтобы не жечь лимит на переделках. Самый дорогой расход это когда Claude сразу бросается писать, идёт не туда, ты останавливаешь, объясняешь заново, он переписывает. Каждая такая итерация это полный проход по контексту, и на большой задаче их набегает десяток.
Лечится это планированием до старта. В Claude Code для этого есть Plan Mode: модель сначала расписывает, что собирается делать, ты подтверждаешь или правишь план на словах, и только потом идёт код. Дешёвый текстовый план вместо дорогих циклов «написал, не так, переписал».
Для тяжёлой задачи попроси план явно, прежде чем разрешить писать:
Не пиши код сразу. Сначала распиши план по шагам и назови, что непонятно. Жду подтверждения.
Так ты ловишь неверное понимание на этапе плана, где правка стоит одну реплику. Поймать ту же ошибку на этапе готового кода дороже: там переделка стоит целый проход по раздутому контексту. На длинных задачах это экономит больше, чем все остальные приёмы вместе, потому что режет самую дорогую статью расхода: повторную работу.
Приём 8. Посмотри через /context, куда уходят токены на самом деле
Семь приёмов выше про то, что ты сам пишешь в чат. Но часть лимита сгорает ещё до того, как ты набрал первый символ. В Claude Code есть команда /context, и она показывает разбивку окна по категориям: системный промпт, системные инструменты, инструменты подключённых MCP-серверов, файлы памяти вроде CLAUDE.md, скиллы, история сообщений и сколько места осталось свободным.
Первый запуск обычно удивляет. Оказывается, каждый подключённый MCP-сервер оплачивается на каждом запросе: в контекст едет описание всех его инструментов, имена, тексты и полные схемы параметров. По разбору вывода /context на реальной сессии один инструмент почтового сервера стоит 600-800 токенов: создание черновика около 820, поиск писем около 660. Сервер с десятком инструментов это уже тысячи токенов, которые ты платишь в каждом сообщении, даже если весь день правишь вёрстку и почту не трогал.
Подключил пять MCP-серверов «на будущее» и забыл, это самая тихая утечка из всех. Она не видна в диалоге и не зависит от твоей аккуратности: сервера жгут токены сами по себе, фоном, на каждом запросе. Набери `/mcp`, посмотри список подключённых и отключи те, что не нужны в текущей задаче. Подключить обратно это одна команда.
Здесь же лежит приём, который пришёл из инженерии мультиагентных систем: не загружать в модель весь справочник разом. Вместо полных схем всех инструментов ей дают компактный каталог возможностей, а подробное описание подтягивается только в момент, когда инструмент реально вызывают. В Claude Code это работает как отложенная загрузка инструментов, и в выводе /context такие сервера видно отдельной строкой с заметно меньшим весом. Если у тебя подключено много всего, включить отложенную загрузку выгоднее, чем героически отключать сервера руками. Что вообще умеют такие сервера и какие ставить стоит, разбирает гайд про MCP-серверы для Claude.
Заведи правило: одна задача - один набор серверов. Работаешь с кодом, оставь файловые и гитовые. Собираешь отчёт, включи почту и таблицы, а на время кода выключи. Проверять себя через `/context` достаточно раз в неделю, а не каждую сессию.
Приём 9. Не плоди агентов ради агентов
Последний приём против модной ошибки. Читатель узнаёт про сабагентов, про рой из десяти помощников, разбивает задачу на всех сразу, и лимит, который раньше жил до вечера, сгорает за сорок минут.
Anthropic честно назвала цену такой схемы в разборе собственной мультиагентной системы. Обычный агент тратит примерно вчетверо больше токенов, чем тот же вопрос в чате. Схема из нескольких агентов примерно в 15 раз больше. И там же признание: расход токенов объясняет около 80 процентов разницы в качестве результата. То есть рой работает лучше во многом просто потому, что тратит больше, а не потому, что в нём есть какая-то магия.
Отсюда простое правило. Рой оправдан там, где задачу реально можно разложить на независимые ветки, которые не ждут друг друга: собрать информацию из десятка источников, проверить гипотезу с четырёх сторон, прошерстить большой репозиторий. И там, где результат стоит дороже сожжённых токенов. На связных задачах вроде правки кода, где каждый шаг зависит от предыдущего, агенты начинают спотыкаться друг о друга, а лимит тает.
Сабагент экономит, когда
- перелопачивает много материала, а возвращает абзац
- работает в своём окне, твой основной контекст остаётся чистым
- ветки независимы и идут параллельно
- его вывод короче его входа
Сабагент жжёт, когда
- задача связная и шаги зависят друг от друга
- ты запускаешь троих на правку одного файла
- каждый заново читает те же файлы и ту же историю
- ты зовёшь его туда, где хватило бы одного вопроса
Проверка на пальцах: сабагент оправдан, если его вывод короче его входа. Разведка по большому проекту это да, он прочитает сорок файлов и принесёт тебе абзац, а сорок файлов в твоём окне не осядут. Переименовать переменную это нет, вход и выход одинаковые, а накладные расходы на запуск агента ты оплатишь. Как устроены сабагенты и с чего начать, разбирает гайд про агентов Claude для новичка.
Формула: лимит выгорает не столько на работе, сколько на четырёх утечках: раздутый контекст, дорогая модель на мелочь, переделки из-за спешки и накладные расходы, которые ты не видишь - лишние MCP-сервера и агенты не по задаче. Почини все четыре, и та же подписка живёт в разы дольше.
Когда апгрейд на Claude Max реально нужен
Честный ответ: сначала приёмы, потом апгрейд. Большинство упирается в лимит не потому, что мало платит, а потому, что жжёт токены впустую. Если ты выбиваешь лимит на длинных чатах и Opus для форматирования, апгрейд на Max просто отложит проблему на пару часов, а деньги уйдут.
Апгрейд оправдан, когда ты уже применил экономию, чистишь контекст, ставишь модель под задачу, планируешь тяжёлое, и всё равно упираешься в потолок каждый день по реальной работе. Тогда считаешь так. Max 5x за $100 это примерно пятикратный запас к Pro, Max 20x за $200 двадцатикратный. Если Claude приносит тебе деньги и час простоя из-за лимита стоит дороже разницы в цене тарифов, апгрейд окупается в первый же день.
| Тариф | Цена в месяц | Запас к Pro | Кому |
|---|---|---|---|
| Pro | $20 | база (1x) | старт, обычная нагрузка, тексты и лёгкий код |
| Max 5x | $100 | ~5x | ежедневная плотная работа, много кода |
| Max 20x | $200 | ~20x | код целыми днями, несколько параллельных задач |
Если же ты пока новичок и лимит выбиваешь редко, оставайся на Pro и просто примени девять приёмов. Разница между аккуратным и неаккуратным пользователем на Pro больше, чем разница между Pro и Max у того, кто жжёт токены впустую. Подробнее про сами тарифы и оплату из России в гайде Claude Code: подписка и цена.
Отдельный вопрос для нас: чем платить. Российские карты Anthropic не принимает ни на Pro, ни на Max. Если зарубежной карты нет, простой путь это сервис оплаты подписок, который оформит подписку на твой аккаунт за рубли (реферальная ссылка: тебе тот же прайс, мне небольшой процент). Считай честно: разница между Pro и Max это $80 в месяц плюс комиссия, и она должна отбиваться работой.
На Max действует недельный лимит, отдельный от пятичасового. При очень плотной нагрузке подписка может незаметно переключиться в режим оплаты по токенам сверх пакета. Следи за счётчиком в настройках и не считай Max безлимитным: потолок выше, но он есть, и за его пределами включается тарификация по факту.
Правда про «обойти лимит»: обойти нельзя, тратить меньше можно
Скажу прямо, чтобы не было ложных ожиданий. Обойти лимит Claude нельзя. Нет скрытой кнопки, промпта-заклинания или настройки, которая снимает потолок бесплатно. Любой, кто обещает «безлимит по секретному способу», продаёт либо чужой перепродаваемый доступ, либо воздух. Лимит это защита инфраструктуры Anthropic, и она работает на всех тарифах.
Зато между «упираться к обеду» и «сидеть полный день» лежат твои привычки. Потолок остаётся прежним, просто ты перестаёшь жечь его впустую: меньше лишнего контекста, модель под вес задачи, markdown вместо PDF, план вместо переделок, отключённые сервера и агенты по делу. По отдельности каждый приём экономит понемногу, вместе они дают те самые восемь часов вместо двух на той же подписке.
И есть неочевидный бонус. Пока лимит тикает, ты осторожничаешь: боишься переделать лишний раз, экономишь каждый запрос, работаешь зажато. Когда лимита хватает на весь день, голова освобождается, и ты пробуешь смелее. Именно на десятке свободных проектов и набивается рука, одного осторожного для этого мало.
Чек-лист: что у тебя теперь есть
Пройди по списку. Если разобрался с приёмами правильно, все пункты закрыты.
- Понимаешь, что лимит считается в токенах и сбрасывается в двух окнах: скользящем 5-часовом и недельном.
- Знаешь, что «отдельный лимит у Claude Code» это миф: всё считается из общего пула подписки.
- Пишешь компактные промпты без вежливых обёрток и повторов.
- Чистишь контекст через
/clearв Claude Code и стартуешь новый чат с резюме в чат-приложении. - Прогоняешь PDF через MarkItDown перед загрузкой в Claude.
- Поставил Headroom, если много кодишь, чтобы экономия шла автоматически.
- Ставишь Sonnet или Haiku на рутину, а Opus бережёшь для тяжёлого. Мелочь ушла на локальную модель.
- Кэшируешь повторяемые инструкции в Память, Проекты и
CLAUDE.md. - Планируешь тяжёлые задачи через Plan Mode вместо того, чтобы бросаться в код с ходу.
- Хоть раз посмотрел
/contextи знаешь, сколько токенов съедают подключённые MCP-сервера ещё до твоего первого сообщения. - Отключаешь через
/mcpсервера, которые не нужны в текущей задаче, или включил отложенную загрузку инструментов. - Зовёшь сабагента только туда, где его вывод короче его входа, и не разбиваешь на рой связную задачу.
- Понимаешь, когда апгрейд на Max окупается, а когда достаточно починить привычки.
Дальше правило одно: обойти лимит нельзя, но растянуть подписку в разы можно. Начни с приёмов 1 и 2, они бесплатны и дают основной выигрыш в первый же день. Потом один раз загляни в /context, это пять секунд и часто самая большая находка. Остальное подключай по мере того, как доходят руки.
Идея приёмов 8 и 9 выросла из разбора экономии токенов в мультиагентных схемах, по материалам kdnuggets.com. Оригинал написан для разработчиков агентных систем, здесь те же принципы переложены на обычную подписку Pro.
Рассылка
Подпишись на еженедельную рассылку
Полезные материалы и скиллы, которые усилят твою работу с нейросетями и помогут больше зарабатывать. Раз в неделю, без воды и спама.
человек уже подписались
Готово! Ты в списке.
Первое письмо придёт в ближайшую рассылку. Отписка в один клик.
Частые вопросы
Как устроены лимиты Claude Pro и Max в 2026?
Лимит считается в токенах и обнуляется в двух окнах: скользящее 5-часовое и недельное. Pro за $20 даёт примерно 45 сообщений в пятичасовое окно, Max 5x за $100 в пять раз больше, Max 20x за $200 в двадцать. Точных цифр Anthropic не публикует, есть только множители. С 18 июля 2026 недельные лимиты Claude Code подняты на 50 процентов для Pro, Max и Team, но до 19 августа 2026.
Claude лимит закончился, что делать прямо сейчас?
Дождись сброса пятичасового окна, оно скользящее и открывается частями в течение дня. Пока ждёшь, вынеси мелочь на бесплатную модель или на Haiku. На будущее срежь расход: чисти контекст через /clear, переводи PDF в текст через MarkItDown, держи чаты короткими. Обойти лимит нельзя, но растянуть подписку в разы реально.
Как экономить токены Claude без потери качества?
Главный расход это раздутый контекст, который модель перечитывает на каждый ответ. Держи диалоги короткими и чисти историю. Ставь модель под вес задачи и держи Opus для тяжёлого. Грузи повторяемые файлы один раз в Проект. В Claude Code набери /context и посмотри, куда уходят токены: часто половину съедают описания подключённых MCP-серверов, которые в этой задаче не нужны.
Сабагенты в Claude Code экономят токены или жгут?
Зависит от задачи. Anthropic в разборе своей мультиагентной системы называет цифры: обычный агент тратит примерно вчетверо больше токенов, чем диалог в чате, а схема из нескольких агентов примерно в 15 раз больше. Сабагент экономит, когда перелопачивает много материала и возвращает короткую выжимку. Жжёт, когда задачу нельзя разложить на независимые ветки.
Когда апгрейд на Claude Max реально нужен?
Когда ты уже применил приёмы экономии, а лимит всё равно выбиваешь каждый день по реальной работе. Max 5x за $100 это примерно пятикратный запас к Pro, Max 20x за $200 двадцатикратный. Если Claude приносит деньги и простой из-за лимита стоит дороже разницы в цене, апгрейд окупается. Если упираешься от раздутых чатов, сначала почини привычки.