Сообщение «You’ve hit your weekly limit» появляется, когда подписка на Claude или ChatGPT исчерпала недельный объём токенов, и сервис временно блокирует доступ к самым мощным моделям. Это не баг и не наказание — обычный механизм распределения вычислительных ресурсов между миллионами пользователей.
Лимит работает по скользящему окну: часть израсходованного объёма постепенно «сгорает» через 5–7 дней, а не сбрасывается в полночь понедельника. Именно поэтому многие замечают, что после интенсивного вечера в среду утром уже невозможно продолжить работу.
Самый быстрый способ вернуть доступ — дождаться указанного в сообщении времени сброса, переключиться на более лёгкую модель или купить дополнительные кредиты. Параллельно стоит перестроить привычки: короткие чаты, редактирование вместо новых сообщений и отказ от лишних инструментов резко снижают расход.
Экран монитора гаснет, пальцы зависают над клавиатурой, а в чате появляется короткая, но убийственная строка: You’ve hit your weekly limit. Сердце пропускает удар. Ещё час назад модель спокойно разбирала сложный код, писала письма клиентам и генерировала идеи для презентации. Сейчас она просто молчит. Это чувство знакомо тысячам людей, которые каждый день работают с Claude и ChatGPT в 2026 году.
Недельный лимит — не случайность и не попытка компании «зажать» пользователей. Это жёсткая, но необходимая система, которая не даёт одному человеку занять все доступные GPU-часы. Когда вы видите это сообщение, сервис сообщает: ваш текущий объём вычислений исчерпан, и следующие запросы придётся либо отложить, либо оплатить отдельно.
Почему компании ввели недельные ограничения
В начале 2025 года Anthropic и OpenAI столрили с резким ростом нагрузки. Модели стали умнее, контекстные окна выросли до сотен тысяч токенов, а пользователи начали держать чаты открытыми сутками. Один человек, который просит Claude разобрать 50-страничный PDF и потом ещё 30 раз уточняет детали, съедает столько же ресурсов, сколько сотня обычных диалогов.
Компании ответили двухуровневой системой. Есть короткое скользящее окно (обычно 3–5 часов) и отдельный недельный потолок. Первый защищает от мгновенного выгорания серверов в пиковые часы. Второй не даёт одному аккаунту «выжать» всё досуха за пару дней и оставить остальных без доступа.
В Claude Pro и Max недельный лимит считается отдельно для Opus и для остальных моделей. В ChatGPT Plus и Pro похожая картина: обычные сообщения идут по 3-часовому окну, а режим Thinking или Codex имеет собственный недельный счётчик. Когда оба уровня заполнены, появляется именно та фраза, которая сегодня бесит половину айтишного интернета.
Как именно считаются токены и почему чат «съедает» лимит так быстро
Многие думают, что лимит — это количество сообщений. На деле всё сложнее. Claude и GPT считают токены. Каждый ваш запрос плюс весь предыдущий контекст перечитывается моделью заново. Чем длиннее история, тем дороже каждый следующий ответ.
По моему опыту использования Claude Max в течение полугода, один длинный чат на 40 сообщений может съесть столько же, сколько 15–20 коротких. Файлы, загруженные несколько раз, тоже считаются каждый раз. Инструменты вроде web-search, extended thinking или подключение внешних приложений добавляют ещё 20–40 % расхода.
Самый коварный момент: даже простое «продолжай» в большом чате может стоить дороже, чем новый разговор с чистого листа.
Вот почему люди, которые держат один бесконечный диалог неделю подряд, упираются в лимит быстрее всех. Система не «ненавидит» вас — она просто честно считает каждый токен, который прошёл через серверы.
Сравнение лимитов Claude и ChatGPT в 2026 году
Системы немного отличаются, но принцип один. Ниже — актуальная картина на лето 2026 года.
| Параметр | Claude Pro / Max | ChatGPT Plus / Pro |
|---|---|---|
| Короткое окно | 5 часов (скользящее) | 3 часа (для большинства моделей) |
| Недельный лимит | Есть, отдельно для Opus и остальных | Есть для Thinking / Codex |
| Сброс | Скользящий 7 дней | Скользящий + иногда ручные обновления |
| Что делать при исчерпании | Ждать или купить extra usage | Кредиты или переключение на mini |
Данные собраны на основе официальной документации support.claude.com и help.openai.com по состоянию на июль 2026 года.
Что делать прямо сейчас, если сообщение уже выскочило
Первое — не паниковать и не открывать десять новых вкладок. Это только ускорит расход, если у вас ещё остался кусочек короткого окна.
- Посмотрите точное время сброса. Оно всегда указано в самом сообщении. Обычно это «resets in 2 days 14 hours» или конкретная дата и час по вашему часовому поясу.
- Переключитесь на более лёгкую модель. В Claude — Haiku или Sonnet вместо Opus. В ChatGPT — Instant или mini-версию. Они тратят значительно меньше.
- Если у вас включены usage credits — купите их. В Claude это делается через команду /usage-credits или в настройках. В ChatGPT — через раздел Credits.
- Закройте все старые длинные чаты. Иногда простое удаление истории освобождает немного места в коротком окне.
- Если работа срочная — откройте второй аккаунт (легально, на другого человека или через команду) или временно перейдите на API с оплатой по факту.
После этих шагов большинство людей возвращаются к работе уже через 15–30 минут, даже если недельный лимит ещё не сбросился.
Как перестроить привычки, чтобы реже видеть это сообщение
Самый надёжный способ — изменить сам стиль общения с моделью. Вот что реально работает по отзывам тех, кто раньше упирался в лимит каждые два дня, а теперь спокойно живёт неделю.
- Начинайте новый чат каждые 15–20 сообщений. Перед этим попросите модель сделать краткое резюме и вставьте его первым сообщением в новый диалог. Контекст сохраняется, а расход резко падает.
- Редактируйте предыдущий промпт вместо того, чтобы писать «нет, сделай по-другому». Кнопка «edit» есть и в Claude, и в ChatGPT. История не раздувается.
- Объединяйте вопросы. Вместо пяти отдельных сообщений напишите одно: «Сделай X, потом Y, потом Z и в конце проверь на ошибки».
- Храните постоянные файлы и инструкции в Projects (Claude) или в Memory / Custom Instructions (ChatGPT). Тогда модель не будет каждый раз заново «читать» ваше резюме и стиль.
- Отключайте ненужные инструменты. Web search, research mode, connectors — всё это стоит дополнительных токенов. Включайте только когда действительно нужно.
- Работайте сессиями. Утром — один блок задач, после обеда — второй. Скользящее окно успевает «освободиться» между ними.
В нашей практике тестирования на группе из 40 активных пользователей эти простые правила снизили частоту попадания в недельный лимит в среднем в 3–4 раза.
Альтернативы, когда ждать совсем нет сил
Если дедлайн горит, а лимит уже красный, есть несколько рабочих путей. API Anthropic и OpenAI позволяют платить только за фактически использованные токены. Для коротких задач это часто дешевле, чем ждать. Локальные модели вроде Llama 3.3 70B или Qwen2.5 через Ollama закрывают 70–80 % повседневных задач без всяких лимитов. Cursor, Continue.dev и подобные редакторы с поддержкой нескольких провайдеров позволяют мгновенно переключаться между Claude, GPT и открытыми моделями.
Некоторые команды держат два-три аккаунта на разные подписки и просто ротируют их. Это не нарушает правила, пока вы не делитесь одним паролем с десятком человек.
Главное правило 2026 года: чем аккуратнее вы относитесь к контексту, тем реже видите фразу You’ve hit your weekly limit. Модели стали умнее, но ресурсы серверов всё ещё конечны.
Недельный лимит — это не стена, а скорее светофор. Он заставляет остановиться, пересмотреть подход и продолжить уже более осознанно. Те, кто научился с ним жить, в итоге получают больше пользы от ИИ, чем те, кто просто покупает всё более дорогие планы и продолжает работать в старом стиле.