MS_China_AI

MS_China_AI 

"..ИИ рядом, уже тут и мы этого не замечаем.."

8subscribers

131posts

goals2
2 of 1 000 paid subscribers
Рассказывать об ИИ агентах, возможностях, обучение, лайвхаки,видео и статьи, популяризация искусственного интеллекта
$0 of $3 717 raised
4x Tesla V100 32Гб HBM2 PCi-e (комплект для AI-Сервера)

Клод расходует ваши ресурсы быстрее, чем когда-либо. Anthropic не расскажет вам почему

Компания Anthropic ужесточила ограничения на использование, не предоставив никаких средств для управления этим процессом, а Сэм Альтман тем временем наживается на этом.
С момента написания этого текста кое-что изменилось. Окно контекста с 1 миллионом токенов теперь общедоступно для Opus 4.6 и Sonnet 4.6, но оно эксклюзивно для тарифного плана Max (100–200 долларов в месяц) . Пользователи Pro по-прежнему ограничены 200 000 токенов. Также в середине марта действовала временная акция, в рамках которой лимиты использования удваивались в непиковые часы, но она закончилась 27 марта.
Таким образом, потолок возможностей значительно выше, если вы используете Max, — но если вы используете Pro и сталкиваетесь с ограничениями, вы остаетесь в том же положении, что и раньше. Основная проблема, описанная в этом посте, никуда не исчезла: рабочие процессы агентов, такие как Claude Code, истощают лимиты неочевидным образом, и ни один план не защищает вас от этого полностью. Практический совет по-прежнему актуален: обдуманно подходите к тому, что вы помещаете в контекст, закрывайте сессии, когда закончите, и если вы постоянно сталкиваетесь с ограничениями, честный ответ — вы, вероятно, переросли Pro.
Обновление – 1 апреля 2026 г.: Ограничения Клода стали еще более странными.
Начиная с конца марта 2026 года, Anthropic незаметно ужесточает правила работы Claude в течение 5-часовой сессии в рабочие дни в США (примерно с 8:00 до 14:00 по восточному времени), поэтому многие пользователи Pro и даже Max теперь сталкиваются с ограничениями при нагрузке, которая раньше не вызывала проблем. Одно сообщение Sonnet или Opus может занять от 20 до 100% сессии, а у некоторых пользователей весь 5-часовой период исчезает менее чем за час после всего нескольких запросов.
Модераторы r/ClaudeAI теперь ведут оперативный отчет «Последнее состояние и обходные пути» с конкретными исправлениями для веб-версии, мобильных приложений, настольных компьютеров и кода Claude (изменения в settings.json, .claudeignorelean CLAUDE.md, read-onceхук и многое другое). Если вы хотите получить самые актуальные обходные пути от сообщества, начните здесь: Отчет о последнем состоянии и обходных путях .
В оставшейся части статьи я подробно описываю свою собственную систему дальнейшего развития подхода Клода — особенно рубрику «мышление против действия» и аудит запланированных задач стоимостью 338 долларов в год, — которые по-прежнему актуальны, но сейчас, когда ограничения фактически стали более жесткими, они имеют еще большее значение.
Если вы используете код Клода, сначала выполните следующие 3 действия.
Добавьте это к ~/.claude/settings.json(по умолчанию используются более дешевые модели, а ограничение — невидимое мышление): Этот единственный блок может сократить потребление кода Клода на 60–80% в реальных условиях использования.
```json
{
“model”: “sonnet”,
“env”: {
“MAX_THINKING_TOKENS”: “10000”,
“CLAUDE_AUTOCOMPACT_PCT_OVERRIDE”: “50”,
“CLAUDE_CODE_SUBAGENT_MODEL”: “haiku”
}
}
```
Создайте `.claudeignore` файл в своем репозитории и обработайте его следующим образом `.gitignore` :
игнорируйте папки node_modules/, dist/, build/, *.lock, __pycache__/, и другие большие или сгенерированные папки, чтобы Клод перестал перечитывать их при каждом запросе.
Установите `read-once` хук , чтобы Клод не сканировал одни и те же файлы снова и снова: пользователи сообщают об экономии десятков тысяч токенов за сессию только благодаря этому.
```bash
curl -fsSL https://raw.githubusercontent.com/Bande-a-Bonnot/Boucle-framework/main/tools/read-once/install.sh | bash
```
Для получения более сложных обходных путей, специфичных для кода Клода (бережливое производство , CLAUDE.md привычки , инструменты мониторинга), см. подробное руководство сообщества в мегатеме «Ограничения использования» `./clear/compact`
Пользуетесь бесплатным тарифом? Вот что действительно помогает.
Даже в бесплатной версии Claude можно расширить его возможности, изменив подход к использованию. Вот проверенные сообществом советы:
+ Для большинства чатов используйте Sonnet вместо Opus ;
+ Opus может стоить примерно в 5 раз больше токенов за аналогичную работу.
Избегайте варианта с контекстом 1M, если это не является абсолютно необходимым; переключитесь обратно на стандартную модель 200K в выпадающем списке, чтобы каждое сообщение обошлось дешевле.
Начинайте новые чаты чаще, вместо того чтобы создавать одну большую тему, и формулируйте подсказки очень конкретно («исправьте строку 42 в этом файле» вместо «исправьте ошибку аутентификации»).
Модераторы r/ClaudeAI постоянно обновляют список полезных для бесплатного тарифа приемов (тайминг сеанса, пакетная обработка подсказок, предварительная обработка документов и многое другое) здесь: Отчет о последнем состоянии и обходных путях .
Несмотря на то, что Anthropic постоянно меняет правила игры, основная проблема остается неизменной: большинство из нас тратит ресурсы Claude на «лишние мыслительные задачи», а не на реальную работу.
В оставшейся части этой статьи я расскажу о системе, которую я использую, чтобы изменить это соотношение — от того, как я структурирую подсказки и рабочие процессы, до аудита «запланированных задач» стоимостью 338 долларов в год, который снова сделал Claude пригодным для использования, даже в условиях сегодняшних более строгих ограничений.
Оригинальный пост:
Сегодня понедельник, 23:54. Я ничего необычного не делал. Я не писал целый код приложения в стиле vibe и не тратил восемь часов на исследования. И каким-то образом меня заблокировали в Claude из-за 100% использования сессии, не говоря уже о том, что я почти достиг лимита использования Claude на всю неделю… а ведь сегодня только понедельник.
Раньше это была проблема по пятницам, из-за чего мне приходилось проводить выходные вдали от компьютера, что, наверное, тоже имеет свою привлекательность.
Несколько месяцев назад я занимался по-настоящему серьёзной работой в Claude — создавал приложения с нуля, перезапускал эту рассылку, тестировал рабочие процессы, которые никогда раньше не пробовал. Я расходовал токены так же быстро, как студент расходует сигареты и лапшу быстрого приготовления. И меня это устраивало. Лимит казался щедрым.
Теперь я выполняю меньше задач, работаю эффективнее и к понедельнику после обеда натыкаюсь на предел. Это не сходится — если только этот предел не сдвинулся с места.
Да, так и было.
В конце марта Anthropic незаметно ужесточила 5-часовые лимиты сеансов Claude в часы пик по будням (с 8:00 до 14:00 по восточному времени). Они упомянули об этом в сообщении службы поддержки после того, как пользователи начали жаловаться. Около 7% пользователей теперь сталкиваются с лимитами, которых раньше никогда не достигали. Один абонент Max сообщил, что после одного запроса использование сервиса подскочило с 21% до 100%.
Причина? Спрос на Anthropic превышает возможности графических процессоров. Приложение Claude возглавило американский App Store после того, как контракт OpenAI с Пентагоном вызвал бойкот со стороны пользователей. Веб-трафик вырос более чем на 30% по сравнению с предыдущим месяцем. А новое контекстное окно с 1 миллионом токенов означает, что каждый разговор по умолчанию становится более ресурсоемким, даже если вы этого не чувствуете.
Компания Anthropic не спрашивала, устраивает ли их это. Они просто скорректировали лимиты и надеялись, что вы этого не заметите.
*В марте 2026 года компания Anthropic ужесточила ограничения Claude на пиковые часы работы. Теперь таймер вашей сессии работает быстрее, чем раньше, — даже если ваша рабочая нагрузка не изменилась*
Я заметил.
Поэтому я сделал то, что сделал бы любой здравомыслящий человек: попытался переключиться на Haiku посреди разговора, чтобы сохранить оставшееся время работы. Haiku — это более легкая и дешевая модель Клода, предназначенная для задач, не требующих сложных рассуждений. Если бы я мог перенаправлять туда более простую работу, я бы смог сохранить время работы с Sonnet для тех задач, которые действительно в этом нуждаются.
Результат:
«Подсказка слишком длинная. Этот разговор слишком затянут, чтобы продолжать. Начните новую сессию или удалите некоторые инструменты, чтобы освободить место».
В тот момент я понял настоящую проблему. Дело не только в том, что ограничения ужесточились. Дело в том, что нет механизмов контроля, позволяющих ими управлять.
*В Claude Desktop можно переключать модели, но результат может оказаться не таким, как вы ожидали*
В Claude Desktop можно переключать модели — я проверил, инструмент выбора находится прямо внизу окна создания сообщения. Но переключение на Haiku посреди разговора сохраняет всю историю контекста, и если эта история существенна (а любая реальная рабочая сессия будет такой), Haiku не сможет её сохранить. Переключение не удастся.
Можно переходить только вверх — от хайку к сонету. Не вниз.
Это значит, что решение о выборе модели должно быть принято до того, как вы наберете первое сообщение. Не после. Не тогда, когда вы поймете, что исчерпали свой лимит. До.
*Нельзя переключиться на хайку посреди разговора, чтобы сэкономить лимит. Когда контекст становится большим, более лёгкая модель не может его вместить. Стена реальна — и её нельзя сдвинуть*
Компания Anthropic создала самого функционального ИИ-помощника из всех доступных. Многих из нас он по-настоящему зацепил — мы управляли им, автоматизировали рабочие процессы, создавали то, что раньше не могли создать. А потом, незаметно для всех, сделали выполнение того же объема работы дороже.
История стара как мир! Первая игра была бесплатной. Теперь нужно платить. Знакомо?
*Увлекитесь бесплатным тарифом. Постройте на нем весь свой бизнес. А потом обнаружите, что правила изменились*
Тем временем Сэм Альтман из OpenAI объявляет об отсутствии ограничений в тарифном плане Pro. Это не совпадение. Это прямой посыл каждому пользователю Claude, который сейчас разочарован. Время выбрано слишком удачно.
(К слову: у «отсутствия ограничений» OpenAI есть мелкий шрифт — плюс пользователи по-прежнему ограничены 160 сообщениями за 3 часа, после чего происходит переход к мини-моделям. Но маркетинг выполняет свою задачу.)
*Выбор времени Сэмом Альтманом не случаен. «Без ограничений» — со звездочкой — появляется именно тогда, когда пользователи Claude больше всего раздражены*
Вот в чем дело. Я не собираюсь уходить от Клода. Качество по-прежнему лучше для моей реальной работы. Созданные мной интеграции, запланированные задачи, управляющие рассылкой новостей, то, как он понимает контекст в длительных проектах — ничто из этого не переносится на ChatGPT в одночасье.
Но я также не собираюсь делать вид, что этого не происходит.
Решение — настоящее решение — простое в теории, но раздражающее на практике: вам нужно выбрать правильную модель до начала каждого разговора, потому что эффективно исправить ее после этого невозможно. Выбор модели — это предварительный этап.
Для платных подписчиков я делюсь следующей информацией:
+ Точная схема «мышление против действия» — пошаговая инструкция по выбору между хайку, сонетом или опусом перед открытием нового чата.
+ Функция ручного аудита рабочих процессов , которая классифицирует все ваши обычные задачи по уровням моделей и оценивает, сколько вы сэкономите, перейдя на другой подход.
+ Функция проверки запланированных задач, которую я использовал, позволила сократить расходы на 338 долларов за счет использования токенов , включая задачу, которая съедала 54% всего моего бюджета (и из-за этого проваливалась).
+ Неожиданный вывод: сокращение количества подсказок практически ничего не меняет. Вот что действительно меняет ситуацию.
Subscription levels1

Премиум

$20 per month
Доступ к закрытой части, видео, обучение, статьи, лайвхаки, дополнительные материалы
Go up