📱

Get Our Mobile App

Take your business learning on the go!

Download on the App StoreGet it on Google Play

Вы теряете 98% токенов впустую. 16 советов, как это исправить в Claude Code

Марина Тацевич | ИИ-автоматизация42:36

Transcription

Ребята, всем привет. Если вы работаете в Clode, то, скорее всего, сталкивались с этой проблемой. Открываете сессию, делаете пару задач и лимит уже на исходе. При этом ощущение такое, что как будто бы ничего особенного и не сделали. И мне стали приходить вопросы именно об этом. Марина, почему так быстро заканчивается лимит? Что происходит? Что делать, чтобы не переходить на более дорогой план? И сегодня мы постараемся разобраться в этой теме.

Сначала, почему лимиты тратятся так быстро? Потому что как только мы это поймём, то советы, о которых будет сегодня речь, станут довольно очевидными. И пройдёмся с вами по шестнадцати конкретным приёмам, советам от простых привычек до стратегии, а благодаря которым мы уменьшим расходование токенов. Итак, поехали.

Сначала разберёмся, как работают токены. А токен - это наименьшая единица текста, за которую cloud списывает лимит. И, грубо говоря, один токен - это приблизительно 0,75 слова. То есть 1.000 токенов это около 70 750 слов. Э, и каждый раз, когда вы отправляете сообщение, cloud его читает, обрабатывает текст, и каждое слово в этом тексте стоит токены. Но вот где начинается самое интересное. Cloud перечитывает весь разговор каждый раз. То есть когда вы работаете с Cloud Code, а у вас есть контекстное окно, где вы задаёте вопросы, строите какие-то автоматизации, скилы и так далее. И когда вы отправляете новое сообщение в это окно, токло Клоуд ээ читает не только это сообщение, он перечитывает всю историю вот в этом контекстном окне с самого начала. То есть ваше первое сообщение, первый ответ от клода, второе сообщение, второй ответ и так далее до вашего последнего нового сообщения. Каждый раз всё заново. И вот почему стоимость разговора э растёт неравномерно, а просто с огромным ускорением. Первое сообщение может стоить, например, 500 токенов, да, если вот вы отправляете какой-то прот. Но тридцатое сообщение в одном и том же окне уже может стоить 15.000 токенов. Просто потому, что Клод перечитал всю историю э до того, как перешёл к вашему вот последнему новому сообщению. И даже я где-то читала, что один разработчик замерил, что в чате из 100 сообщений 98% токенов может уйти на перечитывание старой истории. Не на вашу задачу, а просто на повторное чтение того, что уже было.

Дальше. А что ещё? может съедать токены до первого сообщения. Это может быть самой такой неочевидной частью. А прежде чем вы пишите хотя бы одно сообщение э в cloud, cloud уже тратит токен. А потому что при каждом э при каждой новой сессии он загружает, а cloud md файлы, подключённые mcp э серверы какие-то. тулы, скилы, а файлы памяти, так, например, Memory MD файл и так далее. И свежая сессия без даже одного сообщения может уже, э, расходовать где-то 50.000 тов. Это не какой-то баг, это так устроено, но если знать это, этим можно управлять. Допустим, вот у меня сейчас открыто свежее контекстное окно, нет ни одного сообщения и просто как пример показать вам достаточно ввести косую черту. Так, скоeк ent. И мы увидим как раз-таки вот на данном аккаунте у меня, э, тарифный план Pro, модель Sonet. Сейчас у меня по умолчанию и на плане, э, контекстное окно включает в себя 200.000 токенов. И мы видим, что сразу же съедается практически 22.000 токенов, то есть 11%. И далее мы видим эти токены по категориям, системные промты, а какие-то файлы, MCP, Memory Files. Вот как раз-таки здесь сидит Cloud MD, Memory MD file, скилы сообщения всего лишь восемь токенов, потому что, ну, ничего не было. Так и свободное ещё место. немножко подробнее о об использовании контекст команды и об этих категориях поговорим с вами, но вот на данный момент, чтобы вы представляли, как это устроено.

И ещё одна вещь, которую я хочу, а, упомянуть, перед тем, как перейдём к советам, что переполненный контекст, э, он не просто стоит дорого, но он ещё и снижает качество. А, то есть, если у вас опять же контекстное окно, в котором очень много сообщений, а то клод лучше всего видит начало и конец сессии, а вот то, что накопилось в середине, обрабатывается гораздо хуже. То есть одновременно мы и платим больше, потому что Клоду постоянно нужно читать историю перед тем, как обработать новое сообщение, которое мы пропишем. Но и при этом он выдаёт худшие результаты. И вот теперь, когда мы ознакомлены с такими неочевидными вещами, давайте перейдём, э, к конкретным, э, советам, привычкам, которые можно, а, выработать.

Итак, а рекомендация номер один, новый разговор на каждую новую задачу. Это самый простой, но, на мой взгляд, самый важный совет. То есть, если у вас контекстное окно, в котором вы уже переписываетесь, а, с клодом, даёте ему задачи, а много всего обсудили и теперь хотите перейти к какой-то новой задаче, то лучше всего перейти в новое контекстное окно, не писать, а не давать Клоду, мм, м новую задачу а здесь же. И как это сделать? Не нужно открывать новое окошко. Достаточно просто очистить историю контекстного окна. Можно это сделать с помощью, а команды клир, но то, что я заметила, меня об этом спрашивали, и то же самое я испытывала такой страх, что когда мы выполним эту команду клир, то автоматически клод забудет всё, э, о чём была речь в контекстном окне. Поэтому, ээ, здесь такой момент, не нужно бояться. Достаточно просто попросить Клод запомнить, а, конкретные моменты из вашей истории. И раньше, здесь такой есть лайфхак, раньше перед каждым использованием команды Clear, ээ, я либо прописывала вручную, либо голосом, а, говорила Клоду, что он должен сохранить из, э, историй, так, из этого контекстного окна. И так как я использую команду Кleр очень часто, я поняла, что это занимает время каждый раз спросить Клод, что ему нужно запомнить. Поэтому я создала скилл learn, а где указала Клоду, что для меня важно, чтобы он всегда сохранял. То есть в моём случае это были э принятые решения в переписке с Клодом. А статусы задач, какие-то планы, идеи, которые у меня возникают, так я сразу же прописываю, могу их прописывать в окне. И сейчас каждый раз я сначала использую а alarm. Так, и Клод уже знает, что должно быть сохранено, например, в Memory MD file. А если что-то должно быть сохранено в Cloud MD, то он у меня спрашивает, он не делает это автоматически, чтобы не засорять Cloud MD файлы. И об этом тоже мы сегодня поговорим. А, и, э, как только этот скилл, э, выполнен, так можно прописывать алир и у нас новое м окно. Можем переходить к решению новой задачи.

Далее. А второй совет. Объединяйте запросы в одно сообщение. Это связано с тем, о чём была речь в самом начале. Так, каждое новое сообщение клод перечитывает всё сначала. То есть это значит, что три отдельных сообщения стоит примерно в три раза дороже, а, чем одно сообщение, но с тремя пунктами, так, с тремя задачами. Поэтому, если у вас несколько связанных задач и вот они уже есть в голове, то лучше отправить их вместе одним сообщением. И в данном случае такое сообщение с тремя задачами даст нам нужный результат по обычной стоимости. Клод не будет перечитывать всю историю.

Далее, третья рекомендация. А план mode, так, режим планирования перед большой задачей. Самый, наверное, дорогой сценарий - это когда Клод начинает работу, уходит в неправильном направлении, делает кучу изменений, и мы понимаем в какой-то момент, что это не то, что мы хотели, нужно всё переделывать. При этом токены уже потрачены и потрачены впустую. И чтобы это не происходило, а перед большой задачей, перед созданием скила, автоматизации, используйте режим планирования. То есть clна составит план, а задаст нам уточняющие вопросы, убедится, что он всё правильно понял и только потом будет выполнять пункты в этом плане. И к режиму планирования можно перейти, переключая здесь, так, на Plan Mode. Или же можно использовать горячие клавиши Shift Tab и таким образом переключаться. Так, плано.

Далее, э, совет номер четыре. А, смотрите, что делает Клод. Я бы советовала не отправлять задачу, а и, знаете, просто лучше не отправлять задачу и не уходить э на что-то другое, потому что иногда Клод начинает работать и ходит не туда, застревает, читает одни и те же файлы снова и снова. Если мы это видим, просто нажимаем escape и всё, работа клода над конкретной задачей останавливается, токены не тратятся, мы корректируем задачу, запускаем заново. Потому что если клод зависнет в какой-то вот своей петле, то большая часть токенов уйдёт в пустую. И рекомендую это делать хотя бы в начале задач. Так просто убедиться, что клод пошёл в правильном направлении, э-э, начал, э, анализировать, подключать именно те приложения, те платформы, которые нам нужны для выполнения задачи, к которым у нас есть доступ и так далее. Это очень много экономики и времени, и токенов.

Дальше, а, пятая рекомендация. Будьте точны с файлами и с запросами. Перед тем, как вставить какой-то файл, особенно большой, подумайте, а нужен ли клоду весь файл или только какой-то кусочек. Если есть ошибка, э, в какой-то одной функции, отдайте только её. Если нужен какой-то, а, один конкретный абзац скопировать Клоду и попросить его обработать, перевести, не знаю, проанализировать, суммировать, дайте только этот абзац, потому что больше контекста в данном случае - это не помощь к лоду, это просто лишние токены. И, э, то же самое с нашими запросами, так, с формулировками. Вместо того, чтобы сказать Клоду: "А, улучши этот проект или проанализируй там целую папку с документами, м когда Клод начинает читать всё подряд, пытаясь понять вообще с чего начать, лучше конкретно м сказать, добавить что есть такой-то файл или такие-то файлы, проанализируй их в первую очередь и от этого отталкиваться". То есть, чем точнее запрос, тем меньше лишних действий, лишних чтений, которые, которые проделывает clуд, и тем меньше токенов.

Далее, а совет номер шесть, а, запустите, а, команду контекст, так, то есть то, о чём мы уже говорили, э, так как многие понятия не имеют, куда уходят токены, и если не видишь проблему, то как же её решить? Как же её исправить? А, поэтому, э, команда контекст, а, вот вы работаете, у вас уже много сообщений в контекстном окне, м, выполнили эту команду и сразу же увидите, а, категории, а, токенов по в такой в такой разбивке. И здесь важно понимать, что есть определённые категории, на которые мы не повлияем. А, например, system, system tools, да, какие-то базовые инструкции, встроенные инструменты клода. А, но, например, вот Cloud MD, Memory MD file должны быть короткими. А очень важная вещь, про которую поговорим. А skills, так, это те скилы, которые у вас есть. Очень многие сейчас скачивают с интернета готовые скилы, просто там сотни этих скилов. При этом не задумываясь, что это будет очень быстро съедать токены, хоть клоп не анализирует целиком а файл skill md в каждом из скилов он только анализирует name и description, но всё равно, если этих скачанных скилов, которые вообще никак мм не настроены под конкретный бизнес, они будут просто съедать очень очень много токенов.

Так, ээ, дальше, а, следующий совет, а, запустите команду, а, она позволяет посмотреть, а, сколько стоит текущая сессия. А, но здесь важная оговорка, что это актуально только для API пользователей. Если у вас подписка Pro либо Макс, то мы просто платим, а, каждый месяц за пользование клодкодом. И в данном случае, а, здесь мы ничего не увидим. То есть я могу, а, быстренько эту команду вызвать. Так, и просто у нас subscription. А, ну важно для тех, кто работает по API подписке, чтобы контролировать токены.

А дальше, а следующая рекомендация, э, которую, э, я назвала, не давайте лимиту застать вас в расплох. Она супер простая, но это просто, наверное, одно одна из первых вещей, которые я делаю, а когда сажусь за компьютер и включаю клод-код. А это просто открыть дашборд, так сайт, официальный сайт Cloud AI, а свой аккаунт, зайти в настройки, и вы будете иметь доступ к разделу с лимитами использования. Там можно увидеть картину в реальном времени. То есть, например, если мы зайдём на Cloud AI, а, так. Да, на данный момент у меня здесь я подключена к аккаунту мм к плану Pro. Этот аккаунт к плану Pro. Переходим в settings. И здесь достаточно выбрать usage. И мы увидим, э, две такие самые главные вещи: информацию о текущей сессии, сколько процентов использовано и через сколько эта сессия обновится, а также недельные лимиты. Так, а-э, также, э, у меня активировалась, эээ, э, дополнительная возможность использования токенов, а, потому что клодкод на прошлой неделе аэ раздавал м пополнял баланс а многих пользователей и дал, например, в данном случае мне 17 евро бесплатно для м экст использование токенов, если нужно. То есть я открываю это окошко, работаю в clode и при этом а время от времени просто переключаюсь на м браузер, так и проверяю, а сколько у меня ещё осталось лимита для текущей сессии и недельной.

Далее, а совет номер девять. Отключайте MCP серверы. Э, это относится как раз-таки к рекомендации, а, которую мы здесь обсуждали, аэ, в шаге номер шесть, потому что здесь мы видим категорию MCP Tools. И каждый раз, когда мы открываем новую сессию, то каждый подключённый MCP сервер съедает очень много токенов. То есть MCP-серверы - это, наверное, одна из самых тяжёлых, ну, давайте назовём это статей расхода. А потому что один MCP-сервер может стоить около 18 тыся токенов. даже за отдельное сообщение, то есть не за сессию. А и посмотреть, какие MCP-серверы у вас подключены, достаточно просто. А сшкоманда MCP. Так, и здесь у меня в этом аккаунте только Chrome, а DEF Tools, то есть этот MCP сервер помогает, благодаря немукод имеет доступ к хрому, а, считывает оттуда информацию, делает какие-то скриншоты и так далее. То есть, если нужно отключить какой-то конкретный, например, Google календарь, у вас подключён, но вы понимаете, что им не будете пользоваться, то просто нужно кликнуть на connected и здесь disable выбрать. И потом можно переподключить ээ нужный MCP-сервер в любой момент.

Далее, а следующая рекомендация про сжатие, а контекста. А, скорее всего, если вы активно работаете с клодкодом, вы замечали, а такое кружок, а, который показывает, а, сколько процентов, мм, контекста, э, вы уже использовали, а, какой лимит использован. И при достижении 95 либо 100% код автоматически будет сжимать контекст, так? Потому что вы уже, например, 200.000 токенов израсходовали, всё, вы дальше не можете э вписывать новое сообщение в одно и то же контекстное окно. То есть CL CL code сделает это автоматически. Но здесь нужно помнить такую вещь, что к этому моменту, а когда уже контекстное окно будет заполнено на 95%, во-первых, cloudкод будет работать намного хуже, потому что в нём скапливается слишком много информации, которая просто будет игнорироваться, да, то, о чём мы уже говорили. Поэтому не ждите этого. А лучше запускать сжатие самим, например, при 60%, при 50%. И здесь есть два подхода. Э, во-первых, мы используем команду compact для сжатия. И при, э, как мы, когда мы прописываем эту команду, то прямо можно сообщить Клоду, а на что он должен обратить внимание прижатии, что он обязательно должен сохранить, аа, чтобы не опустил какие-то важные моменты. И второй способ добавить раздел в F Cloud MD инструкции по сжатию. А где мы пропишем, что каждый раз при сжатии, неважно, либо это мы сами будем делать, вызывать компакт, например, при достижении 60% лимита или же, э, клод будет автоматически делать сжатие, он будет знать, что нужно обязательно сохранять.

Так, далее. Следующий, э, мини-совет тоже касается сжатий. Ээ когда вы работаете в одном и том же контекстном окне и, например, вы сделали уже три-четыре вот таких компакта, так, сжатия, а лучше перейти в совершенно новую сессию. А при этом просто попросите clд. Я иногда просто говорю, что буду переходить в новое контекстное окно. Дай мне, пожалуйста, summary. Итог всей ээ всего нашего разговора, всей этой сессии. Он мне даёт информацию, я копирую, спокойно, делаю clear. Так и перехожу аа и перехожу м и работаю в новом контекстном свежем окне.

Далее, следующий совет про выбор правильной модели. Я, наверное, говорю про это в каждом своём видео. Суперважная вещь. Не все задачи требуют самой мощной модели. И по умолчанию стоит по умолчанию мы подключены к модели Sonet, которая подходит для большинства задач. И как вообще проверить м текущую модель, с которой вы работаете. Касая черта модель enter. Так и видим, что by default по умолчанию sonet. можно переключиться на опус для более сложных задач. А особенно, например, когда а я хочу начать создание нового скила, включаю режим планирования и хочу, чтобы прямо клод код выдал мне очень хороший детальный план, а хорошо обработал как бы тоже мой входящий промт. Я перехожу на опуск для очень простых задач. на а хайку. Так.

А дальше следующая рекомендация по работе с субагентами. Здесь нужно понимать, что, э, запуск агентов, а, достаточно дорогой. А потому что когда мы их запускаем, то каждый из них стартует со своим полным контекстом. И в итоге работа с агентами стоит в 7-10 раз дороже обычной сессии. Но здесь есть такой приём, который можно использовать, запускать аа супагентов, например, на хайку модели вместо Sonet для каких-то очень простых задач. И это прямо можно прописать в файлике Cloud MD. И таким образом большая часть токенов уйдёт на дешёвую модель. результат при этом тот же, расход меньше. Но опять же здесь нужно понимать, и это приходит м со временем. Чем больше вы пользуетесь клодкодом, решаете разные задачи, вы уже будете понимать м для каких именно ваших задач лучше подходит мт модель. Для каких опус для каких хайков?

Дальше, а следующая рекомендация по поводу файла Cloud MD. Нужно помнить, что Cloud читает файл Cloud MD, а при каждом а при каждой новой сессии, а без исключений. А если cloud MD, Memory MD, вот эти термины вам не знакомы, то я рекомендую посмотреть вам одно из моих предыдущих видео, где более подробно об этом а говорю. Поэтому ссылка будет и в описании. Надеюсь, что где-то здесь тоже появится. А смело переходите. Надеюсь, что видео будет полезно. А так вот ClД MD. Нужно понимать, что если файл стал большим, разросся, то каждое сообщение тоже становится дороже. И рекомендация, а, согласно официальной документации от клода такая, чтобы cloud MDФа был меньше, чем 200 строк. А в идеале вообще, чтобы клод MD был 60 линию. Этого будет достаточно, и это можно сделать. А я столкнулась с таким вопросом. Меня спросили, а по поводу того, а как же вот передать как можно больше информации о себе клоду? А нужно ли прописывать в файле Cloud MD информацию о проекте, о том, кто я, какой стиль предпочитаю, например, при написании постов? а какие у нас клиенты, с какими странами мы работаем. Так вот, не нужно это всё прописывать, а в cloud MD файле. Этот файл нужно лучше всего воспринимать не как хранилище, а как такой мм индекс. То есть в книге, в любой книге одна из первых страниц - это содержание. где можно легко перейти к нужному разделу, к нужной странице. Так вот, мой подход такой, чтобы файли ClD, первые несколько линий, а, были, конечно же, о том, для чего конкретный проект, кратенько, э, кто мы, очень кратко, а далее все детали, а, прописывать там как такие references, то есть, например, а, описание бизнеса и услуги и даём ссылку путь к тому, где лежит эта информация. Либо это конкретный файл, либо какая-то папка. Стиль общения с клиентами даём путь. Потом, а, а, ссылки на социальные сети, сайт и так далее. Даём информацию, так, даём ссылку. А потом, например, наш стиль, что касается там логотипа, корпоративный стиль и так далее, цвета, бренды, тоже даём ссылку. И вот это поможет сделать Cloud MTФile и таким лаконичным, чистым. И при этом мы очень сильно поможем Клоду, потому что он любит, когда вот есть такая, э, чёткая информация, чёткая инструкция, где что лежит. Э, то есть таким образом Клод знает, где искать, и нет ничего лишнего. И ещё одна важная вещь про подробные инструкции для конкретных задач, а тоже мы этого это не прописываем в файлике CL Cloud MD. А конкретное под конкретной задачей мы создаём скилы. Так, и скилы у нас будут загружаться при вызове либо нами через команду конкретную, либо когда мы просим клод. А, то есть это совершенно отдельно. Так, skill skill mdфайл - это совершенно что-то другое, чем cloud md. Тоже важно это мм разграничивать.

Далее, следующая рекомендация кратенько по поводу Memory MD файла. Там тоже может накапливаться что-то лишнее. А это тоже файл, который читается при каждом запуске. И это своего рода такой файл памяти клода, где сохраняются важные моменты между сессиями, чтобы не забывать их после использования клир команды. И проблема в том, что туда попадают разные вещи. Устаревшие какие-то статусы задач хранятся, какие-то детали, которые уже не актуальны, а какая-то информация, которая дублируется в других файлах. файл разрастается и помню, что это съедает наши токены. И пример из моего опыта. Я открыла свой Memory MD файл. Его так просто не найти здесь среди папок, а, например, в Visual Studio Code либо Antigravity в зависимости от того, что вы используете. Поэтому просто достаточно попросить Клод открыть Memory MD файл, а вы ознакомитесь с ним, поймёте, что там вообще теперь хранится. В моём случае там была информация на 13 строки, а много было неактуального, и я просто попросила Клод, а проанализировать этот файл и дать мне список, э, с рекомендациями, что может быть удалено, э, как сделать, может быть, его лучше структурированным. И в итоге после чистки у меня осталось всего лишь 65 строк.

Так, и следующий совет про extended thinking или расширенное мышление, наверное, такой будет аналог на русском языке, возможно, не совсем точный. Это то, о чём а многие не знают. По умолчанию Клод думает перед каждым ответом. И это называется extendent thinking, расширенное мышление. И на это мышление тоже уходят токены при каждом ответе. Для сложных задач это оправдано, потому что клод глубже анализирует, меньше ошибается, выдаёт нам лучший результат. А, но если мы просим написать какой-то короткий текст, переименовать файлы, сделать сортировку файлов у нас на компьютере, например, или в каком-то проекте, ответить на простой вопрос, перевести что-то, токены на мышление тратятся, а результат может быть таким же и без вот этого extended thinking. И как вообще проверить, э, э, как какой уровень мышления у вас сейчас настроен. А для этого можно использовать э команду Effort. И мы видим, а что у меня стоит хай, так, самый высокий здесь на модели Solnet. По-моему, [фыркает] если переключиться на модель опуста, то там появится ещё четвёртый уровень. И можно переключаться на medium, на low. Очень тоже полезная вещь. И для простых задач, ну, по крайней мере, медиум должно хватать. Так, для сложных всегда можно вернуться на хай.

Итак, э, что самое главное, э, что я бы рекомендовала запомнить на данный момент. И вот с чего начать? А первое, а на каждую новую задачу начинать новый разговор. И помним про вот эту функцию clear. Дальше объединять запросы. То есть вместо пяти отдельных сообщений лучше написать одно сообщение с пятью пунктами, особенно если вы работаете в окне, где уже очень много всего. И каждый раз вы понимаете, что каждое новое сообщение - это чтение истории, э, всего окна для клода. И чем точнее запрос, чем точнее файл, тем, конечно, меньше лишних токенов, которые используется. Используем контекст, чтобы посмотреть, что съедает ваши токены. Используем команду compact, э, а, для того, чтобы сжимать, э, контекст, и можно следить за лимитами у себя в настройках аккаунта. И тоже ещё такая вещь. Прежде чем думать о переходе на более дорогой тариф, во многих случаях это обосновано, потому что сейчас мы действительно используем клод мм код для таких задач, где подписки про ну просто недостаточно. А, но я думаю, что эти рекомендации будут полезны как для тех, у кого про, так и для тех, у кого тариф Макс, потому что это просто такие привычки, а которые помогают эффективно работать с контекстом, с токенами. И чаще это вот как раз-таки не вопрос в тарифе, так, а просто вопрос в том, чтобы не прогонять клод-код несколько десятков раз через одну и то же ту же э историю э контекстного окна.

И ещё хотела бы закончить это видео на такой очень позитивной ноте. А потому что если вы регулярно упираетесь в лимиты, по крайней мере, я это так воспринимаю и так о себе думаю, то это хороший знак. А потому что это значит, что вы действительно работаете э с инструментом. Вы используете и и вы в честь тех, кто осваивает технологии не в теории, а на практике. И хочется верить, что это открывает новые перспективы для нас. Пишите в комментариях, какие из этих приёмов вы уже используете. Э, возможно, есть какие-то другие лайфхаки, а которыми хотели бы поделиться. Пишите, что попробуете в первую очередь. Если видео было полезным, ставьте лайк, подписывайтесь. Это реально помогает каналу. Спасибо большое, что были со мной в этом видео, и до встречи в следующих видео. Всем спасибо. Пока-пока.