📱

Get Our Mobile App

Take your business learning on the go!

Download on the App StoreGet it on Google Play

GitHub Copilot billing and credits explained. Plus 5 ways to spend less

Barbara Forbes | Ba4bes16:36

Transcription

Если вы используете GitHub Copilot, вы, вероятно, слышали, что 1 июня 2026 года все изменится. Не паникуйте, но вам нужно знать, как работает эта новая модель оплаты. Хорошая новость в том, что можно подготовиться, и, вероятно, все будет не так плохо, как вы думаете. Когда вы задаете Copilot вопрос вроде «Рефакторинг моего кода», «Напиши это приложение», «Проверь этот PR», все это требует вычислительной мощности, и это может быть оправдано, а может и нет. На протяжении большей части существования Copilot эта вычислительная мощность не имела значения. Вы платили фиксированную плату и использовали все, что хотели. Но эта модель меняется, и понимание того, почему она изменилась и как работает новая модель, поможет вам максимально использовать имеющиеся у вас кредиты. Вы можете даже тратить меньше или получать лучшие результаты. Ладно, я немного оптимист, но именно об этом мы и поговорим в этом видео. Как мы к этому пришли? Что означает новая модель оплаты? И в конце я поделюсь несколькими советами и хитростями, которые вы можете использовать, чтобы максимально использовать свои кредиты GitHub Copilot. Одно быстрое заверение, прежде чем мы начнем. Автодополнение в Visual Studio Code останется прежним. Неограниченное использование во всех платных планах. Изменения в биллинге касаются только чата, агентского режима и проверки кода, а не встроенных предложений в вашем редакторе. Так что это хорошо. Чтобы понять текущую модель ценообразования, нам сначала нужно понять, почему старая модель перестала работать. Когда был запущен GitHub Copilot, это было, по сути, умное автодополнение. Не очень хорошее на тот момент. Вы набирали что-то, и он предлагал следующие несколько строк. Это была одна из первых практических реализаций помощи ИИ, которую мы видели. Каждое предложение было небольшой, быстрой и дешевой операцией. Так что изначально это был бесплатный уровень, когда он был в предварительной версии. А затем, когда деньги стали вопросом, первая подписка представляла собой фиксированную плату в размере 10 долларов в месяц. Кстати, это вызвало некоторое возмущение, потому что мы думали, что это безумно дорого, хотя это намного дешевле всех подписок на ИИ, которые у нас есть сейчас. В любом случае, ИИ стал лучше. Появилось больше вариантов. Разработчики стали более амбициозными, и GitHub представил Copilot Chat, а затем агентский режим. И в этот момент Copilot перестал быть автодополнением и стал агентом. Вместо того, чтобы предлагать следующую строку, вы теперь могли просто сказать: «Рефакторинг всей этой модели», «Найди и исправь все ошибки в этом файле», «Запусти проверку всего кода в моей кодовой базе и дай мне обратную связь». И Copilot сделает это. Он возьмет цель, разобьет ее на шаги, вызовет инструменты, прочитает файлы, выполнит команды, проверит результаты. Он мог работать минутами. Теперь вот в чем проблема. Оба эти действия, как предложение из одной строки, так и 20-минутная сессия, будут стоить одинаково. Это одна подписка и один премиум-запрос на вопрос. В апреле 2026 года GitHub опубликовал сообщение в блоге, в котором говорилось, что стало обычным делом, когда несколько агентских запросов стоят дороже всего месячного плана. Так что речь идет о стоимости вычислений для этих запросов. Проблемы были настолько велики, что в конце апреля они прекратили новые регистрации. Они ужесточили лимиты и перестроили модель биллинга. И вот мы с новой моделью, основанной на использовании. Нам это может не понравиться, но это имеет больше смысла. Мы все запутаны, потому что, давайте признаем, нас избаловали. Я не знаю, как вы, но я использовал самые дорогие модели для самых простых задач, потому что почему бы и нет? У меня было так много премиум-запросов, что я все равно их не закончил. Ну, я закончил, но не об этом. Эта новая модель означает, что нам действительно нужно понять механику запроса, который мы задаем C-Pilot, а затем заставить его работать на нас. Итак, давайте просто погрузимся и выясним, что происходит, когда мы что-то спрашиваем у Copilot. Все в новой модели биллинга сводится к одной концепции — токенам. Вы, вероятно, уже слышали об этом, но давайте убедимся, что мы понимаем это слово, потому что оно станет намного важнее. Токен — это не слово. Это не символ. Это фрагмент текста, который языковая модель обрабатывает как единое целое. Существуют веб-сайты, которые помогут вам увидеть, сколько токенов в предложении. В среднем токен составляет примерно 3/4 слова. Так что 100 слов — это около 130 токенов. Я упрощаю, но давайте остановимся на этом. Короткие слова, такие как «the» или «is», обычно составляют один токен каждое, но более длинные или необычные слова могут состоять из двух или трех токенов. Код часто более плотный по токенам, чем обычный английский, потому что идентификаторы и символы синтаксиса получают свои собственные токены. Теперь, почему это важно для биллинга? В новой модели каждое взаимодействие в Copilot измеряется в токенах. Дело в том, что вам выставляется счет не только за то, что вы набираете. Вам выставляется счет за то, что система передает Copilot в качестве входных данных, за то, что Copilot может отправить обратно, и за все промежуточное. Теперь я знаю, что это много. Так что давайте разберем это. Сначала у нас есть входные токены. Это все, что получает модель. Затем выходные токены. Это все, что генерирует модель. Наконец, у нас есть кэшированные токены. Это контент, который был недавно обработан и сохранен, который модель может повторно использовать с меньшими затратами. Это может быть не так просто, как вы надеялись. Хорошо, мы используем все три типа токенов каждый раз, когда взаимодействуем с Copilot. И в новой модели мы фактически платим определенную сумму за каждый из этих токенов с помощью AI-кредитов GitHub. Итак, 1 AI-кредит равен 1 центу. Наконец-то что-то простое. Вот снова осложнение. Стоимость за токен или, фактически, за миллионы токенов зависит от используемой модели. Легкая модель, такая как GPT5 mini, будет стоить гораздо меньше за токен, чем модель Frontier, такая как Opus 4.7. Хорошо, еще одно осложнение. Надеюсь, токены, за которые вы платите, — это не только ваш запрос. Существует целый стек контента, который вставляется в каждый запрос без вашего ведома, и вам выставляется счет за все это. Нет причин паниковать. Позвольте мне провести вас через слои вашего запроса к Copilot. Сначала системные инструкции. Каждый раз, когда вы открываете Copilot, GitHub вставляет внутренние инструкции, которые говорят модели, как себя вести. Так он указывает свою роль, ограничивает форматирование кода. Они всегда присутствуют в каждом запросе, и вы не можете их видеть и не можете их удалить. Так что это первые токены в контекстном окне, и вы еще ничего не набрали. Затем ваши файлы настройки. Я сделал много коротких видео о файлах настройки, так что смотрите мой канал, чтобы быть в курсе. У нас есть copilot instructions.mmd, который является глобальной настройкой для вашего проекта. Это значительно улучшает результаты Copilot. Одна из причин в том, что содержимое этих файлов вставляется в качестве входных данных для каждого взаимодействия. Для каждого. Так что, если ваш файл инструкций имеет 500 строк, это тысячи токенов, добавленных к каждому разговору с C-Pilot. Затем мы добавляем схемы инструментов. Когда вы запускаете агентский режим, у Copilot есть доступные инструменты, и он должен знать о них. Поэтому он собирает метаданные, такие как имена, параметры, описания. Это все дополнительные токены, которые добавляются, даже если они не используются. А затем история вашего разговора. Если вы какое-то время разговаривали с Copilot, все в этой сессии добавляется. Так что каждый вопрос, каждый ответ, все между ними — это все дополнительные токены. Это означает, что если вы задаете вопрос после того, как уже задали три других вопроса в сессии, вы используете больше токенов, чем если бы вы задали тот же вопрос в совершенно новой сессии. И, наконец, содержимое файла. Так что, если вы бросаете 2000-строчный файл в C-Pilot, это все часть токенов, даже если нужно исправить всего две строки. Сложите все это, и запрос, который кажется простым двухстрочным вопросом, может фактически содержать 30-40 тысяч входных токенов, а модель еще даже не сгенерировала ни одного слова в ответ. И это не экстремальный сценарий. Это на самом деле довольно типично для обычного использования Copilot. Так что стоит запомнить из всего этого: ваш запрос — это часто самая маленькая часть вашего входного счета. Пока мы говорим об использовании токенов, я думаю, стоит упомянуть и контекстное окно, потому что оно приносит дополнительные ограничения и возможности. Контекстное окно — это общий объем текста, который модель может удерживать в своей рабочей памяти. Ваши входные данные, история разговора, инструкции — все это. Рабочая память — это упрощенное объяснение, но я хочу, чтобы это видео было разумной длины. Если контекстное окно заполнится, это может вызвать проблемы с вашими ответами. Более старый контент вытесняется, и модель начинает забывать предыдущие части разговора. Это контекстное окно варьируется в зависимости от моделей и имеет фиксированный предел, и оно заполняется быстрее, чем вы можете ожидать. Подумайте о тысячестрочном файле, который сам по себе составляет примерно 12-15 тысяч токенов. Добавьте инструкции, историю, схемы инструментов. В долгой агентской сессии вы можете заполнить это окно довольно быстро. Когда окно почти заполнено, Copilot автоматически сжимает разговор. Это означает, что он просит модель создать сводку разговора и создать новую сессию только с этой сводкой в контекстном окне. Это очень полезная функция, потому что это означает, что качество ответов не ухудшится по мере роста контекста и модель приближается к своему пределу. Недостаток теперь в том, что этот вызов для сжатия и суммирования также будет стоить токенов. Токенов за разговор, за который вы уже заплатили. Это не приведет к банкротству само по себе, это не так уж и страшно, но это то, чем вы можете лучше управлять, если будете сами следить за контекстным окном. Хорошо. Итак, я хочу сосредоточиться на входных данных и на том, что мы можем сделать, чтобы убедиться, что мы не тратим токены впустую. Первое — это держать сессии короткими и сфокусированными. Каждое сообщение в длинной сессии повторно отправляет весь предыдущий контекст в качестве входных данных. Так что стоимость каждого сообщения растет с ростом сессии. У этого есть простое решение. Используйте новое окно чата для каждой задачи. Не переносите контекст, который не имеет отношения к следующему сообщению. Спросите себя, поможет ли контекст разговора следующему сообщению. Если нет, начните новую сессию. Второе — относитесь к своим файлам инструкций как к коду. Так что держите их лаконичными и модульными. Ваш файл copilot instructions.mmd и, если они актуальны, ваши файлы навыков и агентов — они оплачиваются, если они используются во взаимодействии. Ваш, вероятно, в основном написан ИИ, как и должно быть. Вам следует позволить ИИ помочь вам написать эти файлы инструкций, но ИИ имеет тенденцию создавать длинные файлы. Так что загляните в свои файлы инструкций и проверьте, действительно ли нужны строки, которые там есть. Это не черно-белая ситуация, потому что более подробные инструкции могут дать лучшие результаты. Но до сих пор мы относились к этим файлам так, как будто они были бесплатными, потому что они были. Пришло время выяснить, улучшают ли добавление дополнительных примеров ответы, или можно достичь тех же результатов с меньшим количеством строк. И пока вы этим занимаетесь, проверьте, действительно ли инструкции в copilot instructions.mmd нужны для каждой сессии. Есть ли у них конкретные инструкции? Тогда, возможно, агентский файл или навыки — лучший вариант. Третий вариант — ссылайтесь только на то, что вам нужно. Если вам нужна помощь с 20-строчной функцией в 2000-строчном файле, не вставляйте весь файл. Скопируйте только функцию или выберите только функцию. Если модели нужен окружающий контекст, вы можете обобщить его самостоятельно. Скажите: «Эта функция является частью модели аутентификации, которая обрабатывает проверку там». Одно предложение сводки — это 100 токенов. Весь файл может стоить 12 000. Вы можете использовать тот же принцип для вложений. Если вы спрашиваете о файле конфигурации, возможно, вы вставляете только соответствующий блок. Сопоставьте модель с задачей. Это то, в чем мы могли быть ленивы. Но теперь, когда нам приходится платить за эти токены, здесь есть реальная выгода. Выберите правильную модель. Не каждая проблема требует модели Frontier. GPT5 Mini и GPT4.1 включены в планы подписки и гораздо дешевле в использовании, чем Opus, например, и они довольно хорошо объясняют сообщения об ошибках или создают документацию. Так что оставьте Opus 4.7 и GBT 5.5 для задач, которые действительно требуют того, на что они способны. Очень тонкие ошибки, архитектурные компромиссы, сложное рассуждение. Кстати, стоит знать, что обе эти модели в настоящее время доступны только в плане Pro Plus. Вы не сможете использовать их, если у вас есть план Pro. Существуют руководства о том, когда следует использовать ту или иную модель, но я считаю, что также очень помогает просто выяснить это самостоятельно путем проб и ошибок. Для меня также помогло установить Opus в качестве значения по умолчанию вместо Opus. Это намного дешевле, и я был приятно удивлен тем, на что он способен. Если вы не чувствуете себя комфортно, принимая решения, всегда есть возможность использовать автоматический выбор модели. Copilot выберет модель для вас на основе доступности и производительности, и вы получите скидку 10%. Есть загвоздка. Автоматический режим выбирает только из моделей с более низкой стоимостью. Так что он никогда не выберет Opus или GPT 5.5. Это на самом деле хорошо, потому что вы не получите неожиданных расходов, но это также означает, что вам придется самостоятельно выбирать более мощную модель. Теперь вариант пять: используйте режим планирования перед использованием агента. Перед началом долгой агентской сессии всегда следует использовать режим планирования. Эта модель генерирует структурированное разбиение того, что она намерена сделать. Так что вы можете прочитать его, исправить и удалить шаги, которые не служат цели, а затем запустить агента на сфокусированной и хорошо определенной задаче. Агент, который точно знает, что делать, будет совершать меньше вызовов инструментов. Он будет генерировать меньше выходных данных и будет меньше откатываться. Теперь, в качестве дополнительного бонуса, ваши результаты, вероятно, также улучшатся, и у вас есть возможность передать простые задачи в рамках плана более дешевой модели. Итак, это пять изменений в нашем рабочем процессе, которые не так уж велики. У нас была возможность делать это и без них, когда мы чувствовали, что ИИ бесплатен, но мы должны стать более осведомленными об используемых ресурсах. И это не плохо. Это может фактически улучшить ваши результаты, если вы лучше понимаете, что ИИ делает за этим сообщением в чате. Итак, для краткого обзора, сначала хорошие новости: автодополнение кода и автодополнение по-прежнему неограничены для платных планов. Токеновый биллинг означает, что вы платите за входные токены, выходные токены и кэшированные токены при каждом взаимодействии. И это включает все скрытые уровни: системные инструкции, ваши файлы настройки, схемы инструментов и историю разговора. Выбранная модель — самый большой множитель ваших расходов. Так что вам нужно сопоставить ее с задачей, а длинные сессии дороже, потому что история добавляется каждый раз. Так что короткие сессии дешевле. Не забывайте, что ваш файл инструкций оплачивается при каждом повороте. Так что держите его лаконичным и используйте навыки или агентов, чтобы сделать инструкции более сфокусированными. И, конечно же, всегда хорошо планировать перед тем, как использовать агента. Теперь вещи, о которых мы говорили, не являются обходными путями или хаками. Это просто хорошее понимание того, как работает инструмент и как вы можете максимально использовать его. Я надеюсь, что это видео немного помогло вам лучше понять, что происходит с этой новой моделью оплаты и как заставить ее работать на вас. Теперь эта модель оплаты еще даже не введена. Она довольно новая, или, возможно, она уже была введена, когда вы смотрите, но если произойдут большие обновления, я добавлю их в описание. Так что перейдите в описание, чтобы убедиться, что ничего важного не произошло. Я также добавлю ссылки на документацию GitHub, которая всегда должна быть актуальной. Если вы хотите узнать больше, задавайте свои вопросы в комментариях. Спасибо за просмотр, и до встречи в следующем видео.