📱

Get Our Mobile App

Take your business learning on the go!

Download on the App StoreGet it on Google Play

Voice to Agents to Sora 2: Gemini Computer Use + Realtime API + Claude Code

IndyDevDan32:13

Transcription

Ада, создай двух агентов Claude Code. Назови их Sony и Blink. Понял, Дэн. Я создам двух агентов Claude Code по имени Sony и Blink. Оба агента, Sony и Blink, готовы. Дэн, какие задачи нам следует им поставить дальше? Прикажи Sony прочитать все файлы в каталоге AI docs. Используй план/команду для поддержки генерации видео с помощью API Soore. Убедись, что он запишет свой план в каталог specs. Понял, Дэн. Я попрошу Sony прочитать все файлы в каталоге AI docs. Затем спланирую поддержку генерации видео с помощью API Sora и сохраню план в каталоге specs. Sony работает над этим. Дэн, дай мне знать, если ты захочешь поручить что-нибудь Blink дальше. Ада, прикажи Blink инвертировать основные цвета и фронтенд. Мы хотим черный текст на белом фоне. Загрузи шрифт Play из Google Fonts и примени его ко всему тексту. Понял, Дэн. Я поручу Blink инвертировать основные цвета во фронтенде для черного текста на белом фоне, а затем применю шрифт Play из Google Fonts ко всему тексту. Есть ли еще что-нибудь, что ты хочешь запланировать? Техническая индустрия хочет, чтобы ты выбрал одну модель, одного поставщика, один инструмент. Но для тебя и меня, инженера, это проигрышная игра. Почему? Потому что ты оптимизируешь под их бизнес-модель, а не под свои максимальные возможности. Лояльность в эпоху генеративного ИИ — не выигрышная стратегия. Выигрышный ход — использовать их всех. Думай в терминах "и", а не "или". Используй модели Gemini, затем модели OpenAI. Используй облачный код рядом с API OpenAI в реальном времени. Комбинируй, смешивай и сопоставляй. Итак, что если ты пойдешь дальше с этой идеей и объединишь три передовые технологии генеративного ИИ в одного большого супер-агента? Позволь мне показать тебе, как это работает. Это очень экспериментально. В прошлом я создавал такие многоагентные системы. Эта — безусловно, самая мощная. Позволь мне показать тебе точно, как. Ада, перечисли наших текущих агентов. Конечно, Дэн. У нас сейчас два активных агента: Sony и Blink. Хорошо. Можешь проверить статус Blink? Как у него дела с этими обновлениями? Дэн, задача Blink в процессе. Он определил файлы и начинает реализацию инвертирования цветов и применения шрифта Play. Отлично, фантастика. А что насчет Sony? Sony завершил обзор документации по ИИ и архитектуры бэкенда, и теперь он планирует полную интеграцию API Sora. Мы вернемся позже, как только он продвинется дальше. Пара быстрых моментов, которые стоит упомянуть сразу. Верно, у нас есть голосовой агент-оркестратор. После того, как у тебя появятся лучшие агенты, ты добавляешь больше агентов, а затем начинаешь создавать пользовательские агенты. Тебе нужен обертка для фактического взаимодействия и управления всеми твоими агентами. Прямо рядом с нашим голосовым агентом-оркестратором у нас также есть многоагентная наблюдаемость. Верно? Ты можешь видеть, что у нас есть живой пульс всех действий наших агентов. Если мы откроем это, ты увидишь это еще более подробно. Мы используем хуки облачного кода, чтобы получить отличные детали от каждого из наших агентов. И ты можешь видеть здесь, что один из наших агентов сейчас проверяет свою работу с новой моделью использования компьютера Gemini 2.5 внутри нового агента внутри инструмента. Мы разберем это чуть позже. Мы пройдемся по архитектуре. Наш агент фактически проверяет свою работу здесь, верно? Я просто уберу это с экрана, чтобы я мог закончить. Ты можешь видеть, как этот инструмент используется прямо там. Blink фактически проверяет свою работу с помощью браузерного агента. Так что очень мощные вещи прямо с самого начала. Наши агенты мощнее, чем когда-либо. И благодаря многоагентной наблюдаемости. Мы можем фактически видеть, что они делают, не застревая в цикле. Это огромный, огромный тренд, который будет актуален по мере нашего продвижения в эпоху генеративного ИИ. Как агентные инженеры, если вы не можете видеть, что делают ваши агенты в масштабе, вы не сможете масштабировать свои вычисления. И когда вы масштабируете свои вычисления, вы масштабируете свое влияние. Еще одна очень крутая вещь здесь, просто чтобы упомянуть с этим многоагентным интерфейсом наблюдаемости, мы также получаем быстрые, дешевые сводки моделей. Ты можешь видеть эту работу, поступающую на заднем плане. Мы получаем дешевые, быстрые сводки моделей каждой команды, поступающей сюда, верно? Так что нам не нужно копаться во всем. Конечно, мы можем, если хотим. Мы можем видеть весь полезный груз, но на самом деле нам нужен высокий уровень. Знаешь, мы хотим углубиться только в том случае, если что-то пойдет не так. Вот еще один браузерный агент, подтверждающий изменение цвета, верно? У нас есть мощные замкнутые структуры. Наш агент облачного кода имеет инструмент использования компьютера, который он может использовать для полной проверки своей работы. Затем браузерный инструмент вернет любые сообщения об успехе или неудаче. Опять же, я просто уберу это с дороги. И наш агент затем проверит свою работу. Итак, Blink тестирует свою работу, и я думаю, что сейчас Sony завершила свою работу. Итак, давайте посмотрим, как дела у Sony. Давайте просто проверим наш основной интерфейс. И да, посмотрите на это. Агент Sony, сообщение о результате: задача выполнена. И вот разбивка. Итак, я подтвержу это с ADA, агентом-оркестратором. А затем мы продолжим создавать фронтенд и бэкенд для генерации контента. Ада, перечисли наших агентов и проверь статус обоих наших агентов. Хорошо, Дэн. Сначала я перечислю наших агентов, а затем проверю статус Sony и Blink. Дэн, вот обновление. Sony успешно завершил свою задачу. Он сгенерировал полный документ спецификации "Specs Sora video generation integration". Blink завершил изменения кода, инвертировал цвета и применил шрифт Play, и собирается запустить сервер разработки для проверки. Оба агента идут по плану и готовы к любым следующим шагам, которые у тебя есть на уме. Фантастика. Ада, открой этот файл спецификаций, сгенерированный Sony. Конечно, Дэн. Файл спецификаций теперь открыт в VS Code. Дэн, дай мне знать, если ты хочешь просмотреть что-то конкретное или перейти к следующей задаче. Очень крутые вещи здесь, верно? У нас есть наши агенты, которые агентно вызывают конкретные инструменты, которые помогают нам управлять многоагентной системой. Наш агент Sony завершил этот план для генерации видео Sora. Вот, пожалуйста. Ты можешь видеть архитектуру, конечные точки API, тело запроса ответа. Ты можешь видеть здесь, что он получил много ключевой информации. Наши агентные кодеры, конечно, работают на совершенно новом Claude Code 2 с моделью Claude 4.5 sonnet. Очень мощная, очень способная, очень самостоятельная модель. Мы говорили об этом в нашем предыдущем видео. Cloud code — это агентный инструмент кодирования, который сейчас вне конкуренции. Список видео, удалить видео, ремикс. Фантастика. Итак, это все новые функции, выходящие из API OpenAI Sora 2. Вот структура нашего проекта. Отличная разбивка. Ты, возможно, заметил, что когда я давал команду нашему оркестратору записать промпт в нашего агента декодирования Sony, я сказал использовать команду слэш plan. Так что это фактически запустило пользовательскую команду слэш и записало план в структуре, которую мы детализировали. Хорошо, так что пользовательские команды слэш очень мощные. Они возникают снова и снова, потому что они представляют собой повторно используемые вычисления для твоих агентов. Они позволяют тебе настраивать повторно используемые структуры результатов. Это выглядит супер здорово. Я добавлю еще кое-что здесь на протяжении всего этого, знаешь, эксперимента. Я постараюсь не писать никаких промптов. Хорошо, я просто буду разговаривать со своим оркестратором. Я хочу, чтобы мой оркестратор занимался всем, кроме голосовых промптов. Я не хочу ничего набирать, кроме пары ключевых обновлений. Итак, я просто скажу "важные дополнительные заметки". Я хочу убедиться, что цикл самопроверки здесь действительно, действительно плотный для нашего агента. Обязательно настройте структуры логирования. Таким образом, вы можете проверить, возникают ли проблемы. Вы можете опираться на свои выходные файлы. Логирование Python и лучшие практики. Точно. Хорошо. Итак, это здорово. Итак, этот план выглядит фантастически. Я собираюсь закрыть его сейчас. Он был сохранен и обновлен. А теперь я попрошу Sony приступить к его реализации. Ада, дай Sony инструкцию запустить команду build custom/ против точного файла спецификаций, который он сгенерировал. Понял, Дэн. Я попрошу Sony запустить сборку на основе точного файла спецификаций, который он создал. Sony сейчас запускает сборку, Дэн. Хорошо, фантастика. А затем давайте прикажем Blink прочитать этот файл спецификаций и сообщить, когда он закончит чтение. Пока ничего не собираем. Просто попроси его прочитать этот файл. Понял, Дэн. Я поручу Blink прочитать файл спецификаций и сообщить обратно, как только он закончит чтение. Я отправлю эту команду сейчас. Теперь в нашей многоагентной наблюдаемости мы увидим, как эти два агента начнут работу. Blink сейчас читает файл спецификаций, Дэн. Итак, теперь у нас работают два агента, над которыми ведется работа, и мы можем быстро наблюдать за всем, что происходит здесь. Верно? Если мы просто прокрутим вниз, мы увидим, как работают наши агенты. Почему это так ценно? Почему этот эксперимент важен, чтобы обратить на него внимание? Я думаю, если вы поклонник этого канала, вы понимаете, что вычисления — это то, как вы масштабируете свое влияние как инженер. Но мы должны двигаться дальше. Сначала у нас есть лучшие агенты, затем у нас есть больше агентов, затем у нас есть пользовательские агенты, и затем нам нужно проводить их и оркестрировать их наилучшим образом. Агент Blink только что закончил. Итак, давайте прикажем Blink фактически начать создавать фронтенд. Blink прочитал этот, знаешь, 900-строчный план с подробным описанием того, как построить API OpenAI Sora. Мы попросим Sony сосредоточиться на бэкенде, а теперь давайте попросим Blink создать фронтенд для этого. Хорошо, Ада, прикажи Blink реализовать фронтенд на основе файла спецификаций. Мы хотим, чтобы Sony работал над бэкендом, как он это делает, и чтобы Blink работал над фронтендом. Сосредоточься только на фронтенд-компонентах и их подключении к бэкенду. Придерживайся нашей минималистичной темы "черное на белом" и уделяй особое внимание отказоустойчивости и логике повторных попыток для нашего видео API. Это имеет смысл? Понял, Дэн. Я прикажу Blink реализовать фронтенд-компоненты, подключить их к бэкенду, следовать теме "черное на белом" и обеспечить отказоустойчивость и логику повторных попыток. Я приступаю к этому сейчас. Теперь оба наших агента запущены и работают, верно? Итак, у нас Sony на бэкенде здесь. И если мы откроем нашу многоагентную наблюдаемость, мы увидим именно это. Итак, Sony на бэкенде. Вот этот файл логирования Python. И теперь Blink фактически будет реализовывать фронтенд. Хорошо. Итак, два агента работают. Выглядит здорово. Мы можем масштабировать это столько, сколько нам нужно. Как выглядит архитектура этого приложения? Верно. Давайте разберем это. Я выведу что-нибудь на экран, пока буду говорить об этом. Это начинается со слоя ввода. Кто является фактическими движущими силами рабочего процесса? Это инженер. То есть ты или я. И затем, что очень важно, наши агенты. Нам нужно разрабатывать интерфейсы ввода для наших агентов, чтобы они могли замыкать цикл. Хорошо, это большая, большая идея, о которой мы говорим в тактическом агентном кодировании. Вот как вы масштабируете свое влияние. Научите своих агентов исправлять свою собственную работу. Затем мы используем текст или голос, и агент-оркестратор запускает API OpenAI в реальном времени. API OpenAI в реальном времени запускает наш системный слой. Итак, внутри нашей системы API в реальном времени, конечно, имеет несколько инструментов. И если мы прокрутим вверх, ты увидишь некоторые из инструментов, которые есть у нашего агента, верно? Итак, каталог инструментов регистрируется в самом начале каждой сессии. Список агентов, создание агента, команда агенту. Это настоящие тяжеловесы. Мы хотим, чтобы наш уровень оркестрации агентов мог очень быстро взаимодействовать и отдавать команды другим агентам. когда мы отдаем команду агенту, верно? Когда мы передаем промпт от нашего агента-оркестратора нашему фактическому агенту-строителю. Итак, знаешь, в данном случае у нас есть агенты Claude Code. Мы также можем запускать браузерные агенты, которые ты увидишь через мгновение. Как только мы начнем передавать команды, это войдет в мир Claude Code. И поэтому мы сделали несколько видео, знаешь, суб-агенты, пользовательские команды слэш, бесконечные агентные циклы, программный режим, пользовательские агенты, верно? Все это там. Все это, знаешь, может быть действительно сжато в одну команду и одну систему, в которую ты затем можешь добавить дополнительную работу. Хорошо. И круто то, что наш агент облачного кода имеет доступ к новой модели использования компьютера Gemini 2.5. Он будет использовать этого агента для проверки своей работы и получения конкретной обратной связи в замкнутой структуре. У нас есть замкнутые промпты, встроенные в нашу многоагентную систему, встроенные в системный промпт нашего пользовательского агента. И обрати внимание, насколько тонким является этот уровень оркестрации. Он имеет в основном CRUD-операции с агентами. И мы не говорим, какие именно агенты здесь. Есть любые агенты, верно? И они являются любым инструментом и любым типом. У нас будет эта новая модель Opus, или у нас будет эта новая модель Gemini 3. Какой бы инструмент или модель ни появилась следующей, ты хочешь иметь возможность адаптировать свою систему. Затем мы должны ответить и получить фактическую конкретную обратную связь. Хорошо? И это дает нам результат, верно? Итак, у нас есть слой ввода, системный слой и затем выходной слой нашей многоагентной системы. Также стоит упомянуть, что наши агенты облачного кода отправляют запросы в свою систему многоагентной наблюдаемости. Так что все это фантастика. Это очень, очень мощно. Наша система затем, верно, через наши инструменты и наш API OpenAI в реальном времени, выводит аудио, текст, файлы и, по сути, побочные эффекты, верно? Все, что сделали наши агенты, это то, что выходит. И это, конечно, замыкается обратно к нам, верно? Инженеру и нашим агентам. При проектировании этих систем вы действительно хотите думать о входах и выходах и о том, как выходы замыкаются обратно во входы. Очень важно. Это очень важно для того, чтобы сделать системы мощными и легитимными. И поэтому ты можешь видеть здесь, что наш интерфейс только что обновился. Наш фронтенд-агент, Blink, проделал здесь некоторую работу для нас. Это выглядит здорово. Хорошо. И теперь он обновляется. Он вносит некоторые изменения в пользовательский интерфейс, которые мне не нравятся. Мне действительно нравится предыдущий интерфейс. Позволь мне фактически просто увеличить это немного и посмотреть, что только что произошло. Там было два пользовательских интерфейса, которые перекрывали друг друга. Давайте посмотрим, что происходит. Хорошо, я вижу, что Sony фактически вмешивается в работу Blink над фронтендом. Так что нам, вероятно, придется снова приказать Blink вернуться и настроить все. Но это то, что произойдет, верно? Нам нужны четкие границы между нашими агентами, а у наших агентов их нет, верно? Я был недостаточно ясен в своем промпте, и я был недостаточно ясен в плане, чтобы бэкенд-агент просто занимался бэкенд-задачами. Да, ты можешь видеть здесь Sony, работающую над задачами генерации видео. Нам придется работать с дублирующимся кодом. Давайте просто продолжим, и я позволю агентам закончить. Мы посмотрим, как они справятся с этим. Давайте углубимся сюда и посмотрим, где находятся наши агенты. Мы должны были дать нашей системе достаточно времени. Давайте посмотрим, где все находится. Ада, дай мне обновление статуса обоих наших агентов. Оба агента активно работают. Дэн, Sony выполняет свою задачу сборки, а Blink реализует фронтенд-компоненты. Оба в процессе, и мы скоро вернемся за более подробными обновлениями. Я собираюсь попросить Blink вернуться, обновить пользовательский интерфейс, Ада, попросить Blink проверить новые API на бэкенде, а затем восстановить темы, стили и компоненты, которые он изначально написал. Похоже, агент Sony также проделал некоторую работу над фронтендом. Попросите Blink тщательно изучить как фронтенд, так и бэкенд, прежде чем вносить свои обновления. Мы хотим убедиться, что мы вернем эти стили. Сделай все это, пока мы подключаемся к существующему работающему API. Понял, Дэн. Итак, теперь Blink будет запущен, и, надеюсь, он снова сгенерирует тот отличный пользовательский интерфейс, который у нас был в начале. Итак, теперь у нас запущены Sony и Blink, верно? Давайте откроем это и будем отслеживать наших агентов, пока они работают над этой задачей. Итак, мне интересно, что сейчас делает Sony. Я думаю, он просто тестирует. У нас есть несколько видео, у нас есть сбои генерации, загрузка, но пока нет воспроизведения. Итак, вот оно. Так что это выглядит здорово. Итак, Blink обновил наш фронтенд обратно к этому чистому стилю. Это выглядит потрясающе. Рад слышать, что это выглядит здорово. Дэн, дай мне знать, если тебе нужны какие-либо дальнейшие корректировки или если ты хочешь перейти к следующей задаче. Хорошо, у нас есть эти потрясающие быстрые шаблоны, которые мы можем использовать. Итак, у нас есть наш агент Claw Code, тестирующий свой рабочий процесс. Генератор видео выглядит хорошо. Вот оно. Итак, мы только что увидели прокрутку и снимок экрана. Это просто прокрутка вверх. Я был очень впечатлен моделью использования компьютера Gemini 2.5. Отлично. Он переключился в режим библиотеки. Есть пара видео. Похоже, это старые видео, которые я уже генерировал при запуске некоторых тестов. Отлично. Это выглядит здорово. Итак, я задаюсь вопросом, что именно он тестирует здесь. Я думаю, он просто проводит тесты пользовательского интерфейса. Но вот оно. Просто переключись. Я ничего из этого не делаю, верно? Кстати, мои руки здесь. И да, каждый раз, когда экран мерцает так, он фактически делает снимок экрана. Благодаря нашей многоагентной наблюдаемости мы можем точно видеть, какие инструменты запускаются. Прямо сейчас работает только Blink. Так что пока все идет хорошо. Похоже, что поскольку он запустил два браузера, он, вероятно, ищет новое соединение. Итак, я просто закрою это и посмотрим, что он сделает. Он может просто запустить еще один. И ты можешь видеть из нашего ручного тестирования, у нас есть проблема. Итак, если мы нажмем "открыть это", давайте обновим этот кинематографический кошачий фильм, а затем нажмем "сгенерировать". Давайте посмотрим, что мы получим здесь с некоторым ручным тестированием. Хорошо. Хорошо. Итак, мы попадаем в приятный интерфейс. Давайте посмотрим, работает ли наша логика очереди. И наши агенты, возможно, отметили это как завершенное. Давайте посмотрим, что происходит. Да. Итак, вот ответ нашего браузерного агента Gemini. Отличная генерация видео. Похоже, это работает. Это здорово. И вот сообщение о ответе Blink. Что было сделано? И поэтому подтверждено, что все это операционные ядра для 3334. Это на самом деле неправильно. Должно быть 333. Хорошо. Бэкенд и фронтенд работают на этом дополнительном порту. Это не совсем правильно, но ладно. Итак, подтверждены все конечные точки. Это выглядит хорошо. Отлично. Тестирование валидно. Все компоненты работают. Наш фронтенд выглядит хорошо. Давайте посмотрим, как работает эта генерация. Мы хотим увидеть, как это завершится. Но тем временем я попрошу полномасштабный браузерный агент просто запуститься и выполнить промпт для нас. Ада, создай агент использования браузера. Попроси этого агента протестировать наш локальный хост на порту 3333. Попроси его написать промпт для изображения и сгенерировать его. Убедись, что он подождет некоторое время. Генерация займет некоторое время, но я хочу проверить, работает ли это. Обнови модель до Sora 2 Pro. Продолжительность 8 секунд. И давайте использовать портретный режим. Дай инструкцию всему этому агенту использования браузера после того, как ты его создашь. Понял, Дэн. Я создам агент использования браузера и дам ему инструкцию протестировать твой локальный хост на порту 3333. Сгенерировать промпт для изображения и обновить до Sora 2 Pro. Продолжительность 8 секунд. Портретный режим. Я позабочусь о том, чтобы он подождал генерации. Хорошо. Итак, это работает. Итак, ты можешь видеть, что с нашим ручным тестом мы получили изображение кошки, сгенерированное там. Это выглядит здорово. Наш агент использования браузера сам пишет этот промпт. И вот оно. Он прокручивается. Теперь он, вероятно, нажмет "сгенерировать видео". Возможно, он обновит некоторые настройки. Хорошо. Итак, он просто нажмет "сгенерировать видео". Давайте посмотрим, что мы получим. И теперь он запустит это. Итак, пока он делает снимки экрана, он должен просто, знаешь, работать и, надеюсь, подождать полного цикла. Но тем временем, пока это работает, посмотри на это. У нас есть полная генерация. Кошка на мраморном столе, я думаю. Да, почти все, что ты ожидаешь, верно? Мы можем скачать миниатюру. Давайте посмотрим, как это работает. Фантастика. Вот миниатюра. Мы можем ремикшировать. Мы можем скачать спрайт-лист. Это интересно. Давайте посмотрим, как это выглядит. Хорошо, так что здорово. Итак, просто пара изображений во время воспроизведения и создание ремикса. Интересно, насколько это работает. Хорошо, давайте просто попробуем. Ты можешь видеть нашу генерацию видео, поступающую сюда для нашего тестового агента. Давайте посмотрим, будет ли это видео полностью отрисовано. Похоже, у нас могут быть некоторые проблемы с браузерным использованием, фактически отображающим фактические видео. Хорошо, так что это не сработало. Так что мы просто позволим этому продолжать вращаться. Итак, давайте ремикшируем это видео. Кошка, обнови кошку, чтобы она вращалась. Давайте посмотрим, как это работает. Хорошо, так что я не уверен, что произошло. Похоже, наша генерация взорвалась. Она фактически завершила наш весь агент голосовой оркестрации, но мы можем просто запустить ее снова и перечислить всех агентов. Дэн, у нас три активных агента: Blink и Sony для задач кодирования и браузерный агент под названием browser agent 17722. Дай мне знать, что ты хочешь делать дальше. Хорошо, так что мы получили сквозную генерацию кошки. Это сработало отлично. Я хотел бы увидеть, как работает наша функция ремикса, но давайте посмотрим это видео. Хорошо, так что здорово. Итак, это видео, сгенерированное нашим агентом использования браузера. Давайте просто посмотрим. Хорошо, отличная часть системы в том, что даже с таким сбоем мы можем быстро перезапустить, и у нас есть наши последние файлы, где агенты регистрируют свою работу, и мы можем просто перечислить всех наших агентов и заставить нашего основного агента снова запуститься и вернуться к работе. Итак, я не буду слишком углубляться в это. Я хотел показать, знаешь, как выглядит многоагентная система, когда ты начинаешь объединять эти различные системы. У нас есть использование компьютера Gemini 2.5, тестирование возможностей, тестирование функциональности. У нас есть приятная многоагентная система, где мы можем работать с несколькими агентами и фактически видеть результаты. Мы используем мощные агенты Claude Code, а затем у нас есть наше фактическое приложение, которое создается нашими агентами, верно? Мы можем сделать это сейчас. Мы можем позволить им продолжать развертывание против этого, чтобы тестировать и проверять свою работу. Позволь мне просто быстро скачать приложение. Ты помнишь, что в нескольких частях я явно просил наших агентов Claude Code выполнять конкретные команды. Они напрямую ссылаются на некоторые из этих мощных агентных рабочих процессов, которые уже были созданы. Верно? Мы запустили plan и мы запустили build. Они смогли напрямую использовать эти команды, получая промпты от другого агента. Верно? Это очень упрощает расширение их возможностей и использование более краткого, лаконичного естественного языка для направления того, что они могут делать. Мы можем просто быстро зайти сюда и проверить некоторую работу, которую они проделали в кодовой базе. Наши агенты управляли этой кодовой базой для нас от начала до конца. Итак, если мы зайдем в файл specs, мы можем увидеть наш план генерации видео Sora. Верно? Это был первоначальный план, который мы рассматривали, который фактически выполнил всю работу, которая была построена. Верно? Теперь, я должен был улучшить свой промпт, сказав, знаешь, Sony, ты работаешь только над бэкендом, верно? Мы получили отличный фронтенд, сгенерированный от начала до конца, верно? У нас есть компоненты, у нас есть наши композируемые элементы, и наш агент Blink позаботился об этом для нас. И внутри нашего бэкенда, если мы откроем source, похоже, у нас есть несколько дополнительных файлов, которые были сгенерированы, но ты можешь видеть, что у нас есть наш основной интерфейс там. Вот наши основные проверки работоспособности. И затем, конечно, внутри routers videos, у нас есть эта отличная архитектура, как и планировалось. И поэтому мы могли бы настроить любую из этих вещей внутри нашего плана. Классические конечные точки бэкенда Fast API, загрузка контента и так далее, верно? Все это вместе, построило наш генератор видео Sora. Это действительно генератор контента. Благодаря нашим агентам мы можем просто генерировать эти видео, верно? Давайте сделаем кинематографическую сцену, широкий план сноубордиста на огромной горе. Медленное панорамирование. Давайте используем 2 pro. Я хочу 8 секунд. Давайте попробуем портретный вид. Давайте сгенерируем это. Благодаря нашей многоагентной системе оркестрации, они построили это от начала до конца для нас. Итак, у нас есть этот приличный экран загрузки. Конечно, все можно улучшить, верно? Мы можем вмешаться в цикл после того, как наши агенты завершат работу. Что это, это еще один пример оркестрации нескольких агентов, наблюдения за нашими агентами и управления нашими агентами с помощью высокоуровневого интерфейса. В данном случае мы используем голосовой интерфейс для выполнения работы. Это идеи, которые вы можете объединять, верно? Я знаю, кто-то в комментариях скажет, что ты можешь сделать это намного быстрее, если просто наберешь yada yada yada. Есть куча, знаешь, условий для голосовых рабочих процессов, но я строю эти многоагентные системы уже много лет. Каждый раз, когда я сажусь экспериментировать с тем, что можно сделать с последними инструментами, то, что можно сделать, значительно продвинулось. Теперь, возьмите из этого все, что хотите, но ключевые идеи здесь довольно просты. Голосовое агентное кодирование уже не за горами. Если вы на передовой, вы можете начать создавать их прямо сейчас, чтобы управлять своими парками агентов. Теперь, даже без голоса, верно, полностью отбросьте голос, верно? Вы можете использовать текстовые рабочие процессы, и мы можем запустить это прямо сейчас, верно? Если мы закроем это и используем этот рабочий процесс, и вместо этого я скажу "промпт, перечисли всех агентов, проверь их статус", у меня есть этот интерфейс для моего агента, чтобы просто запустить нашего агента-оркестратора и быстро выполнить работу. Итак, ты можешь видеть, что мы быстро пробиваемся через всю эту работу. Все это происходит очень быстро, очень стремительно. Нет голосового ответа. Все это текст. Хорошо. Какую бы систему вы ни хотели построить, убедитесь, что у вас есть текст, убедитесь, что у вас есть голос. Вы хотите расширить входы, которые могут быть у вашей системы, чтобы вы могли удовлетворить цикл обратной связи всей вашей многоагентной оркестрированной системы, верно? Вы хотите строить для себя, своей команды и своих агентов одновременно. Убедитесь, что выходы вашей системы замыкаются обратно во входы. Убедитесь, что ваши агенты могут получать обратную связь от вашей системы. Хорошо, у нас есть рабочий процесс на основе промптов. Верно, позволь мне просто очистить это снова и показать тебе. Верно, если мы нажмем вверх, ты увидишь, что у меня есть полный рабочий процесс для этого инструмента, который может быть активирован просто передачей промпта. Почему это так? Это потому, что я могу предоставить его нашему агенту, чтобы агент мог протестировать все для нас. И последнее, но не менее важное: у нас была наша система многоагентной наблюдаемости, чтобы помочь нам фактически отслеживать всех наших агентов, специфичных для Claude Code. Ты действительно можешь подключить любого агента, которого хочешь. Прямо сейчас это поддерживает только Claude Code. Я оставлю кодовую базу многоагентной наблюдаемости по ссылке в описании. Она основана прямо на хуках Claude Code. Мы говорили об этом на канале раньше. Это будет доступно там для тебя. И если ты хочешь продвинуть свои способности в области агентного кодирования еще дальше, если ты хочешь постоянно переходить от внутреннего цикла к внешнему, у меня есть последнее предложение для тебя. Многие инженеры уже знают, что это такое, если ты смотришь канал. Я хочу предложить тебе тактическое агентное кодирование, пока не закончится предложение для ранних пташек в среду. Тактическое агентное кодирование — это мой взгляд на то, как ты можешь выйти далеко за рамки AI-кодирования и вайб-кодирования с продвинутым агентным инжинирингом, настолько мощным, что твоя кодовая база работает сама по себе. Теперь идеи здесь, о которых мы говорили на канале снова и снова. Мы берем эти идеи и продвигаем их еще дальше. Теперь позволь мне быть предельно ясным. Это для инженеров, которые отправляют в продакшн. Это для инженеров, которые ищут большое преимущество в эпоху генеративного ИИ с агентами. Хорошо, мы знаем, что AI-кодирования недостаточно, и здесь есть куча больших идей, но самая важная — это то, что ты, инженер, являешься узким местом. Это не инструменты, не модели, не агенты, верно? Как ты можешь видеть здесь в нашем многоагентном примере, верно? Речь идет о том, что мы можем сделать. Как мы можем оркестрировать все эти мощные инструменты, верно? И посмотри на это. У нас есть наш, у нас есть наш, позволь мне просто перейти в полноэкранный режим. Вернуться. Хорошо. И поэтому мы можем скачать миниатюру, конечно. Мы можем скачать таблицу спрайтов. Мы можем работать с этим. Это будет начало моей платформы генерации контента. Убедись, что ты поставил лайк и подписался, если тебе интересно увидеть, куда это приведет. Конечно, мы будем строить все это с помощью агентов, и это будет отличный способ для нас изучить различные многоагентные архитектуры. В любом случае, вернемся к тактическому агентному кодированию, верно? Совершенно ясно, что модели отличные. Инструменты фантастические. Агенты есть. Дело в тебе, верно? Дело в тебе и мне. Мы — узкое место. Теперь давайте продвинем наши вычисления дальше. Хорошо. Итак, руководящий вопрос здесь: что, если бы твоя кодовая база могла сама себя отправлять? Очевидно, здесь я задаю вопрос. Так что у меня есть какой-то ответ для тебя внутри тактического агентного кодирования. Отказ от ответственности: это не для новичков. Если ты новичок, если ты вайб-кодер, это не для тебя. Это будет выше твоего понимания. Идеи здесь довольно продвинутые. У нас есть большая цель внутри этого курса. Моя миссия — превратить тебя в инженера, которого нельзя заменить. Как мы это делаем? Мы отказываемся от старых способов инжиниринга, чтобы освоить новый лучший инструмент для работы. Это, конечно, агенты. Хорошо. Большая идея, которую мы исследуем снова и снова, заключается в том, что мы строим систему, которая строит систему. Ты хочешь все больше и больше работать над агентной системой, которая затем строит систему. Теперь, я только что показал тебе еще один пример этого в этом эксперименте, верно? Я построил уровень оркестрации агентов, а затем я дал промпт этому уровню, чтобы построить приложение. Хорошо, я снова построил агентную систему на канале публично, верно? Это могло пойти не так миллион раз, и это пару раз пошло не так, верно? Это спектр, ребята, верно? Мы постоянно совершенствуемся. Думай в сером. Нет, никто не знает ответов сейчас. Но люди, которые экспериментируют и продвигают вещи вперед, у них больше ответов, чем у других. Хорошо? Ты видел это здесь, верно? Мы построили систему: агенты Claude Code, агенты использования браузера с Gemini 2.5, API OpenAI в реальном времени. Мы объединяем мощные уровни вычислений, чтобы затем построить систему для нас. Хорошо? Ты увидишь это снова и снова. Запусти это. Ты можешь освоить эту архитектуру прямо сейчас в тактическом агентном кодировании. И ты можешь научиться строить ее внутри каждой кодовой базы, которую ты строишь. Хорошо, так что у нас есть пара больших идей здесь. Мы масштабируем ядро 4. И просто чтобы упомянуть, есть два курса внутри тактического агентного кодирования. Первый — это основные 8 уроков. Если ты хочешь только ядро больших идей, просто возьми этот. После покупки тактического агентного кодирования ты можешь перейти в Agentic Horizon и получить дополнительные уроки, и ты можешь голосовать за следующие три урока. Хорошо, так что все уроки здесь. Все детали здесь. Ссылка будет в описании для тебя. Конечно, мы вернулись для фазы два. Большое спасибо за все добрые слова от каждого инженера. Мне нужно добавить кучу отзывов. Вы ребята действительно бомбите отзывами. У нас сейчас более 500 инженеров повышают свою квалификацию. И просто чтобы упомянуть, сделка, специальное предложение для ранних пташек почти закончилось. Так что заходите сюда, пока это не закончится. Хорошо? К тому времени, когда ты это увидишь, это будет как 3, 2 или 1 день осталось. Эта сделка заканчивается в среду вечером. Так что заходите сюда. Я вознаграждаю инженеров, которые видят возможности и инвестируют в себя. Это все. Это не маркетинговый трюк. Это просто здесь, чтобы инженеры, которые инвестируют в себя и хотят получить хорошую сделку, действовали. Это полностью без риска. Это не случается часто на моем канале, к счастью, но время от времени, знаешь, я получаю случайные комментарии от нескольких комментаторов, которые думают, что я какой-то интернет-мошенник или фальшивый гуру. Ни одна из этих вещей не существует без серьезного инжиниринга снова и снова, тестирования моих идей. Почему я все это говорю? Я говорю это потому, что я думаю с инженерной точки зрения. У тебя есть полная гарантия возврата денег до начала урока 4 в течение 30 дней. Ты получишь свои деньги обратно. Я не хочу, чтобы ты был здесь, если ты не хочешь быть здесь. В этом нет никакой ценности ни для меня, ни для тебя. Так что, если ты дойдешь до третьего урока и тебе не понравится мой стиль или ты не увидишь видение, ты получишь полный возврат денег гарантированно. Без вопросов. Без проблем, без обид. Это тактическое агентное кодирование. Ознакомься с FAQ. Ознакомься с видео на целевой странице, чтобы понять, о чем это. Еще раз, это для инженеров, которые отправляют в продакшн. Если ты новичок, если ты только начинаешь свой путь, это не для тебя. Хорошо? Создание чего-то для всех означает создание ничего для кого-либо. Если ты создавал продукты, ты это знаешь. Итак, многоагентные системы здесь. Ты хочешь думать в терминах "и", а не "или". Объединяй эти инструменты, чтобы делать больше, чем ты когда-либо мог раньше. Итак, как многие зрители канала знают, Claude Code — мой основной инструмент для агентного кодирования, но я постоянно тестирую его против Gemini, против Codeex, против всех этих других инструментов. И самое главное, я их комбинирую. Название игры в инжиниринге сейчас заключается в том, что инженеры с более высокой производительностью почти напрямую используют больше вычислений. Я говорил это на канале раньше, повторю еще раз. Существует прямая причинно-следственная связь между использованием твоих вычислений и твоей инженерной производительностью. Масштабируй свои вычисления, чтобы масштабировать свое влияние. Это может показаться очень подавляющим прямо сейчас из-за безумного темпа инноваций, исходящих из всех этих лабораторий. Что это значит для нас, инженеров? Для меня я вижу только возможности. Вот почему каждый понедельник я сажусь, чтобы попытаться показать тебе, что возможно, показать тебе будущие потенциалы, дать тебе конкретный взгляд на идеи, которые я исследую, чтобы продвинуть свой инжиниринг дальше, чтобы ты мог принять их для себя, чтобы ты мог взять их, настроить и получить некоторое преимущество. Все дело в твоем информационном преимуществе. Слишком много хлама там. Хорошо? Слишком много хлама там. Будет слишком много шума, верно? Сосредоточься на сигнале. Сосредоточься на каналах, подобных этому, которые действительно пытаются, экспериментируют, продвигают, комбинируют. И всегда помни, что если все рухнет, одна большая идея, на которую ты можешь положиться, заключается в том, чтобы масштабировать свое влияние, ты должен масштабировать свои вычисления. Это название игры. Вот почему агенты набирают обороты прямо сейчас. Это то, что имеет значение больше всего. Используй больше агентов, используй больше вычислений, создай свою многоагентную систему. И что бы ты ни делал здесь, оставайся сосредоточенным и продолжай строить.