Transcription
С возвращением, инженеры. С вами Indydev Dan. У нас есть новая антигравитационная IDE следующего поколения Gemini 3 Pro, а также Nano Banana Pro, не говоря уже о GPT 5.1 Codeex Max Premium XL от OpenAI. Ладно, нам действительно нужно улучшить наши названия. Давайте настроимся на сигнал. Что здесь на самом деле важно? Что на самом деле говорят эти релизы? Итак, если спросить меня, только два из трех этих релизов имеют значение. Gemini 3 — новая лучшая модель. Clawed Code, работающий на 4.5 Sonnet, был свергнут. Там есть некоторая нюансировка. Там есть некоторая деталь, но, как вы можете видеть, э, бенчмарки говорят сами за себя. Gemini 3 Pro стирает всех с доски. Google anti-gravity — это форк VS Code, который больше похож на копирование курсора, которое на самом деле является каскадом. Хорошо, для меня здесь очень слабый сигнал. Если вам нужен отличный готовый к использованию, строго ориентированный инструмент редактирования, просто откройте Cursor, используйте его. Мне очень любопытно увидеть, когда эти крупные компании поймут, что они не могут победить стартап, который делает только одну вещь. Cursor работает только на Cursor, в то время как у Google 500 000 продуктов. Так они их не победят. Слабый сигнал здесь от anti-gravity. А затем у нас есть лучший инструмент для редактирования изображений, лучший инструмент для генерации изображений, Nano Banana Pro. Это сильный сигнал. Это высокая возможность. Эта модель абсолютно безумна. Но настоящая главная новость здесь, конечно же, Gemini 3 Pro. Каждый раз, когда выходит такой релиз, я задаю себе один вопрос. Что мы, инженеры, можем сделать, чего не могли сделать раньше? Существует новая возможность, которую большинство инженеров сейчас упускают, и которой я хочу с вами поделиться. Я одержим этой возможностью в последнее время. Вы можете дать своим агентам их собственные компьютеры. Здесь у нас Gemini CLI, работающий с совершенно новой предварительной моделью Gemini 3 Pro. Мы можем запустить этот промпт, обратный слэш, песочница. Итак, мы ищем пеликана. Это вариация на тему "Пеликан на велосипеде" Саймона Уиллиса. Я вырос, катаясь на скейтборде. Я хочу увидеть, как этот пеликан катается на скейтборде. А затем я хочу увидеть размещенные результаты. Мы даем Gemini 3 его собственный компьютер. Нажмем Enter. Command Tab. И давайте запустим еще один экземпляр Gemini CLI, работающий, конечно же, с передовой моделью Gemini 3 Pro. Обратный слэш, песочница, генерация, хостинг, результаты. Еще одна песочница. Нам нужен SVG из трех карт покемонов. Банановая тема, показывающая их эволюцию. Хостинг результатов. Бац. Давайте запустим. Круто. Но вам не надоели эти демонстрации, где кто-то просто создает простой, знаете ли, одноразовый пользовательский интерфейс. Давайте продвинем эти модели дальше. Эти передовые модели могут сделать гораздо больше, чем вы думаете. Я могу гарантировать вам, что вы не используете достаточно вычислительных ресурсов. Я не использую достаточно вычислительных ресурсов. Итак, давайте исправим это. Снова новый терминал, G3PY. Давайте запустим агентный рабочий процесс. Обратный слэш, агент, и я объясню этот обратный слэш через секунду. Песочницы: план, сборка, хостинг, тестирование. А затем я вставлю сюда промпт. Это будет конкатенация определенного промпта. Вы можете видеть, что мы собираемся создать простой интерфейс SQLite crud. А затем у нас есть имя для этого рабочего процесса, чтобы мы могли идентифицировать, что он запущен. Теперь Gemini 3 Pro запускает не один, не два, а три экземпляра своего собственного компьютера. Вы можете увидеть идентификатор песочницы прямо там. Это создаст полнофункциональное приложение. Инженерная работа — это гораздо больше, как вы знаете. Давайте продолжим. Бац. G3PY. Давайте масштабируем наши вычисления, чтобы масштабировать наше влияние. Обратный слэш, агент, песочницы. На этот раз нам нужен интерфейс Nano Banana. Он создаст для нас пользовательский интерфейс для работы с новой моделью Nano Banano Pro. Хорошо, мы запускаем это. Теперь у нас четыре отдельных агента Gemini, работающих на своих собственных компьютерах. Угадайте, что мы будем делать дальше? У нас есть вычислительные мощности по запросу, когда мы используем передовые модели, работающие на их собственных устройствах. G3PY. Я хочу показать вам, сколько вычислительных ресурсов вы действительно можете использовать здесь. Хорошо, мы вставим еще один промпт. Обратный слэш, агент, песочница, план, сборка, хостинг, тестирование. Здесь нам нужно приложение для заметок. Опять же, полнофункциональное. Это не пользовательский интерфейс. Это полнофункциональное приложение. Нажмите Enter. У нас 5 экземпляров Gemini, работающих в песочницах. Вы можете видеть здесь, у нас уже есть один результат. Но прежде чем мы коснемся этого, я хочу немного повысить ставки. Я хочу добавить сюда немного конкуренции и, конечно же, запустить Claude Code, работающий на Sonic 4.5, и новый Codeex, работающий на GBT 5.1 Codeex Max High. Что я собираюсь сделать здесь? Я собираюсь сделать то же самое с агентными песочницами. Когда вы даете своим агентам их собственные выделенные устройства, вы можете делать абсурдные вещи в масштабе. Те же самые промпты. Итак, SVG Pelican запущен. SVG из трех карт покемонов запущен. Визуализатор SQL запущен. UI Nano Banana запущен. И наше простое приложение для заметок запущено. Мы собираемся сделать то же самое внутри Codeex. Итак, у нас запущено 15 агентных песочниц, выполняющих работу в своей собственной среде. В этом видео я хочу показать вам, как вы можете перепрограммировать любого агента для использования агентных навыков. Я хочу показать вам, как вы можете масштабировать свое влияние, давая своим агентам их собственные устройства. А затем нам нужно углубиться в суть всего этого. Насколько важна производительность модели на самом деле? Насколько Gemini 3 Pro лучше остальных? И действительно ли это имеет значение? Итак, прежде всего, если мы откроем наш интерфейс агентных песочниц, вы увидите здесь множество, множество, множество агентных песочниц. Похоже, у нас запущено 12 песочниц. Но это невероятная часть агентных песочниц. Вы можете просто масштабироваться. Вы можете просто бросить больше вычислительных ресурсов на свои проблемы. E2B — это сервис, который я использую для хостинга и запуска моих агентных песочниц, моих компьютеров для моих агентов. Эти песочницы обеспечивают большую автономию для ваших агентов и меньше управления для вас. Запустите кучу вычислительных ресурсов против проблемы, а затем выберите лучший результат. Это лучшее из N. Пока эти работают, делая работу для нас, давайте разберемся со слоном в комнате. Claude Code, работающий на Sonnet 4.5, лучший агент и модель, наконец-то имеет конкуренцию. Если мы откроем искусственный анализ из этого стороннего анализа, никогда не доверяйте бенчмаркам, которые вы видите на главной странице. Все они выглядят отлично. Мы можем посмотреть на них, но вы всегда хотите сторонний обзор. Если мы посмотрим на это и просто найдем, знаете ли, Gemini 3 Pro, результаты уже есть. Это очень, очень явно лучшая модель. Позвольте мне просто найти Gemini 3, чтобы мы могли увидеть это на индивидуальных бенчмарках. Почти каждый бенчмарк показывает Gemini 3 на вершине. Я использую эту модель с момента ее выпуска. Сравнивая ее с Cloud Code и Sonic, совершенно ясно, что это абсолютно безумная модель. Google усердно поработал, и из всех способов, которыми они разбросаны как большая компания со многими, многими целями, совершенно ясно, что они серьезно относятся к созданию лучшей модели, лучших вычислительных ресурсов, лучших чипов, верно? вплоть до TPU. Теперь, настоящий вопрос, который я всегда люблю задавать, это что мы можем сделать, чего не могли сделать раньше? Я думаю, есть совершенно новая возможность: вы можете заставить своих агентов запускать свои собственные компьютеры. Наши результаты начнут поступать сюда. Давайте подождем еще немного. Есть что-то под всеми этими релизами моделей, что, я думаю, действительно важно обсудить и действительно поговорить, и это вопрос о том, насколько это на самом деле важно anymore? Я думаю, есть несколько бенчмарков, которые имеют гораздо большее значение, чем другие. Вы хотите продолжать видеть, как увеличивается продолжительность работы инструментария терминала, длительные периоды агентной работы. Вы хотите, чтобы эта продолжительность постоянно увеличивалась. Я думаю, это сильный сигнал, верно? Любой агентный бенчмарк, связанный с кодированием. Это действительно отличные вещи. Он работает дольше. Он выполняет работу. Он фактически выполняет инженерную работу для вас. Опять же, как вы увидите, верно, это не просто фронтенд-приложения. Мы не говорим, что нужно построить Pong. Они будут создавать полнофункциональные приложения, фронтенд, бэкенд, базу данных. Я хочу высказать кое-что и услышать ваше мнение по этому поводу. Я не думаю, что интеллект модели больше дает нам столько новых возможностей. Хорошо, я думаю, что на самом деле важно — это полный опыт, агентный опыт. Хорошо, мы отходим от того, что LLM — это то, что имеет значение, к тому, что агенты — это то, что имеет значение, и к экосистеме агентов, которую вы строите. И теперь по этой причине вся оценка производительности полезна лишь в некоторой степени. Что имеет наибольшее значение, так это то, как эти модели, а теперь конкретно, как эти агенты работают против вашего конкретного варианта использования? Это единственный бенчмарк, который действительно имеет значение. Мы приближаемся к тому моменту, когда на самом деле не имеет значения, что эти большие лаборатории публикуют в своем блоге, потому что на самом деле имеет значение ваш бенчмарк, а затем то, как они работают внутри агента. Так что, хотя все это хорошо, все это коррелирует с лучшей производительностью. Есть так много вещей, которые все эти модели могут делать. Теперь ограничением больше не является языковая модель. Ограничением является агент. Ограничение заключается в том, какие агентные системы вы и я можем или не можем построить. И это в нас, действительно продвигающих эти модели против наших конкретных вариантов использования. Итак, имеют ли модели значение anymore? Каждый релиз, они имеют меньшее значение. Кстати, чтобы просто уделить минутку, я хочу сказать огромное спасибо всем, кто следит за каналом. Мы только что пересекли отметку в 100 000 подписчиков. как канал глубоких технологий, где мы действительно углубляемся в инженерные варианты использования, инженерные принципы и агентную инженерию. Мы никогда не должны были стать такими большими. Я создал этот канал, чтобы он стал любимым каналом инженеров для инженеров. Хорошо, так что по дизайну он должен был быть таким сфокусированным, таким инженерным и действительно опережающим в том, что мы можем делать. Трудно попадать в эту точку каждую неделю, знаете ли, создавать видео каждую неделю. В этом так много подготовки, о которой никто не хочет слышать. Но просто невероятно быть на этом этапе, и я просто хочу поблагодарить всех, кто был частью этого путешествия до сих пор. Цель этого канала — создавать живое программное обеспечение, которое работает для нас, пока мы спим, и мы приближаемся. Я просто хочу отметить всех, кто был с нами в этом путешествии. Если вы новичок, добро пожаловать и пристегнитесь. 2026 год будет безумным для нас, инженеров. Есть много страха, но есть и невероятные возможности, верно? Когда все убегают, когда все выключаются, когда происходит потеря работы, вот когда нужно включиться и выяснить, что дальше. И именно на этом мы фокусируемся каждый понедельник здесь, на канале. Хорошо, у меня есть большие идеи, которыми я хочу поделиться с вами. У меня есть огромные прототипы, над которыми агенты активно работают прямо сейчас, и я не могу дождаться, чтобы поделиться ими с вами в 2026 году. Пара вещей, которые стоит упомянуть до конца года. У меня есть пара больших идей, которыми я хочу поделиться с вами. У нас будет наше большое видео с прогнозами на конец года, где мы оглянемся на все сделанные ставки, посмотрим, сколько из них мы угадали, а затем я сделаю свои ставки и прогнозы на 2026 год. Я также выпущу два заключительных урока для Aentic Horizon до 2026 года. Так что следите за этим. Этот канал всегда будет сосредоточен на сигнале, поиске лучшего инструмента для инженерной работы. Огромное спасибо каждому инженеру, который смотрит нас неделю за неделей. 100K — это безумное число. Давайте вернемся, чтобы посмотреть, как поживают наши агенты. Итак, помните наш первоначальный промпт здесь, обратный слэш, песочница. Это не правильный синтаксис, верно? Это команда обратного слэша, а не команда слэша. Так что же я сделал здесь? Я перепрограммировал этого агента и действительно каждого агента, чтобы использовать навыки агента clog, использовать общий навык, к которому теперь может получить доступ любой агент. Давайте сначала посмотрим на результат. Итак, я скопирую это. Давайте откроем это. Хорошо. И вот наш пеликан, который катается. Итак, это Gemini Pro Pelican Shredding. Выглядит отлично. Давайте также откроем наши карты покемонов. Верно. Нам нужны были SVG карт покемонов. Так давайте посмотрим, что мы получим. Хорошо. Итак, фантастика. У нас есть Бананит. У нас есть банановое кольцо, и у нас есть король банановых рыцарей. Имейте в виду, что это SVG. Так что это не простая задача, верно? Наш агент Gemini 3 Pro создал SVG карт покемонов. Довольно впечатляет. И снова я просто хочу подчеркнуть этот момент. Все это работало на его собственном компьютере. Ничто из этого не коснулось моего компьютера. Вы видите там несколько экземпляров, 15 запущенных песочниц, как и было запрошено. Так что это выглядит отлично, верно? Это работает прямо из песочницы. Так что здорово в агентных песочницах то, что вы можете просто развернуть вычислительные ресурсы против проблемы, а затем, когда захотите, вы можете выбрать лучший результат. Так что мы можем просто сделать что-то вроде этого. Скопировать это приложение в temp G3 banana Pokémon, что-то вроде этого, верно? И я думаю, что это будет всего один файл или один файл с некоторыми SVG. У нас теперь есть временное место, где этот файл размещен, и теперь мы можем делать с ним все, что захотим. Верно? Так что наш агент, работающий в песочнице, также может просто копировать все файлы локально, когда мы хотим их, если мы хотим их. Вот наш пеликан на скейтборде из нашего Codeex, есть некоторые проблемы, но хорошая попытка. И вот наша версия снова из Codeex с нашей картой покемонов. Довольно хорошо. Вы можете видеть здесь, что Gemini определенно создал более связные SVG. Но давайте посмотрим на версию карты покемонов от Clog Code. У нас есть Бананито, у нас есть Банановый Жевательный, и Банановый Зар. Но это все простые проблемы, верно? Наши агенты могут делать гораздо больше, чем это. Прежде чем мы перейдем к работе наших агентов, к их конкретному выводу, давайте поговорим о том, как вы можете перепрограммировать своих агентов, чтобы у них были специальные функции, такие как запуск навыков агента Clog. Итак, давайте откроем этот кодовый файл. В начале вы видели, что мы запустили эту специальную команду, верно? Если мы вернемся к нашему терминалу Gemini, пойдем сюда, мы запустили эту команду. Хорошо, позвольте мне быстро скопировать это. Верно? Как мы смогли взять это и превратить в конкретный промпт, верно? Наш агент точно знал, что делать. Что здесь произошло? Итак, мы сделали что-то вроде этого. Вы можете видеть, что у нас здесь все наши файлы агентов. И если мы откроем Gemini, он указывает обратно на файл памяти Clog. Если мы откроем агентов, он указывает прямо на файл памяти Clog. И если мы откроем Clog, вы увидите кое-что действительно интересное. Выполнение повторно используемых промптов. В любое время, когда инженер начинает команду с обратного слэша, ищите файл и выполняйте команду. Мы ищем стандартные промпты, и мы ищем вложенные промпты, и мы ищем промпты агентных песочниц. Хорошо, мы фактически перепрограммировали обратный слэш, чтобы он смотрел на наш навык агентной песочницы. Вы можете видеть здесь, у нас есть навык агента, который будет перенаправлять запускаемый промпт. И это возможность мощных языковых моделей, обернутых в правильного агента. Они могут понять, что вы хотите перепрограммировать. И это отличное использование файлов памяти, кстати. Вы можете добавить свой собственный специальный синтаксис к своим агентам, чтобы они работали уникальным образом. Итак, внутри этого кодового файла, если мы перейдем к skills agent sandbox skill, вы увидите, что это именно то, что запускают и на что ссылаются наши агенты, верно? Эта команда обратного слэша сопоставлена с отдельными промптами, которые у нас есть здесь. Вы можете видеть, что там есть песочница, и там наш агентный рабочий процесс, верно? План, сборка, хостинг, тестирование. Нам не нужно углубляться в это слишком сильно, но вы можете представить, что это делает, если вы следили за каналом. Это мощный агентный промпт, который выполняет тонну работы в одном промпте, 170-строчный промпт. И вот как это выглядит на высоком уровне. Если мы просто откроем workflow collapse снова, вы увидите здесь все шаги. Читать документацию по агентным песочницам. Так что каждый агент учится работать с этим навыком. Инициализировать песочницу. Итак, вот шаг планирования. Создать полнофункциональный план. Затем у нас есть сборка, хостинг, а затем тестирование. Итак, у нас есть отдельные промпты, которые разбиваются в этом рабочем процессе. И круто то, что они фактически продолжают использовать этот перепрограммированный обратный слэш. Хорошо? И поэтому, возможно, обратный слэш — это не лучший символ, лучшая клавиша для использования. Вы можете использовать все, что хотите, если оно доступно и не используется. И поэтому вы можете видеть здесь, что мы запускаем классический цепочечный агентный рабочий процесс. Вы можете нарезать и разделять свои промпты. Вот как я встраиваю промпты в агентные навыки. Так что это очень мощно. Давайте перейдем к некоторым результатам контента. Не стесняйтесь, конечно, проверить навык, проверить эти промпты. Все это будет доступно вам. Ссылка в описании. И давайте начнем смотреть на некоторые из наших результатов. Могут ли передовые агенты, такие как Sonnet 45, такой как новый Gemini 3 Pro, такой как Codeex 5.1 Max XL Premium, запускать свои собственные компьютеры? Давайте узнаем. Верно? Эти простые демонстрации пользовательского интерфейса, генерации SVG, они не важны. Меня они не волнуют. Вас, вероятно, тоже. Это не настоящая инженерная работа. Настоящая инженерная работа — это объединение сервисов. Это полнофункциональная разработка приложений. У нас здесь Sonnet, и давайте посмотрим, что у нас здесь. Итак, это интерфейс SQL CRUD от Sonnet. Хорошо. И давайте откроем панель разработчика. Отлично. Пока все хорошо. Нажмем посты. Хорошо. Это пользовательский интерфейс, бэкенд и сервер. Нам нужно продолжать продвигать эти модели. Что они могут делать сами, если мы дадим им правильные инструменты? У наших агентов есть свои компьютеры для работы. Это потрясающе. И давайте докажем, что это работает, верно? Давайте... что это за значок корзины? Удалить строку. Отлично. Строка успешно удалена. Удалить еще одну. Удалить еще одну. Теперь я обновлю. Отлично. Всего семь строк. 4 3 53. Это выглядит отлично, верно? Это сохраняется. Это полнофункциональное приложение. У нас есть бэкенд на Python, некоторый фронтенд, а затем у нас есть база данных, похожая на SQL, в качестве бэкенда. Фантастика, верно? Создать случайную строку, строка 12. Получаем немного Lorem Ipsum. И это здорово. Так что мы можем... просмотреть данные, а затем, конечно, отредактировать их. Фантастика. Давайте увеличим идентификатор пользователя. Сохранить. Отлично. Мы можем видеть теги. Мы можем удалять теги. Мы можем добавить новую строку. И снова, чтобы подчеркнуть точку. Обновить Claude Code, работающий на Sonnet 4.5, предоставил все это полнофункциональное приложение за один раз. Хорошо. Итак, здорово. Мы просто бросили вычислительные ресурсы на проблему. Она решила все. Теперь мы можем скачать этот код, если хотим, из агентной песочницы, работать над ним, улучшать его. и так далее, верно? Это здорово. Что еще у нас есть? Как поживает Gemini? Хорошо, похоже, Gemini закончил работу над приложением для заметок. Давайте посмотрим, как он справился. Итак, Ctrl S для включения копирования. Это немного раздражает. Хотелось бы, чтобы мы могли просто копировать вещи как обычно. Давайте посмотрим, что у нас здесь. Хорошо, похоже, у нас есть приложение для заметок. Лог консоли выглядит хорошо. Давайте создадим заметку. Записываем некоторые детали. И если мы нажмем сохранить, мы должны увидеть, что это сохранится. Вы видите, что цветовая схема немного нарушена, но это работает. Хорошо, мы можем искать наши заметки. Внешняя заметка. Отлично. Это скрывает другую. Мы можем создать еще несколько заметок, верно? Сохранить. Это выглядит отлично. Новая заметка. Сохранить. Это выглядит отлично. Мы можем переключать заметки. Мы можем удалять заметки. И знаете, момент истины. Можем ли мы обновить и получить Да. Сохранение. Мы можем. Хорошо. Итак, это здорово. И знаете, позвольте мне быть предельно ясным. Откройте сеть. Закройте этот фильтр. Обновить. Нажмем удалить. И вы увидите новое сетевое событие. Это удаление 4. Полнофункциональное. Это было создано за один раз Gemini 3 Pro. Пока все выглядит хорошо. UI мог бы быть лучше. Не очень беспокоюсь о UI, верно? Так что это приложение для заметок. Давайте посмотрим, что у нас здесь. Хорошо, похоже, у нас есть генератор изображений Nano Banana. Давайте скопируем Nano Banana на столе. Нажмите "Сгенерировать". Хорошо, у нас здесь ошибка. Он не найден или... Хорошо, значит, он неправильно назвал модель. Это нормально. У него должно быть это название модели. Я просто открою Easy Nano здесь. И у нас есть эта документация. Так что я просто скопирую это название модели redux fix. Хорошо. И вы можете видеть здесь, знаете ли, это длительные задачи агентного декодирования. Это 37-минутный запуск, и он все еще работает над этим. И это наш... какое приложение? Это представление таблицы, выходящее из Gemini CLI Gemini 3 Pro. Это выглядит хорошо. Давайте посмотрим, как поживает Codeex. Давайте найдем эту публичную ссылку прямо здесь и посмотрим, как это выглядит. Ого, хорошо. Очень приятно. Вау, это как бы безумие. Вы можете видеть здесь, что ключ API уже установлен. Я попросил агентов найти файл переменных окружения и просто поместить его в их песочницу. Это так круто. Ну, что это? Современная иллюстрация Nano Banana на темном градиентном фоне. Очень круто. Давайте просто... перезапустим это. Итак, давайте сгенерируем это. И это работает на 2.5 flash image. Так что предыдущая версия Nano Banana. Похоже, она сгенерировала то же самое. Это действительно обновляется? Итак, давайте скажем, светлый градиентный фон. И давайте запустим это. Не уверен, что это действительно сгенерировало что-то новое. Давайте посмотрим. Хорошо. Я не думаю, что это действительно создает новые изображения. Обновить. Посмотрим, есть ли какие-либо ошибки. Круто. Загрузка UI. Хорошо. Нет, это на самом деле ничего не обновляет. Так что давайте просто переформулируем немного. Изображения на самом деле не генерируются. Ничего не попадает на фронтенд. Мы видим только одно изображение. Нам действительно нужны какие-то итерационные промпты здесь. Обратный слэш, песочница, отладка, что-то вроде этого, чтобы дать модели немного больше направления. Но пока это нормально. Мы просто будем делать случайные ад-хок промпты. Давайте посмотрим на другой результат. Этот выходит из Codeex 5.1 High. Давайте посмотрим, что у нас здесь. Очень приятно. Так что я очень впечатлен UI Codeex. Вы можете видеть, что у него тот же стиль, та же тема. Но давайте посмотрим. Давайте убедимся, что у нас нет ошибок, потому что, знаете ли, самое важное, что могут сделать ваши модели, — это дать вам работающую версию, верно? Мы не хотим сидеть среди ошибок. Мы хотим сидеть среди работающих прототипов, которые мы затем можем проверить и определить, какой из них мы хотим продвигать. И то же самое с PR для существующих кодовых баз, верно? Мы хотим работать над тем, что работает. Мы хотим улучшать. Мы хотим итерировать. Давайте посмотрим, что у нас здесь. Итак, вы можете видеть здесь, отличный разбор этих таблиц. Опять же, просто отличный UI, и мы можем просматривать, верно? Так что есть некоторые проблемы со стилизацией. Это нормально. Посмотрим, сможем ли мы создать новые строки. Фантастика. Итак, мы генерируем случайные строки. Я думаю, что на данный момент, похоже, Codeex имеет лучший UI. Так что это здорово. Мы можем удалить. И вот реальный тест. Вы можете видеть, что у нас пять строк. Если мы обновим, отлично. Мы получаем те же пять строк. Вы можете видеть, что этот сервис фактически работает против полнофункционального приложения. И снова мы можем это доказать, верно? Скачать этот репозиторий в temp codeexite table app. Хорошо, мы хотим, чтобы все, что он только что сделал, было загружено локально. Вы можете видеть здесь, что мы действительно используем контекстное окно по максимуму, пытаясь сделать все это за один раз. Это, конечно, ограничение передачи тонны работы отдельным агентам. Что нам действительно нужно здесь, так это конвейер агентов. И интересно, что здесь мы получили около 20% контекста. Это может быть новое сжатие контекста и своего рода удаление вызовов инструментов, о которых упомянул Codeex. Очень интересные вещи. Давайте вернемся к Gemini и посмотрим, что у нас там готовится. Вывод здесь. Давайте посмотрим, как это выглядит. Хорошо, вот наша версия Gemini. Давайте просто сгенерируем изображение. Случайное изображение банана. Давайте откроем Dev Tools. Похоже, у нас уже есть ошибка. Давайте посмотрим, получим ли мы что-нибудь здесь. Вот оно. Хорошо, так что приятно видеть, что эта модель работает сквозным образом. Давайте попробуем про-версию и сделаем что-нибудь немного более сложное, верно? Мне нравится генерация карт покемонов. Я думаю, что это что-то детальное, над чем мы можем заставить модель действительно поработать. Так что я просто вставлю этот промпт сюда. Три карты покемонов рядом. Каждая из них — эволюционировавшая версия предыдущей. Давайте установим это в... давайте сделаем пейзаж и дадим ему сгенерироваться. Итак, это работает на новой про-версии. И поэтому давайте посмотрим, как выглядит эта генерация. Похоже, ничего не произошло. Давайте просто запустим это снова. Хорошо, так что здесь ничего не происходит. Не уверен, что там происходит. Давайте просто обновим. Хорошо, так что посмотрите на это. У нас что-то сгенерировано здесь. У нас есть Бананит. У нас есть Плантеан Маск. Хорошо, так что я не совсем уверен, что там происходит, но вот другая версия. Эта выходит из Gemini 3 Pro. Пока они создают полнофункциональную версию. Это все, что нас волнует. Хорошо, но у нас была эта версия, которая долгое время была зависшей. Не уверен, что эта версия выйдет. Посмотрим. Итак, вот генератор изображений Nano Banana AI, выходящий из Claude Sonnet. Давайте посмотрим, как это выглядит. Хорошо. Эм, так что эти кнопки не отображаются должным образом, но это нормально. Давайте используем тот же промпт здесь. Сгенерировать. Вы видите, что ошибок в консоли нет. Это выглядит хорошо. Это полнофункциональная работа. Бэкенд, фронтенд, база данных. И вот оно. Отлично. У нас есть несколько карт покемонов. Так что это выглядит отлично. Давайте откроем это в широком изображении. Давайте используем про. И давайте запустим это снова. Когда дело доходит до реального выполнения работы, похоже, что лучший результат на данный момент — это все еще модель Claude 4.5 Sonnet внутри Claude Code, верно? Есть что-то в агенте, что собирает все это вместе. И это то, что, как я уже упоминал, является огромным дифференцирующим фактором. Дело не только в модели anymore. Совершенно ясно, что Gemini 3 — очень мощная модель. Она очень способна. Она сгенерировала четыре из пяти из них. Она все еще работает над этим пятым примером, выходящим из песочницы. Но Cloud Sonic, похоже, получит каждую из этих версий, верно? Позвольте мне посмотреть на эту последнюю версию. Это приложение для заметок. Где это окончательный вывод? Где публичная ссылка? Давайте посмотрим, что сделал Codex. Давайте скопируем это на стол, сгенерировать. Итак, давайте посмотрим, смог ли Codex исправить свою ошибку и действительно заставить изображение генерироваться. Не смог. Хорошо, это нормально. Вы можете видеть здесь, мы близки. Вероятно, один или два шага от того, чтобы это заработало. Ошибок здесь нет, так что это нормально. Это подчеркивает один из моментов, почему так важно иметь агентные песочницы, верно? Меня не волнует, что некоторые из этих версий, и вы можете видеть, что наши песочницы начинают закрываться. Прошло достаточно времени, поэтому они начинают истекать. Каждая из наших песочниц имеет конкретное имя внутри метаданных, и у всех есть свои рабочие среды. Мы можем извлечь код. Мы можем попросить сделать конкретные вещи внутри сред. Это супер мощно. Я собираюсь немного продвигать эту тенденцию на канале. Я думаю, это слишком важно, чтобы упустить. Вы можете запускать выделенные среды для своего агента, чтобы он владел ими от начала до конца. Это дает вам изоляцию, верно? А изоляция дает вам безопасность. Это дает вам масштаб. Вы можете развернуть множество агентов, решающих множество проблем. Затем вы можете выбрать лучший из N. И это дает вашим агентам больше автономии, верно? Позвольте им делать все, что, по их мнению, им нужно сделать, чтобы выполнить работу. Конечно, здесь есть рекомендации. Конечно, есть некоторые ограничения, которые вы захотите установить. Здесь вступает в игру отличное проектирование промптов и проектирование контекста. Если мы перейдем к навыку, все это находится внутри навыка, кстати. Ничто из этого не работает вне навыка. Так что, если мы перейдем к навыкам Clog, агентным песочницам, все здесь происходит внутри навыка. У нас есть CLI песочницы. У нас есть некоторые выделенные промпты, которые направляют весь опыт. А затем у нас есть некоторые примеры того, как это может быть запущено и выполнено, верно? И детали навыка содержат все, что агент должен знать, чтобы запустить и использовать сам навык. Супер мощные вещи. И мы запускаем все это, перепрограммируя наших агентов, чтобы они понимали, что обратный слэш сопоставляется с одним из следующих: стандартные промпты, вложенные промпты и промпты агентных песочниц. Мы действительно можем открыть это, чтобы просто сопоставить с промптом навыка. Так что очень мощные вещи там. Совершенно ясно, что модель больше не является ограничением. Это то, что вы и я можем сделать. Это технология, которую вы и я развертываем против этих агентов. Будь то Gemini 3 Pro или новый GBT 5.1 Codeex, совершенно новые возможности редактирования. Я думаю, что антигравитация движется в правильном направлении. Я не знаю, использовали ли вы это. Есть много работы, которую нужно сделать над этим инструментом, чтобы он стал действительно жизнеспособным. Он просто показался мне неподготовленным. Запуск показался очень неподготовленным. Итак, у нас здесь завис экземпляр Gemini на довольно долгое время. Ранее он был зависшим на 40 с чем-то минут. Я запустил промпт продолжения здесь. Он зависает. Это нормально. Опять же, это одна из отличных частей паттерна "лучший из N" — дать вашим агентам их собственные песочницы. Вы можете просто позволить им уйти и работать. Вы можете запускать множество версий, и вы можете полностью ожидать, что некоторые версии не будут работать успешно. Знаете, у нас была версия здесь. Похоже, эта версия Claude Code не завершилась. Одна из наших версий Codeex также не завершилась. Но у нас также были хорошие генерации, верно? У нас были солидные генерации от каждой из этих передовых моделей. И это возвращает нас к началу. Знаете, все эти модели очень, очень способны. Хорошо, есть много возможностей. Знаете, я люблю думать об этом так: знаете, есть много возможностей, которые открываются на определенных уровнях интеллекта. И большинство из нас, включая меня, не используют полный, знаете ли, 73-й индекс интеллекта Gemini 3 Pro. Мы, вероятно, где-то на 50, верно? или, знаете ли, 60, верно, если вы действительно продвигаете вещи. Так что вопрос в том, какие методы, какие системы, какие вычислительные ресурсы, какие точки рычага агентного кодирования вы можете собрать вместе, чтобы получить больше работы от агентов. Насколько больше работы вы можете передать своим агентам? Поверьте мне, ответ — больше, больше. Ищите масштабирование. Ищите эти крутые паттерны, такие как перепрограммирование ваших агентов. Ищите инструменты и системы, которые помогают вам выйти из цикла, чтобы вы могли масштабироваться и бросать больше вычислительных ресурсов на проблему, а затем выбирать лучший из N и двигаться дальше. Верно? Всегда будет реальная инженерная работа, но ее форма и вид должны меняться по мере развертывания большего количества вычислительных ресурсов. Мы говорим об этом на канале все время. Если вы хотите победить как инженер прямо сейчас, вы масштабируете свои вычислительные ресурсы, чтобы масштабировать свое влияние. Вы знаете, где меня найти каждый понедельник. Оставайтесь сосредоточенными и продолжайте строить.