Transcription
С возвращением, инженеры. С вами Indydev Dan. У нас есть новая антигравитационная IDE следующего поколения Gemini 3 Pro, и у нас есть Nano Banana Pro, не говоря уже о GPT 5.1 Codeex Max Premium XL от OpenAI. Ладно, нам действительно нужно улучшить наши названия. Давайте настроимся на сигнал. Что здесь действительно важно? Что на самом деле говорят эти релизы? Итак, если спросить меня, только два из трех этих релизов имеют значение. Gemini 3 — новая лучшая модель. Clawed Code, работающий на 4.5 Sonnet, был свергнут. Там есть некоторая тонкость. Там есть некоторая деталь, но, как вы можете видеть, э, бенчмарки говорят сами за себя. Gemini 3 Pro стирает всех с доски. Google anti-gravity — это форк VS Code, который больше похож на копирование курсора, которое на самом деле является каскадом. Хорошо, для меня здесь очень слабый сигнал. Если вам нужен отличный готовый к использованию, строго ориентированный инструмент редактирования, просто откройте Cursor, используйте его. Мне очень интересно посмотреть, когда эти крупные компании поймут, что они не могут победить стартап, который делает только одно. Cursor работает только на Cursor, в то время как у Google 500 000 продуктов. Так они их не победят. Слабый сигнал здесь от anti-gravity. А затем у нас есть лучший инструмент для редактирования изображений, лучший инструмент для генерации изображений, Nano Banana Pro. Это сильный сигнал. Это высокая возможность. Эта модель абсолютно безумна. Но настоящая главная новость здесь, конечно же, Gemini 3 Pro. Каждый раз, когда выходит такой релиз, я задаю себе один вопрос. Что мы, инженеры, можем сделать, чего не могли сделать раньше? Существует новая возможность, которую большинство инженеров сейчас упускают, и которой я хочу с вами поделиться. Я был одержим этой возможностью в последнее время. Вы можете дать своим агентам их собственные компьютеры. Здесь у нас Gemini CLI, работающий с совершенно новой предварительной моделью Gemini 3 Pro. Мы можем выполнить этот промпт обратный слеш sandbox. Итак, мы ищем пеликана. Это вариация на тему "Пеликан на велосипеде" Саймона Уиллиса. Я вырос, катаясь на скейтборде. Я хочу увидеть, как этот пеликан катается на скейтборде. А затем я хочу увидеть размещенные результаты. Мы даем Gemini 3 его собственный компьютер. Нажмем Enter. Command tab. И давайте запустим еще один экземпляр Gemini CLI, работающий, конечно же, с передовой моделью Gemini 3 Pro. Обратный слеш sandbox generate host results. Еще один sandbox. Нам нужен SVG из трех карточек Pokémon. Банановая тема, показывающая их эволюцию. Разместить результаты. Бац. Давайте запустим. Круто. Но вам не надоели эти демонстрации, где кто-то просто создает простой, вы знаете, одноразовый пользовательский интерфейс. Давайте продвинем эти модели дальше. Эти передовые модели могут сделать гораздо больше, чем вы думаете. Я могу гарантировать вам, что вы не используете достаточно вычислительных ресурсов. Я не использую достаточно вычислительных ресурсов. Итак, давайте исправим это. Снова новый терминал, G3PY. Давайте запустим агентный рабочий процесс. Обратный слеш agent, и я объясню этот обратный слеш через секунду. Sandboxes: plan build post test. А затем я вставлю сюда промпт. Это будет конкатенация определенного промпта. Вы можете видеть, что мы создадим простой интерфейс SQLite crud. А затем у нас просто есть имя для этого рабочего процесса, чтобы мы могли идентифицировать, что он запущен. Теперь Gemini 3 Pro запускает не один, не два, а три экземпляра своего собственного компьютера. Вы можете видеть идентификатор sandbox прямо здесь. Это создаст полнофункциональное приложение. Инженерная работа — это гораздо больше, как вы знаете. Давайте продолжим. Бац. G3PY. Давайте масштабируем наши вычисления, чтобы масштабировать наше влияние. Обратный слеш agent sandboxes. На этот раз нам нужен интерфейс nano banana. Он создаст нам пользовательский интерфейс для работы с новой моделью Nano Banano Pro. Хорошо, мы запускаем это. Теперь у нас есть четыре отдельных агента Gemini, работающих на своих собственных компьютерах. Угадайте, что мы будем делать дальше? У нас есть вычислительные мощности по запросу, когда мы используем передовые модели, работающие на их собственных устройствах. G3PY. Я хочу показать вам, сколько вычислительных ресурсов вы действительно можете использовать здесь. Хорошо, мы вставим еще один промпт. Обратный слеш agent sandbox plan buildhost test. Здесь нам нужно приложение для заметок. Опять же, полнофункциональное. Это не пользовательский интерфейс. Это полнофункциональное приложение. Нажмите Enter. У нас есть 1 2 3 4 пять экземпляров Gemini, работающих. Вы можете видеть здесь, у нас уже есть один результат. Но прежде чем мы коснемся этого, я хочу немного повысить ставки. Я хочу добавить сюда некоторую конкуренцию, и я хочу добавить, конечно же, Claude code, работающий на Sonic 4.5, и новый codeex, работающий на GBT 5.1 codeex max high. Что я собираюсь сделать здесь? Я собираюсь сделать то же самое с agent sandboxes. Когда вы даете своим агентам их собственные выделенные устройства, вы можете делать абсурдные вещи в масштабе. Те же самые промпты. Итак, SVG Pelican запущен. SVG три карточки Pokémon запущены. Визуализатор SQL light запущен. Интерфейс Nano banana UI запущен. И наше простое приложение для заметок запущено. Мы собираемся сделать то же самое внутри Codeex. Итак, у нас запущено 15 экземпляров агентов, выполняющих работу в своей собственной среде. В этом видео я хочу показать вам, как вы можете перепрограммировать любого агента для использования навыков агентов. Я хочу показать вам, как вы можете масштабировать свое влияние, давая своим агентам их собственные устройства. А затем нам нужно углубиться в суть всего этого. Насколько важна производительность модели на самом деле anymore? Насколько Gemini 3 Pro лучше остальных? И действительно ли это имеет значение? Итак, прежде всего, если мы откроем наш интерфейс agent sandbox, вы можете увидеть здесь, у нас есть много, много, много запущенных экземпляров agent sandbox. Похоже, у нас запущено 12 экземпляров sandbox на данный момент. Но это невероятная часть agent sandboxes. Вы можете просто масштабировать. Вы можете просто бросить больше вычислительных ресурсов на свои проблемы. E2B — это сервис, который я использую для хостинга и запуска моих agent sandboxes, моих компьютеров для моих агентов. Эти песочницы обеспечивают большую автономию для ваших агентов и меньше управления для вас. Запустите кучу вычислительных ресурсов против проблемы, а затем выберите лучший результат. Это лучшее из N. Пока эти работают, делая работу для нас, давайте разберемся со слоном в комнате. Claude Code, работающий на Sonnet 4.5, лучший агент и модель наконец-то получили конкуренцию. Если мы откроем искусственный анализ от этого стороннего анализа, никогда не доверяйте бенчмаркам, которые вы видите на хост-странице. Все они выглядят отлично. Мы можем посмотреть на них, но вы всегда хотите сторонний обзор. Если мы посмотрим на это и просто поищем, знаете ли, Gemini 3 Pro, результаты есть. Это очень, очень явно лучшая модель. Позвольте мне просто поискать Gemini 3 здесь, чтобы мы могли увидеть ее на индивидуальных бенчмарках. Почти каждый бенчмарк имеет Gemini 3 на вершине. Я использую эту модель с момента ее выпуска. Сравнивая ее с Cloud Code и Sonic, совершенно ясно, что это абсолютно безумная модель. Google усердно поработал, и из всех способов, которыми они разбросаны как большая компания со многими, многими целями, совершенно ясно, что они серьезно относятся к созданию лучшей модели, лучшей вычислительной мощности, лучших чипов, верно? вплоть до TPU. Теперь, настоящий вопрос, который я всегда люблю задавать, это что мы можем сделать, чего не могли сделать раньше? Я думаю, есть совершенно новая возможность, которую вы можете дать своим агентам — запускать их собственные компьютеры. Наши результаты начнут поступать сюда. Давайте подождем еще немного. Есть что-то под всеми этими релизами моделей, что, я думаю, действительно важно обсудить и действительно поговорить, и это вопрос о том, насколько это на самом деле важно anymore? Я думаю, есть несколько бенчмарков, которые имеют гораздо большее значение, чем другие. Вы хотите продолжать видеть, как увеличивается продолжительность работы терминальных инструментов, инструментов для вызова, длительных периодов агентной работы. Вы хотите, чтобы эта продолжительность постоянно увеличивалась. Я думаю, это сильный сигнал, верно? Любой агентный бенчмарк, связанный с кодированием. Это действительно отличные вещи. Он работает дольше. Он выполняет работу. Он фактически выполняет инженерную работу для вас. Опять же, как вы увидите, верно, это не просто фронтенд-приложения. Мы не говорим, что нужно построить Pong. Они будут создавать полнофункциональные приложения, фронтенд, бэкенд, базу данных. Я хочу высказать кое-что и услышать ваше мнение по этому поводу. Я не думаю, что интеллект модели на самом деле дает нам больше новых возможностей anymore? Хорошо, я думаю, что действительно важно сейчас — это полный опыт, агентный опыт. Хорошо, мы уходим от того, что LLM являются тем, что имеет значение, к тому, что агенты являются тем, что имеет значение, и экосистеме агентов, которую вы строите. И теперь по этой причине вся оценка производительности полезна лишь в некоторой степени. Что имеет наибольшее значение, так это то, как эти модели, а теперь конкретно, как эти агенты работают против вашего конкретного варианта использования? Это единственный бенчмарк, который действительно имеет значение. Мы подходим к тому моменту, когда на самом деле не имеет значения, что эти большие лаборатории публикуют в своем блоге, потому что на самом деле важно — это ваш бенчмарк, а затем то, как они работают внутри агента. Так что, хотя все это хорошо, все это коррелирует с лучшей производительностью. Есть так много вещей, которые все эти модели могут делать. Теперь ограничение больше не в языковой модели. Ограничение в агенте. Ограничение в том, какие агентные системы мы с вами можем или не можем построить. И это в нас, действительно продвигающих эти модели против наших конкретных вариантов использования. Итак, имеют ли модели значение anymore? Каждый релиз они значат меньше. Кстати, чтобы просто уделить минутку, я просто хочу сказать огромное спасибо всем, кто следит за каналом. Мы только что пересекли отметку в 100 000 подписчиков. как канал глубоких технологий, где мы действительно углубляемся в инженерные варианты использования, инженерные принципы и агентную инженерию. Мы никогда не должны были стать такими большими. Я создал этот канал, чтобы быть любимым каналом инженеров для инженеров. Хорошо, так по дизайну он должен был быть настолько сфокусированным, настолько инженерным и действительно опережающим в том, что мы можем делать. Трудно попадать в эту точку каждую неделю, вы знаете, создавая видео каждую неделю. В это вложено так много подготовки, о которой никто не хочет слышать. Но просто невероятно быть на этом этапе, и я просто хочу поблагодарить всех, кто был частью этого пути до сих пор. Цель этого канала — создавать живое программное обеспечение, которое работает для нас, пока мы спим, и мы приближаемся. Я просто хочу упомянуть всех, кто был с нами в этом путешествии. Если вы новичок, добро пожаловать и пристегнитесь. 2026 год будет безумным для нас, инженеров. Есть много страха, но есть и невероятные возможности, верно? Когда все убегают, когда все выключаются, когда происходят потери рабочих мест, вот тогда и нужно включиться и выяснить, что дальше. И именно этому мы посвящаем каждый понедельник здесь, на канале. Хорошо, у меня есть большие идеи, которыми я хочу поделиться с вами. У меня есть огромные прототипы, над которыми агенты активно работают буквально прямо сейчас, и я не могу дождаться, чтобы поделиться ими с вами в 2026 году. Пару вещей, просто чтобы упомянуть, приближаясь к концу года. У меня есть пара больших идей, которыми я хочу поделиться с вами. У нас будет наше большое видео с прогнозами на конец года, где мы оглянемся на все сделанные ставки, посмотрим, сколько из них мы угадали, а затем я сделаю свои ставки и прогнозы на 2026 год. Я также выпущу два заключительных урока для Aentic Horizon до 2026 года. Так что следите за этим. Этот канал всегда будет сосредоточен на сигнале, поиске лучшего инструмента для инженерной работы. Огромное спасибо каждому инженеру, который подключается неделя за неделей. 100K — это безумное число. Давайте вернемся, чтобы посмотреть, как поживают наши агенты. Итак, помните наш исходный промпт здесь, обратный слеш sandbox. Это не правильный синтаксис, верно? Это команда обратного слеша, а не команда слэша. Так что же я сделал здесь? Я перепрограммировал этого агента и действительно каждого агента, чтобы использовать навыки агентов clog, использовать общий навык, к которому теперь может получить доступ любой агент. Давайте сначала посмотрим на результат здесь. Итак, я скопирую это. Давайте откроем это. Хорошо. И вот наш Пеликан, режущий. Хорошо. Так это Пеликан Gemini Pro, режущий. Выглядит отлично. Давайте также откроем наши карточки Pokémon. Верно. Нам нужны были SVG карточек Pokémon. Так что давайте посмотрим, что мы получим здесь. Хорошо. Итак, фантастика. У нас есть Bananite. У нас есть banana ring, и у нас есть king banana knight. Имейте в виду, что это SVG. Так что это не простая задача, верно? Наш агент Gemini 3 Pro создал SVG карточек Pokémon. Так что довольно впечатляет. И снова, я просто хочу продолжать подчеркивать этот момент. Все это работало на его собственном компьютере. Ничто из этого не коснулось моего компьютера. Вы можете видеть здесь, у нас есть несколько запущенных экземпляров, 15 запущенных песочниц, как и было запрошено. Так что это выглядит отлично, верно? Это работает прямо из песочницы. Так что отличная часть agent sandbox заключается в том, что вы можете просто развернуть вычислительные ресурсы против проблемы, а затем, когда захотите, вы можете выбрать лучший результат, лучший из N. Так что мы можем просто сделать что-то вроде этого. Скопировать это приложение во временное место G3 banana Pokémon, что-то вроде этого, верно, и я думаю, это будет один файл или один файл с некоторыми SVG. Теперь у нас есть временное место, где этот файл размещен, и теперь мы можем делать с ним все, что захотим. Верно? Итак, наш агент, работающий в песочнице, также может просто копировать все файлы локально, когда мы хотим их, если мы хотим их. Вот наш Pelican skateboard из нашего Codeex, есть некоторые проблемы, но хорошая попытка. И вот наша версия снова из Codeex с нашей карточкой Pokémon. Так что, довольно хорошо. Вы можете видеть здесь, что Gemini определенно создал более связные SVG. Но давайте посмотрим на версию карточки Pokémon от clog code. У нас есть Bananito, у нас есть Banana Chew, и Banana Zar. Но это все простые проблемы, верно? Наши агенты могут делать гораздо больше, чем это. Прежде чем мы перейдем к работе наших агентов, к их конкретному выводу, давайте поговорим о том, как вы можете перепрограммировать своих агентов, чтобы они имели специальную функциональность, такую как запуск навыков агентов clawed. Итак, давайте откроем этот кодовый файл. В начале вы видели, что мы выполнили эту специальную команду, верно? Если мы вернемся к нашему терминалу Gemini, перейдем сюда, мы выполнили эту команду. Хорошо, так что позвольте мне быстро скопировать это. Верно, как мы смогли взять это и превратить это в конкретный промпт, верно? Наш агент точно знал, что делать. Что здесь произошло? Итак, мы сделали что-то вроде этого. Вы можете видеть, что у нас есть все наши файлы агентов здесь. И если мы откроем Gemini, он указывает прямо на файл памяти claw. Если мы откроем agents, он указывает прямо на файл памяти cloud. И если мы откроем claude, вы увидите что-то действительно интересное здесь. Выполнение повторно используемых промптов. Каждый раз, когда инженер начинает команду с обратного слеша, ищите файл и выполняйте команду. Мы ищем стандартные промпты, и мы ищем вложенные промпты, и мы ищем промпты agent sandbox. Хорошо, так что мы фактически перепрограммировали обратный слеш, чтобы он смотрел на наш навык agent sandbox. Вы можете видеть здесь, у нас есть навык агента, который будет перенаправлять выполняемый промпт. И это возможность мощных языковых моделей, обернутых в правильного агента. Они могут понять, что вы хотите перепрограммировать. И это отличное использование файлов памяти, кстати. Вы можете добавить свой собственный специальный синтаксис к своим агентам, чтобы они работали уникальным образом. Итак, внутри этого кодового файла, если мы перейдем к skills agent sandbox skill, вы можете увидеть, что это именно то, что наши агенты запускают и ссылаются, верно? Так эта команда обратного слеша сопоставлена с отдельными промптами, которые у нас есть здесь. Вы можете видеть, что там есть sandbox, и там наш агентный рабочий процесс, верно? Plan, build, host, test. Нам не нужно углубляться в это слишком сильно, но вы можете представить, что это делает, если вы следили за каналом. Это мощный агентный промпт, который выполняет тонну работы в одном промпте, 170-строчный промпт. И вот как это выглядит на высоком уровне. Если мы просто откроем workflow collapse снова, вы можете увидеть здесь все шаги. Прочитать документацию agent sandbox. Так что каждый агент учится работать с этим навыком. Инициализировать песочницу. Итак, вот шаг планирования. Создать полнофункциональный план. Затем у нас есть сборка, хостинг и затем тестирование. Итак, у нас есть отдельные промпты, которые разбиваются в этом рабочем процессе. И круто то, что они фактически продолжают использовать этот перепрограммированный обратный слеш. Хорошо? И поэтому, возможно, обратный слеш — это не лучший символ, лучшая клавиша для использования. Вы можете использовать все, что хотите, если оно доступно и не используется. И поэтому вы можете видеть здесь, что мы запускаем классический цепочечный агентный рабочий процесс. Вы можете нарезать и разделять свои промпты. Вот как я встраиваю промпты в навыки агентов. Так что это очень мощно. Давайте перейдем к некоторым результатам контента. Не стесняйтесь, конечно, проверить навык, проверить эти промпты. Все это будет доступно вам. Ссылка в описании. И давайте начнем рассматривать некоторые из наших результатов. Могут ли передовые агенты, такие как Sonnet 45, такие как новый Gemini 3 Pro, такие как Codeex 5.1 Max XL Premium, запускать свои собственные компьютеры? Давайте узнаем. Верно? Эти простые генераторы пользовательских интерфейсов, примеры генерации SVG, они не важны. Меня это не волнует. Вас, вероятно, тоже. Это не настоящая инженерная работа. Настоящая инженерная работа — это объединение сервисов. Это разработка полнофункциональных приложений. У нас здесь Sonnet, и давайте посмотрим, что у нас здесь. Итак, это интерфейс SQL like CRUD от Sonnet. Хорошо. И давайте откроем панель разработчика. Отлично. Пока все хорошо. Нажмем posts. Хорошо. Это пользовательский интерфейс, бэкенд и сервер. Нам нужно продолжать продвигать эти модели. Что они могут делать сами, если мы дадим им правильные инструменты? У наших агентов есть свои компьютеры для работы. Это потрясающе. И давайте докажем, что это работает, верно? Давайте... что это за значок мусорной корзины? Удалить строку. Отлично. Строка успешно удалена. Удалить еще одну. Удалить еще одну. Теперь я обновлю. Отлично. Всего семь строк. 4 3 53. Это выглядит отлично, верно? Это сохраняется. Это полнофункциональное приложение. У нас есть бэкенд на Python, некоторый фронтенд, а затем у нас есть база данных SQL like в качестве бэкенда. Фантастика, верно? Создать случайную строку, строка 12. Получаем немного Lorem Ipsum. И это отлично. Так что мы можем... просмотреть данные, а затем, конечно, мы можем их отредактировать. Фантастика. Давайте увеличим идентификатор пользователя. Сохранить. Отлично. Мы можем видеть теги. Мы можем удалять теги. Мы можем добавить новую строку. И снова, чтобы подчеркнуть мысль. Обновить Claude code, работающий на sonet 45, доставил все это полнофункциональное приложение за один раз. Хорошо. Итак, отлично. Мы просто бросили вычислительные ресурсы на проблему, и она решила все. Теперь мы можем взять это, скачать код, если хотим, из agent sandbox, работать над ним, улучшать его. и так далее, верно? Это отлично. Что еще у нас есть? Как поживает Gemini? Хорошо, похоже, Gemini закончил приложение для заметок. Давайте посмотрим, как он справился. Итак, Crl S для включения копирования. Это немного раздражает. Хотелось бы, чтобы мы могли просто копировать вещи как обычно. Давайте посмотрим, что у нас здесь. Хорошо, так что похоже, у нас есть приложение для заметок. Лог консоли выглядит хорошо. Давайте создадим заметку. Ведем учет некоторых деталей. И если мы нажмем сохранить, мы должны увидеть, что это сохранится. Вы можете видеть, что цветовая схема немного нарушена, но это работает. Хорошо, мы можем искать наши заметки. Внешняя заметка. Отлично. Это скрывает другую. Мы можем создать еще несколько заметок, верно? Сохранить. Это выглядит отлично. Новая заметка. Сохранить. Это выглядит отлично. Мы можем переключать заметки. Мы можем удалять заметки. И знаете, момент истины. Можем ли мы обновить и иметь Да. Сохранение. Мы можем. Хорошо. Так что это отлично. И знаете, позвольте мне быть предельно ясным. Откройте сеть. Закройте этот фильтр. Обновить. Нажмем удалить. И вы увидите новое сетевое событие. Это удаление 4. Полнофункциональное. Это было создано за один раз Gemini 3 Pro. Пока все выглядит хорошо. UI мог бы быть лучше. Не очень беспокоюсь о UI, верно? Так что это приложение для заметок. Давайте посмотрим, что у нас здесь. Хорошо, похоже, у нас есть генератор изображений nano banana. Давайте скопируем nano banana на столе. Нажмите Generate. Хорошо, у нас здесь ошибка. Он не найден или. Хорошо, так что он неправильно назвал модель. Это нормально. У него должно быть это имя модели. Я просто открою easy nano здесь. И у нас есть эта документация. Так что я просто скопирую это имя модели redux fix. Хорошо. И вы можете видеть здесь, знаете ли, это длительные задачи декодирования агентов. Это 37-минутный запуск, и он все еще работает над этим. И это наше, какое приложение, это табличный вид, выходящий из Gemini CLI Gemini 3 Pro. Это выглядит хорошо. Давайте посмотрим, как поживает Codeex. Давайте найдем эту публичную URL здесь и посмотрим, как это выглядит. Ого, хорошо. Очень приятно. Вау, это как бы безумно. Вы можете видеть там, что ключ API уже установлен. Я попросил агентов найти файл переменных окружения и просто поместить его в их песочницу. Это так круто. Ну, что это? Современная иллюстрация nanobanana на темном градиентном фоне. Очень круто. Давайте просто... перезапустим это. Итак, давайте попросим это сгенерировать. И это запускает 2.5 flash image. Так что предыдущая версия nanobanana. Похоже, она сгенерировала то же самое. Это действительно обновляется? Итак, давайте скажем, светлый градиентный фон. И давайте запустим это. Не уверен, что это действительно сгенерировало что-то новое. Давайте посмотрим. Хорошо. Я не думаю, что это действительно создает новые изображения. Обновить. Посмотрим, не поступают ли здесь какие-либо ошибки. Круто. Загрузка UI. Хорошо. Нет, это на самом деле ничего не обновляет. Так что давайте просто повторим промпт немного. Изображения на самом деле не генерируются. Ничего не попадает на фронтенд. Мы видим только одно изображение. Нам действительно нужны здесь итерационные промпты. Обратный слеш sandbox отладка, что-то вроде этого, чтобы дать модели немного больше направления. Но пока это нормально. Мы просто будем использовать случайные ad hoc промпты. Давайте перейдем к другому результату. Этот выходит из Codeex 5.1 high. Давайте посмотрим, что у нас здесь. Очень приятно. Итак, довольно впечатлен UI Codeex. Вы можете видеть, что у него тот же стиль, та же тема. Но давайте посмотрим. Давайте убедимся, что у нас нет ошибок, потому что, знаете ли, самое важное, что могут сделать ваши модели, — это дать вам работающую версию, верно? Мы не хотим сидеть среди ошибок. Мы хотим сидеть среди работающих прототипов, которые мы затем можем проверить и определить, какой из них мы хотим продвигать. И то же самое с PR для существующих кодовых баз, верно? Мы хотим работать над тем, что работает. Мы хотим улучшать. Мы хотим итерировать. Давайте посмотрим, что у нас здесь. Итак, вы можете видеть здесь, отличный разбор этих таблиц. Опять же, просто отличный UI, и мы можем просматривать, верно? Так что здесь есть некоторые проблемы со стилизацией. Это нормально. Посмотрим, сможем ли мы создать новые строки. Фантастика. Так что мы генерируем случайные строки. Я думаю, что до сих пор, похоже, Codeex имеет лучший UI. Так что это отлично. Мы можем удалять. И вот реальный тест. Вы можете видеть, что у нас пять строк. Если мы обновим, идеально. Мы получаем эти пять строк снова. Вы можете видеть, что этот сервис фактически работает против полнофункционального приложения. И снова, мы можем это доказать, верно? Скачать этот репозиторий в temp codeexite table app. Хорошо, мы хотим, чтобы все, что он только что сделал, было загружено локально. Вы можете видеть здесь, что мы действительно используем контекстное окно по максимуму, пытаясь сделать это за один раз. Это, конечно, ограничение передачи тонны работы отдельным агентам. Что нам действительно нужно здесь, так это конвейер агентов. И интересно, что здесь мы получили около 20% контекста. Это может быть новое сжатие контекста и, своего рода, удаление вызовов инструментов, о которых упомянул Codeex. Очень интересные вещи. Давайте вернемся к Gemini и посмотрим, что у нас там готовится. Вывод здесь. Давайте посмотрим, как это выглядит. Хорошо, вот наша версия Gemini. Давайте просто сгенерируем изображение. Случайное изображение банана. Давайте откроем Dev Tools. Похоже, у нас уже есть ошибка. Давайте посмотрим, получим ли мы что-нибудь здесь. Вот оно. Хорошо, так что приятно. Приятно видеть, как эта модель проходит весь путь. Давайте попробуем про-версию и сделаем что-то немного более сложное, верно? Мне нравится генерация карточек Pokémon. Я думаю, что это что-то детальное, над чем мы можем заставить модель действительно поработать. Так что я просто вставлю этот промпт сюда. Три карточки Pokémon рядом. Каждая из них — эволюционировавшая версия предыдущей. Давайте установим это в... давайте сделаем пейзаж, и пусть это сгенерируется. Так что это запускает новую про-версию. И так, давайте посмотрим, как выглядит эта генерация. Похоже, ничего не произошло. Давайте просто запустим это снова. Хорошо, так что здесь ничего не происходит. Не уверен, что там происходит. Давайте просто обновим. Хорошо, так что посмотрите на это. У нас что-то сгенерировано здесь. У нас есть Bananit. У нас есть Plantean Musk. Хорошо, так что не совсем уверен, что там происходит, но вот другая версия. Эта выходит из Gemini 3 Pro. Пока они создают полнофункциональную версию. Это то, что нас волнует. Хорошо, но у нас была эта версия, которая зависла на довольно долгое время. Не уверен, что эта версия выйдет. Посмотрим. Итак, вот генератор изображений Nano Banana AI, выходящий из Clawude Sonnet. Давайте посмотрим, как это выглядит. Хорошо. Э... так что эти кнопки не отображаются должным образом, но это нормально. Давайте используем тот же промпт здесь. Generate. Вы можете видеть, что ошибок в консоли нет. Это выглядит хорошо. Это полнофункциональная работа. Бэкенд, фронтенд, база данных. И вот оно. Отлично. У нас есть несколько карточек Pokémon здесь. Так что это выглядит отлично. Давайте откроем это в широком изображении. Давайте используем pro. И давайте запустим это снова. Когда дело доходит до реального выполнения работы, похоже, что лучший результат на данный момент — это все еще модель Claude 4.5 sonnet внутри Claude code, верно? Есть что-то в агенте, что собирает все это воедино. И это то, что, как я уже упоминал, является огромным дифференцирующим фактором. Дело уже не только в модели. Совершенно ясно, что Gemini 3 — очень мощная модель. Она очень способна. Она сгенерировала четыре из пяти из них. Она все еще работает над этим пятым примером, выходящим из песочницы. Но Cloud Sonic, похоже, получит каждую из этих версий, верно? Позвольте мне посмотреть на эту последнюю версию. Это приложение для заметок. Где это финальный вывод? Где публичный URL? Давайте посмотрим, что сделал Codex. Давайте скопируем это на стол, сгенерировать. Итак, давайте посмотрим, смог ли Codex исправить свою ошибку здесь и действительно заставить изображение генерироваться. Он не смог. Хорошо, это нормально. Вы можете видеть здесь, мы близки. Вероятно, один или два шага от того, чтобы это заработало. Здесь нет ошибок, попадающих на фронтенд, так что это нормально. Это подчеркивает один из моментов, почему так важно иметь agent sandboxes, верно? Меня не волнует, что некоторые из этих версий, и вы можете видеть, что наши песочницы начинают закрываться. Прошло достаточно времени, поэтому они начинают истекать. Каждая из наших песочниц имеет конкретное имя внутри метаданных, и у всех есть свои рабочие среды. Мы можем извлечь код. Мы можем попросить сделать конкретные вещи внутри сред. Это очень мощно. Я буду продвигать эту тенденцию немного на канале. Я думаю, это слишком важно, чтобы упустить. Вы можете запускать выделенные среды для своего агента, чтобы он владел ими от начала до конца. Это дает вам изоляцию, верно? А изоляция дает вам безопасность. Это дает вам масштаб. Вы можете развернуть множество агентов, решающих множество проблем. Затем вы можете выбрать лучший из N. И это дает вашим агентам больше автономии, верно? Позвольте им делать все, что, по их мнению, им нужно сделать, чтобы выполнить работу. Теперь, конечно, здесь есть руководства. Конечно, есть некоторые ограничения, которые вы захотите установить. Здесь вступает в игру отличное проектирование промптов и проектирование контекста. Если мы перейдем к навыку, все это находится внутри навыка, кстати. Ничто из этого не работает за пределами навыка. Так что, если мы перейдем к claude skills agent sandboxes, все здесь происходит внутри навыка. У нас есть sandbox CLI. У нас есть некоторые выделенные промпты, которые направляют весь опыт. А затем у нас есть некоторые примеры того, как это можно запускать и выполнять, верно? И навык детализирует все, что агент должен знать, чтобы запускать и использовать сам навык. Очень мощные вещи. И мы запускаем все это, перепрограммируя наших агентов, чтобы они понимали, что обратный слеш сопоставляется с одним из следующих: стандартные промпты, вложенные промпты и промпты agent sandbox. Мы действительно можем открыть это, чтобы оно просто сопоставлялось с промптом навыка. Так что очень мощные вещи там. Совершенно ясно, что модель больше не является ограничением. Это то, что мы с вами можем сделать. Это технология, которую мы с вами развертываем против этих агентов. Будь то Gemini 3 Pro или новый GBT 5.1 Codeex, совершенно новый опыт редактирования. Я думаю, что в направлении anti-gravity движется в правильном направлении. Я не знаю, использовали ли вы это. Есть много работы, которую нужно сделать над этим инструментом, чтобы он был действительно жизнеспособным. Он просто показался мне неподготовленным. Запуск показался очень неподготовленным. Итак, у нас был этот экземпляр Gemini, который завис на довольно долгое время. Ранее он зависал на 40 с чем-то минутах. Я запустил промпт продолжения здесь. Он зависает. Это нормально. Опять же, это одна из отличных частей паттерна "лучший из N" — дать вашим агентам их собственные песочницы. Вы можете просто позволить им уйти и работать. Вы можете запускать множество версий, и вы можете полностью ожидать, что некоторые версии не будут работать успешно. Знаете, у нас была версия здесь. Похоже, эта версия Claude code не завершилась. Одна из наших версий Codeex также не завершилась. Но у нас были и хорошие генерации, верно? У нас были солидные генерации от каждой из этих передовых моделей. И это возвращает нас к началу. Знаете, все эти модели очень, очень способны. Хорошо, есть много возможностей. Знаете, я люблю думать об этом так: знаете, есть много возможностей, которые открываются на определенных уровнях интеллекта. И большинство из нас, включая меня, не используют полный, знаете ли, индекс интеллекта 73 Gemini 3 Pro. Мы, вероятно, где-то на 50, верно? Или, знаете ли, 60, верно, если вы действительно продвигаете вещи. Так что вопрос в том, какие методы, какие системы, какие вычислительные ресурсы, какие точки рычага агентного кодирования вы можете собрать вместе, чтобы получить больше работы с агентами. Сколько больше работы вы можете передать своим агентам? Поверьте мне, ответ — больше, больше. Ищите масштабирование. Ищите эти крутые паттерны, такие как перепрограммирование ваших агентов. Ищите инструменты и системы, которые помогают вам выйти из цикла, чтобы вы могли масштабироваться и бросать больше вычислительных ресурсов на проблему, а затем выбирать лучший из N и идти оттуда. Верно? Всегда будет реальная инженерная работа, которую нужно выполнить, но ее форма и вид должны меняться по мере того, как вы развертываете больше вычислительных ресурсов. Мы постоянно говорим об этом на канале. Если вы хотите победить как инженер прямо сейчас, вы масштабируете свои вычисления, чтобы масштабировать свое влияние. Вы знаете, где меня найти каждый понедельник. Оставайтесь сосредоточенными и продолжайте строить.