Transcription
Есть новый победитель по бенчмарк в генерации кода. И это не Clot, и не GPT кодекс, и даже не Droid. А теперь это, а это новая среда, новая агентная система для генерации кода, которая называется Verdent. И она заняла первое место в самом сложном SWE бенчмарке по решению задач, связанных с кодом, с программированием. Вот.
И на данный момент сейчас у них есть семидневный триал период и дают 100 кредитов. И в этом видео я покажу, как можно с двух, буквально с двух промтов за 15 минут создать вот такое вот приложение с использованием а NextGS, с использованием AISDK. И я закинул сюда один-единственный пром. Он пошёл, начал искать в интернете, использует Perplexity, потом пошёл в Open AI, сделал, а, то есть делал вот все вот эти шаги и выдал мне вот такой отчёт по проникновению искусственного интеллекта на в малый средний бизнес США. И вот мне хватило 80 кредитов. Смотри это видео до конца, и я тебе прямо пошаган с самого начала покажу, как это можно сделать.
Первое, о чём хочу сказать, что Verрден у него номер один по SWE Bench. Это такой бенчмарк, который сравнивает разные и не только LLM-модели, и разные агентные системы, которые используют под капотом модели в решении довольно сложных задач. И он обошёл всех и занял первое место. И а именно его я буду использовать сегодня. Я скачал себе триальную версию, а, скачал себе приложение. Есть, а, вот приложение, которое можно скачать для, а, мака или установить себе расширение в VS-код. Я буду использовать, а, приложение, честно говоря, ни разу его не запускал. Вот запустил всё здесь по дефолту. А, есть какие-то настройки, разные модели. Тут можно выбирать разные режимы. А тут есть Open и, а, antropic. А я думаю, что мы по ходу разберёмся. Тут можно создавать разных субагентов, насколько я понимаю, а подключать MCP, создавать команды. И это, конечно, всё очень классно. Давайте добавим сразу контекст SIM. Он нам будет нужен. Вот контекст SIM. Save. И, ну, в общем, не будем долго останавливаться на настройках пока что. Оставим всё как есть по умолчанию. Единственное, что я включу автоit и автоerate code review. А код Review модель будет у нас GPT5, а тут можно ещё и GM включить. Почему-то антропика здесь нет. Вот Agent модель у нас будет Sonet. Планмодель у нас будет Set в режиме Ultra Sim. Всё очень логично, всё очень понятно. MCP у нас а заработал. Отлично. А давайте я включу режим. Вот есть режим агента, есть режим планирования. Естественно, мы, а, начнём с режима планирования. А, наверное, мы должны какую-то выбрать директорию. Давайте я создам её. Тут задачи, я так понимаю. Вот эта секция показывает, а, файлы, а здесь, а, чат. Интересно пока что. Я думаю, сейчас разберёмся на ходу. А давайте сейчас я подготовлю промт, вставлю и по ходу того, как пойдёт работа, будем уже смотреть, разбираться, как что у нас работает. А тут есть вот очень удобный переключатель. Можно создавать сразу, а в своём рабочем древеки. Сейчас я в ветке main. А также тут можно тегать файлы либо тегать агентов, то есть кидать напрямую задачу агенту. А, ну и, соответственно, добавлять какие-то файлы. Вот. А сейчас я вставляю весь свой PD и перевожу его в режим план. То есть я не ставлю новый таск. Я так понимаю, что мы и так сейчас находимся в режиме нового таска и отправляем всё это дело сюда.
О, сейчас, только сейчас мне нужно оформить trial. О'кей. Платёжные данные, значит, надо оставить, да? Хорошо. У меня есть 100 кредитов, и я очень надеюсь на то, что нам их платят, а, чтобы сделать эту задачу. Иначе какой смысл в таком чемпионе среди всех агентных а кодеров, если за 100 кредитов он не уложится? Могу я всё-таки вставить свой перди? Да, работая, я так понимаю, у нас пошла. Я могу нажать вот на вот этот вот work, и я увижу log, что вообще у нас сейчас происходит. То есть я, а, вижу здесь свойd, вижу, что агент обдумывает, сейчас планирует, вызывает уже некоторые инструменты, смотрит, какие у меня там файлы. У меня тут ничего нету, абсолютно всё с чистого листа начинается. И я думаю, что сейчас он начнёт всё это потихонечку создавать. А-а, ну что, здесь интерфейс довольно простой. Здесь мы видим файлы. Здесь мы можем, а, вызвать, аа, терминал. А, здесь мы можем увидеть, собственно, файл. Если бы у нас был какой-то файл, мы бы увидели, а, здесь код. Я так понимаю, что это всё равно форк из-кода, судя по всему, просто до неузнаваемости переделано. А задача у нас, значит, а, вроде как выполняется. Посмотрим наш ворде. О, мы уже потратили, а, 2 с по кредита. 2,6 кредитов. Классно. Вот он дал, в общем, план. Я ему говорю: "Оп, а пока тем временем почитаю". Next, установка зависимостей, backend, аа, мультимодальный, а, обработка в мультимодального инпута юзера, оркестрация, стриминг. Ну, в принципе, всё такое довольно простое и понятное. И вот теперь он уже в режиме агент сам переключился и начал уже выполнять задачки. Я так понимаю, что если мы нажмём на working и можем посмотреть, что конкретно он там выполняет, какие команды он запускает, его вот этот внутренний а чек-лист, который, я так понимаю, дублируется вот с этим, да, абсолютно одинаково. Вот я вижу, что в терминале у нас запустился такой agent терминал, где он почему-то не хочет сделать выбор. О, смотрите, я хотел сделать выбор, а он мне говорит: "Это readли терминал". То есть мне нельзя как пользователь там ничего выбирать. Ну тогда, дружище, давай выбирай, определяйся, будешь ты использовать турбопакт или нет. Решил. Так и решился. Ну отлично, хорошо. Может быть, он там думал. Вот уже файлы. То есть вот так мы видим, да, отображается, ну, обычный редактор кода здесь. А что здесь ещё есть из интересного? Я так понимаю, что можно закидывать новую задачу, прямо прописывать и кидать её. Параллельно выполняется, ну, вот в таком асинхронном режиме другая задача. И это хорошо. Мне этого не хватает. Я, поскольку мой основной инструмент сейчас - это кодекс, мне не хватает его вот этом экстеншене нормального такого, а, асинхронного мультизадачного режима. Там всё выполняется в одном чате. Не очень удобно. Вот здесь как-то это всё сделано, а, поудобнее. Так, сейчас выполняется установка зависимостей пакетов, библиотек и прочего. Так, всё установилось, пакеты установились. О'кей. Я думаю, что здесь комментировать особо нечем. А интерфейс очень минималистичный, простой. А, мне кажется, сделан не неплохо. М, довольно интересно. Здесь вот ещё есть закладки, то есть можно несколько проектов, я так понимаю, отдельно открывать, да, и, ну, несколько рабочих директорий можно открывать и работать с ними параллельно. Так, тем временем у нас уже ушло четыре кредита на установку библиотек. Ну, я всё-таки надеюсь, что справится за эти 100 кредитов, потому что задача довольно не сложная, и я думаю, что я увижу в итоге конец, а вы, зрители этого ролика, уже увидели, потому что он с этого начался, и магия монтажа вам уже сразу наперёд подсказала, какой у меня будет результат. А мне это ещё предстоит увидеть в будущем, пока он там трудится, конечно же, как не сказать про тарифы. Семинедельный трайл на 100 кредитов можно залететь сейчас бесплатно. Это примерно 200 запросов к модели уровню Sonet 45 и GPT5, а за 20 долларов мы получим 640 кредитов. Я думаю, что на самом деле это не так много. Они потратятся примерно за 2-3 дня, если прямо сидеть и прямо плотненько так работать. А вот за 59 долларов мы получим 2.000 кредитов. Ну, этого уже может хватить примерно на неделю, а, скорее всего. Ну, и за 179 долларов, я думаю, что это самый адекватный вариант. А, 6.000 кредитов, честно говоря. Ну, не знаю, что тут гадать. А вот какая-то вот есть тут таблица. А это, кстати, очень хорошо, что если, допустим, ты подписался за 19 долларов и, ээ, так скажем, на лайте пользуешься этим, то вдруг в какой-то момент у тебя там пошла нагрузка, тебе нужно что-то срочно пилить, ты можешь просто докупить, допустим, какое-то количество кредитов единоразово, закрыть свою задачу, если немножко там не хватило, и спокойно дальше оставаться на своих 19 долларах. Если ты постоянно просто раскочегарил этого адскую печку, то, конечно, 179 тут без вариантов. Ну либо уже выбирать что-то другое, типа клодко код за 200 долларов. А потому что, ну, по-другому невозможно. И, кстати, я смотрю, что здесь-то, в принципе, за 179 долларов можно получить и GPT5, и, собственно, цена это 4,5. Да. Вопрос именно юзаджи, как, насколько активный usage будет расходоваться, потому что такое понятие кредит, непонятно, что это. Это токены, это это что? Это некая такая валюта. Но я, ребят, прекрасно понимаю, когда ты не знаешь, как у тебя модель будет, сколько она там токенов затратит на решение той или иной задачи, тебе придётся изобретать вот какую-то такую непонятную, абстрактную историю. И действительно, очень сложно юнит экономику сводить в таких проектах. Я вообще не представляю, как они, а, собираются на этом, а, зарабатывать. Но тем не менее, пока я тут болтаю, у нас уже чуть ли не половина задач выполнено. Я думаю, что дождусь, когда, а, полностью закроется уже весь этот чех-лист, и дальше уже, когда будет что-то запустить, мы будем смотреть. Если что-нибудь интересненькое произойдёт, обязательно тоже подсвечу.
Задача говорит, выполнена. Implementation complete. О'кей. А, открывай, говорит, local host 3.000. Ну, давай. открываю, но что-то не работает, потому что надо запустить всё это дело. Запускаем. Стартануло. Перезагружаю страницу. Так, ну, здесь как бы классика, да, вот эта вот. А давайте напишу, что пока я закинул ему прот, чтобы он поправил, как работает тема, мне вот сюда нужно вбить свой perplexity app ключ и open ключ, чем я, собственно, сейчас и займусь. А ключи настроил. Что-то он ещё дотестирует. Тут переключение темы, которое не работает. Ну о'кей, давайте вообще посмотрим, что а он нам сделал. У нас есть папка App, в ней есть папка IP, в ней папка research и это навигация. Компоненты research input, research result. Я что-то не пойму, а что прямо с компонентов что ли он вызывает perplexity? Ну да, ладно, давайте попробуем, попробуем сделать первый ресч. А пусть проведёт исследование по проникновению искусственного интеллекта в малый, средний бизнес в США. О, analucting deep research. Так, в логах у нас ничего особо нету, то есть мы ничего не увидим, что происходит. мы увидим только, а вот здесь conducting synthesizer information, research complete, summary. Источников миллион, но как бы нету а никакого вывода, да, и выглядит это всё стремновато. Давайте сейчас попробуем поправить. Отправляю в промт, но что-то он у него там не доделало по итогу переключения вот этой темы. Ну да ладно, я вот этот вот хочу промт ещё раз отправить. А давайте я сейчас новый таск создам. Новый таск закидываю. А давайте режим, может быть, планера а попробуем использовать. Кстати, что у нас там пожу? Ух ты, за один промт сожрал, ну не один, прошёл, два сожрал, а 50 кредитов. Сейчас вот как раз ещё один промт я ему закинул. Он дожрёт их до нуля. Я поэтому и говорю, что тариф, где тебе даётся там 600.000 кредитов, ну это на неделю по факту. Даже тариф за, а, 179 долларов вам даёт 2.000 кредитов, по-моему. Этого по факту хватит, ну, на 2 недели. То есть средний чек всё равно, как не крути, если у тебя не кодекс от Open если у тебя не аклод-код, это всё равно 400-500 долларов в месяц. Плюс-минус, если ты прямо постоянно работаешь с утра до вечера, с понедельника по пятницу, вот занимаешься этим, то есть закидываешь задачи, оркестрируешь, то будет такой чек либо плоткод за 200, ну или кодекс.
План он подготовил, я ему говорю. На план у нас сожралась ещё десятка или, по-моему, или пять. Ну, моё мнение на текущий момент, что с одного промптал работающее NextGS приложение с интеграцией AISDK, а, Верселевского, где сразу уже встроен Open AI, где сразу подключен Perplexity, да, где-то там не идеально, но у меня и в промте было довольно коря коряво написана вся вот эта архитектура, как там, что ген должен работать. Но в общем и в целом я считаю, что Вердент - это очень интересный продукт. И, наверное, недаром он действительно смог, а, побить остальных там по пенчмарку, потому что, э, наверное, очень грамотно устроена именно мультиагентная архитектура, которая здесь работает под капотом. Вот что с одного промпта у меня, у меня лично такого не было ни в Плоткод, ни в кодекс, ни в курсоре, ни в Wнсрф, ни в Кира, ни в Кодере, вообще нигде я такого не видел. И это просто удивительно. Может быть, да, где-то там и помогает моделька, что это SNET 4.5. Те предыдущие я в основном использовал на 4 и41, но тем не менее вы сами видели результат, что я получил по факту а работающее приложение. Вот этот второй промт, если он выполнит всё то, что я просил, э, я снимаю шляпу. Мне кажется, это очень и очень, а, классно.
Если интересуешься, как тебе вот с помощью агентов, да, на естественном языке, а разрабатывать вот такие приложения, то у меня есть для тебя хороший офер. У меня есть закрытое сообщество, где люди и разработчики, и не разработчики, а маркетологи, продакты, люди, которые работают в найме, они все интересуются, хотят создавать собственные проекты, запускать продукты, они с искусственным интеллектом интересуются. И на именно для таких ребят у меня есть коммьюнити, где мы все помогаем друг другу. Еженедельно выходим на зумы, проводим совместные спринты и делимся опытом. А есть инфа в описании под этим видео. Если тебе понравится, залетай. Буду очень этому рад. Ну а мы давайте дождёмся, что у нас по итогу. Ну а тем временем мы дожидаемся, когда же у нас будет а готовый результат. Здесь смотрите, какое большое количество шагов он проделывает, чтобы одну таску закрыть. А давайте ставлю на паузу и пусть допиливает и там уже будем смотреть, запускать.
Work complete. Честно говоря, заняло это, ну, буквально минут пять от силы. А здесь, кстати, а внизу ещё, а показано с какой сейчас находится здесь внизу показано наполнение контекста, что сейчас 39% контекста наполнено, 79.000 токенов. А step этапы по шагам. Здесь мы можем увидеть все дифы, то есть что в коде поменялось. Это очень удобно. А, а это классная такая тоже фича. Я такой не видел. Может, где-то ещё есть, но я не видел. Здесь как бы такой самри, где что было поменяно. И это очень круто, особенно если вы прямо понимаете, хорошо понимаете, разбираетесь в коде, где что, как вам нужно было сделать. Вот. И вот эта штука, она прямо помогает вам очень быстро так взглянуть, где что он поменял, потом уже углубляться. И самое клёвое, что параллельно с этим, когда задача была закрыта, запускается код review, то есть он проверяет всё на ошибке. То есть, ну, наверное, какой-то тут алгоритм есть. Я пока ещё не знаю, как он устроен. И если всё о'кей, то прямо здесь можно вот одной кнопкой закоммититься, то есть выгрузить, а, сделать такой чек, сделать в репозитории чекпоинт, загрузить там на GitHub или ещё куда-то. И это очень удобно. То есть с точки зрения именно UX, я считаю, что это один из самых удобных редакторов, которые есть. Вот, пожалуйста, вам код Review, где у нас идёт, а вот есть какие must fix, should fix, ну, чисто к ко клодовская эта штука такая. Вот. И это можно будет потом, я так понимаю, использовать для а того, чтобы эти ошибки устранять. Но ладно, давайте вернёмся к приложению, сделаем рефреш и давайте ещё раз то же самое. Всё, отправил. У меня идёт, значит, анализ инпута. Не знаю, что это. А, conducting deep research, но не совсем как бы то. Я хотел как-то вот как-то помоднее, да, чтобы это как в чат GPT было. Но можно сделать, можно, можно дать примеры. Я думаю, эта штука не работает. Вот. А сейчас вот мы можем видеть, что тут происходит. Ну, по идее, там надо ещё, а, докручивать всё это промтами, чтобы весь ризак, все шаги они были в специальных тегах, чтобы они так появлялись, да, как мы привыкли в GPT или в клоте. Список сорсов огромный. И ладно, о'кей. Клод не очень хороший дизайнер, это как бы факт, но сейчас он готовит мне уже а финальный отчёт. Посмотрим. То есть я говорю: "Слушай, мне в прошлый раз он мне выл вывалил эти сорсы, типа сам иди, да? Вот сейчас, по идее, он должен их прочекать, все вот эти вот источники и а дать мне уже репорт. И где он? И где же этот репорт? Репорт это и как бы и может быть он наверху. А вот он наверху, да? Ну как бы да, тут есть и вопросы к пользовательскому интерфейсу, к пользовательскому опыту, но тем не менее Markдаун тут не рендерится ещё. Вот. Но в общем и в целом отчёт а как бы есть. А при том, что я вообще никакие промкты-то не писал. Здесь можно посмотреть, говорит, откуда вообще эти все промты взялись. Вот они. А, я так понимаю, вот здесь промты. Здесь их можно отредактировать. Ну и в целом как бы работает, да, кривокоса по дизайну, но работает, грубо говоря, с двух промтов. А я считаю, что это очень интересный а продукт. Ссылку на него тоже оставлю. Заходите, скачивайте, а-а, и пользуйтесь 100 кредитов бесплатно. А может быть вам понравится и залетит. Если было полезно, интересно, ставь лайк. Это мотивирует записывать ещё видео. Также подписывайся на мой канал, если ещё вдруг не подписался. Ставь колокольчик, чтобы не пропускать уведомления о а новых видео. У меня их ещё впереди а много. Увидимся в следующем видео. Пока.
[музыка]
เฮ
[музыка]