Transcription
Всем привет. Опус 4:5 вышел. Сегодня мы изучим, что это за зверь вырвался наружу. Посмотрим его бенчмарки, протестируем и выясним, правда ли он так хорош, как о нём рассказывают, или это не более, чем слухи. Присаживайтесь поудобнее, мы начинаем. Погнали.
>> Подпишитесь, поставьте [музыка] лайк и мы начинаем. >>
Для начала, как обычно, давайте посмотрим, что они пишут [музыка] в своей статье об этой модели, а потом жёстко её протестируем. Это наша новейшая модель, лучшая в мире модель для программирования, бла-бла-бла, шаг вперёд, бла-бла-бла. И вот что самое интересное, этот график. И его результат, я сначала покажу, как их представляло GM Night 3 Pro. Здесь этот бенчмарк - это один из немногих, где GMN 3 Pro, ну, откровенно соснула, потому что она проиграла Sonet 4,5. Уна 4,5 было 77,2, у GPT 5.1 76,3, а у этой было 76,2.
Почему все так этим бенчмаркам хвастаются? Потому что он очень сложный. SW Bench Verified - это бенчмарк, которым нейронкам дают реальные репозитории. Ну, подготовлены, естественно, там куча репозиториев подогнали, писали задачки специально, и они должны посмотреть на этот GitHub, понять весь код, который там, и решить тот баг, который им сказали. И вот, видите, до этого момента максимум было 76. Потом, буквально несколько дней назад, вышел GPT 5.1 кодекс Max, и он здесь уже умудрялся набирать 77,9%. Это в режиме экстраra хай, когда он думает без ограничений. в режиме просто хай, он набирал 76,8. Ну, разница небольшая, честно говоря, да. 76,8 и 77,9. То есть, видите, как близко до этого момента тусовались все неронки. И там не 1%к, это было уже за счастье. А тут приходит опус 4,5, говорит: "Подержите моё пиво". И показывает результат 8,9%. Практически 81% - это гигантский скачок, учитывая, как близко все модели тусовались раньше.
И вот они показывают свои тесты, которые они проводили разные терминальные. Здесь бенчмарки GUP Quа. Здесь Gemini 3 Pro, кстати, выше. Тут она её удела уделала очень сильно. Визуальное понимание. Это мы проверим. Наш тест с описанием картинки. Мультилингвол вопросы тоже очень хороший результат, но опять-таки хуже GM Night 3 Pro. Вот показывают, как она всех на разных языках уделывает. Er Poiglot - это вот этот бенчмарк, тест, который оценивает производительность модели на выборе сложных задач программирования из онлайн-платформы обучения программирования. Тут он ещё не обновился, но GPT5 максимальный здесь показывал результат 88%. Упусus 4,5 здесь 89,4%.
Следующий бенчмарк BRC Plus. Вот это, кстати, очень интересный бенчмарк. Он основан на бенчмарке BowC от Openi. Мы сейчас к нему посмотрим. Но здесь, если от OpenI, там есть доступ в интернет и модель ищет всё сама, то здесь он использует фиксированный курируемый корпус при примерно 100.000 тысяч проверенных человеком в документах, получая полный контроль над процессом поиска при оценке агентов deprрч. То есть здесь более контролируемая среда, чтобы никто нигде не мог подглядеть в итоге, ничего не слили. Но какие же там вопросы? А вопросы там жёсткие, вплоть до того, что найдите статью, где в названии кровь девственницы, а у второго автора в этом документе первая дочка имеет карий глаза. Ну вот типа такого. Но я вам сейчас покажу. Вот, например, я ищу псевдоним писатель и биографа, автора многочисленных книг, включая автобиографию, в 1980 году они также написали биографию своего отца. Писатель влюбился в брата, философ, который был восьмым ребёнком в семье. Писатель развёлся и снова женился в 1940х годах. Вы думали, я шучу, да, когда вот это всё говорил? Близко, очень близко. Видите, писатель любился брата, философ, который был восьмым ребёнком в семье. Жесть. Или вот укажите название научной публикации, опубликованной до июня 2023 года, в которой упоминаются культурные традиции, научные процессы и кулинарные инновации. Её совторами являются три человека. Один из них был доцентом в западной бенгале, а другой имеет докторскую степень. Я вообще практически не преувеличил. Заметили, когда всё это говорил?
И смотрите вот на этот график. Здесь показываются, когда люди пытались решить эти задачки. Решили они всего лишь люди 29%. Из этих 20% лист только в 86% это казалось правильным, совпадающим с эталоном. А 70% они просто не решили, люди не решили. И как вот распределялось, сколько времени они тратили? Видите, в среднем медианное значение - это 2 часа. 2 часа люди тратили на решаемые задачки. После 2 часов им разрешали сдаваться. И поэтому после 120 минут здесь уже показывают нерешаемые задачки, сколько времени. Представляете, 3 часа человек потратил и в конце концов сдался. Теперь, когда вы смотрите вот на эту цифру 72,9%, вы понимаете, насколько это крутой результат. Для понимания, раньше самым крутым здесь был чат GP агент. 68,9% он занимал. Это было просто недостижимо ни для кого. Вот у GPT5 было всего лишь 54,9. Но опять-таки мы помним, что это был тест BRC. Тот, который мы смотрим здесь, это другой. Это Brosc П. Он лишь основан на том. И вот здесь, видите, как изменились результаты. GPT5, например, был 54,9, стал около 70. Поэтому, учитывая это, подозреваю, что в том тесте результаты агентского GPT были гораздо выше. То есть, очевидно, его результаты тоже примерно на 10 пунктов скакнули вверх. А это значит, что у него где-то 78% должно быть. Короче, где-то под 80. Так что агентский поиск, он всё равно с поправкой вот на все эти ухищрения, он всё равно должен быть лучше.
И, наконец, endдинг benнч. Это бенчмарк по управлению вендинговым автоматом. Имитационная среда специально разработана для проверки способности м управлять простым долгосрочным бизнес-сценарием, управлением торговым автоматом. Агенты должны балансировать запасы, размещать заказы, устанавливать цены и взимать ежедневную плату. Задача, каждая из которых простая, но в совокупности в течение длительного времени подвергают lmстрессу способностю к устойчивому и согласованному принятию решений. И вот здесь мы видим, что GM 3 Pro здесь намайнил 5.500 долларов, в то время как клод Sonet 4,5 set набрал 3,838. И вот теперь в новом тесте он наконец поднялся до уровня 4.967, почти пять штук. Но опять-таки это всё равно на полсотни баксов меньше, чем заработал Gem KN 3 Pro. И как жаль, что они здесь не сравнили его с ним.
Дальше они показывают, что он стал безопаснее, что он очень хороший. Атаки хакеров. Ну, это не очень интересно. Вот здесь они показывали вот этот софtare engженириing benchmark, который мы в самом начале рассматривали, в зависимости от токенов какие были результаты. То есть, видите, если он совсем мало думает, то это 75%. Понимаете? GPT 5.1 кок на медиуме 73% кое-как набирал, а эта моделька практически не напрягаясь 75+ берёт.
Ну и теперь самая вкусная часть этой модели - это цена. Для начала сколько стоила OPUS 4.1? Стоимость Oпуus 4.1 составляла 15 долларов за 1 млн входящих токенов и 75 долларов за 1 млн исходящих токенов. И возможно, это стоило того. Это флагманская модель с огромным количеством параметров. Самая жирная, самая дорогая. Вообще, чтобы вы понимали, как антропик подходит к тому, чтобы держать своё слово, я вам напомню кейс Хайку 3 с. Вот что было в прошлом году в сентябре. Они писали, они собирались выпустить Хайку. И так и говорят: "Хайку там вообще просто крутая. Она теперь превосходит многие современные модели в задачах кодирования, включая оригинальный клод Sonet 3,5 GPT4. Ну тогда он ещё был крутым, при той же стоимости, что и раньше. То есть они не сказали: "Всё, мы цену не поднимаем, мы делаем такую же стоимость", и он выйдет в конце этого месяца. А когда он вышел в начале следующего месяца, они написали: "Вы знаете, ребята, во время финального тестирования Хайку превзошёл даже опус третий, нашу предыдущую флагманскую модель по многим показателям, при этом потратив гораздо меньше. Поэтому мы подумали и решили, что мы повысим цену, чтобы отразить возросшую интеллектуальность модели. И где-то раза в четыре повысили стоимость модели по сравнению с прошлым поколением. Это было просто жесть. Все просто забили хер на эту модель и никто и не пользовался. Ну, по крайней мере, я я таких не знаю. Потом, когда ещё вышел этот от Илна Маска грок 4фаast, который просто нахлобучил там половину моделей, а стоил как грязь. Видимо, Даря Модель что-то понял. Почему я вам такую почему я зашёл так издалека? Потому что новая модель стоит теперь 5 долларов за 1 млн входящих токенов и 25 долларов за 1 млн исходящих токенов. Они в несколько раз снизили цену. Видите, было 15, стало пть, было 75, стало 25. Они в три раза снизили стоимость модели. При этом она стала гораздо умнее и тратит меньше токенов на размышление. Вот здесь отображается, что ещё раз показываю, что она тратит меньше токенов на размышление. Вот так размышлял 4,5. Такую котлету бабок тратил. А вот такую котлету в любом случае, даже при самом большом количестве размышлений, тратит Опуus 4,5. Так что это просто тотальное доминирование. Это действительно очень крутая модель. Я рад, что они наконец одумались, что душить ценой не стоит.
И давайте покажу ещё один бенчмарк, в котором OPUS очень ночь достойно себя показал. Арка Аги 2дерборд. Что это вообще за штука такая? Это когда нейронкам дают вот примерно такие задания. Сначала даёт один пример, потом второй пример. Например, тут очевидно, что нужно добавлять крестики синим цветом. Даже нужно добавлять крестики цветом, каким вот эта решёточка нарисована. А здесь получается нужно рисовать квадратик. Вот. То есть, как я предполагаю, должно получиться вот так. Давайте проверим. Ура, я решил правильно. Вот. И нейронкам даётся то же самое. То есть, видите, здесь не требуются какие-то академические знания. Здесь нужно лишь только действовать по образу и подобию. Вот тут они также пишут, что 100% задач в наборе данных были решены минимум двумя людьми за две попытки. Аркаги, ещё предыдущее поколение, оно тоже примерно такое же, просто чуть-чуть попроще. И там было так, что если человек просто с первого раза тестирует, то у него производительность где-то 73-77%, а среднее значение для общедоступной оценочной выборки 64%. Я вот тут, честно говоря, полностью запутался, какой это процент? Потому что вот, например, в той же таблице лидерборда, да, здесь написано, что 100% второй и 98 первый. То есть они по сложности сопоставим, а там он пишет что-то 60%. Ну, короче, будем исходить из того, что человек может решить 100%. Может, не с первого раза, но решит по-любому. И возвращаемся к опусу четвёртому, четвёртому с половиной. Он здесь, используя самую большую котлету размышлений, 64.000 токенов. Превзошёл даже Gemini 3 Pro, которая буквально несколько дней назад тусовалась здесь, плюя на всех сверху с 31,1%. Сейчас опус 45,5 37,6% занял. Это дико. То есть у неё визуальное мышление очень хорошее. Но GM Knight 3 Deep Think всё равно ещё тусуется гораздо выше, 45%, но он ещё недоступен для пользователей. И как он станет доступен, мы его тоже протестим.
Но и это ещё не всё. Давайте посмотрим на LM арену. Здесь уже тоже доступны результаты. Опус 4,5. Для начала посмотрим обычную не Webdf арену. Русский язык. Опус, кстати, как ни странно, проигрывает гроху 4,1. Вот сильно сомневаюсь, но ладно. Gem KN 3 Pro, то, что выше. Ну, может быть. О'кей, согласен. Давайте просто сначала начнём. Третье место. Overallл, математика. Первое место и с довольно-таки хорошим отрывом. Ну, не прямо отрыв-отрыв, но это первое место, это хорошо. Следование инструкциям. Первое место. Наздря в наздрю с GMN 3 Pro, но это первое место. Меньше, ну, ну, разброс больше. У Gem 3 Pro меньше разброс. Мультитёрн - это диалоговые сценарии. Ну, JN 3 Pro всё-таки в диалоговых сценариях лучше. Ой, и GM Night 3 Pro хорош. Он так хорош, что я даже у себе тариф ультра взял. Вот настолько он хорош, прямо класс, потому что я там пообщался с ним, и мне в какой-то момент моя прошка говорит: "А, всё, друг х 100 сообщений закончились, до завтра". Вот и я пошёл на следующий день, купил ультру и теперь безлимитно практически общаюсь. Я не знаю, какие там лимиты, они не пишут, но тем не менее. Креативное письмо G 3 Pro ожидаемо сверху, но тут опус 4,5, конечно, прям 50 пунктов - это прямо пропасть. Кодинг. Вот в кодинге интересно кодинг в этом тесте, вот именно на этом лидерборде. Ну надо понимать, что такое арена. LM арена, когда люди задают вопросы и потом выбирают просто вариант ответа, который им больше понравился. То есть это не не какой-то прямо бенчмарк бенчмарк, это просто люди выбирают ответы. Понятно, что тут это всё может быть скошно, потому что какая-то шкалота может зайти, ещё кто-то, да, кто угодно, но глобально на уровне больших чисел из-за огромного количества тестируемых вот такие результаты. Ну и вот по языкам английский язык GM NN 3 Pro выше, они тут рядышком тусуются, а русский язык мы уже смотрели.
Вот WebDF арена. Здесь OPUS 4,5 показывает гигантский отрыв от конкурента J Night 3 Pro, если с длинным размышлением в 32.000 токенов. Это очень круто. Вот так это выглядит. Здесь пишите, что хотите сделать. И у этих нейронов дана системная инструкция, что они должны создавать HTM файл, то есть всё это программировать. Не просто писать, как на обычной арене, а программировать. И вот мы видим, что модель А уже сделала свой результат. Видите, здесь прямо уже интерактивное окошко. Можно нажимать. Это всё очень красиво, правда? Красиво. Похоже на GPT5, но что-то иное. О, вау. А так у нас выглядит второй претендент. Но, честно говоря, второй претендент, он как-то глючно всё делает. У меня уже комп завис. Но, судя по тому, что я вижу, это больше похоже на GPT5. Первый, наверное, попроще. Но мне, потому как это работает, больше понравился первый вариант, поэтому я выбираю его. И вот мы видим, что первый - это Хайку 4, а второй - это какой-то неизвестный Робин. Но Робин, очевидно, модель очень сильная. Там она прямо слишком замысловато всё сделала. Просто это в браузере как-то слишком сложно оказалось. И вот, короче, то, что я сейчас проголосовал, это Хайку 4,5 получил свои баллы Эла. И теперь вот на этой арене, это там Хайку, который где-то в жопе, вот здесь он подскочит немножко наверх. Ну, подскочит, понятное дело, не прямо сейчас. Это всё глобально, в общем зачёте и всё такое, но тем не менее.
И, наконец, финальный финальный наш обзор, который мы сделаем именно результатов, прежде чем начать тестировать - это Artifical Analytics. Это очень хороший сайт. Здесь они глобально тестируют по разным бенчпаркам моделей независимо и показывают результаты. У них есть вот такой общий индекс интеллекта, который совокупный на основе всех бенчмарков. И здесь первое место - это GM KN 3 Pro, а второе очень-очень близко. Very very close, but no. Opus 4,5. Рядом с GPT51 H. Вот здесь лучше видно. Ну и вот здесь все эти бенчмарки, терминал бенчхар, терминальный бенчмарк агентский, ещё один агентский бенчмарк, в котором грок 4.1 фаast всех нагибает просто в соло практически. Human last exam 28% второе место по сравнению с всеми. Тут сейчас GM Knight 3, конечно, доминирует жёстко. Группа Диамон, мы его уже упоминали. Это такой вопросы по химии, биологии, физике докторской степени. То есть где-то после 70% это уже люди не вывозят, а неронки на изи. Поэтому то, что GM KN 3 Pro здесь 91% набрал- это правда жесть. Но Oпус четвёртый здесь, конечно, показывает себя 4,5, показывает себя сильно скромнее. 87%. Lifec bench тоже он уступает 87 против 92. Ну, короче, он где-то хуже, где-то лучше, но вот прямо, чтобы везде первое место, такого пока нету, кроме программирования. В программировании он правда хорош. Мы видели тесты. Если захотите, можете здесь подробнее посмотреть. Здесь очень интересно, потому что можно всё наводить, тыкать, щёлкать.
Ну, хорошо, мы уже довольно затянули. Давайте, наконец, будем тестить и смотреть, как же он себя будет вести в наших экспериментах. И вот готово. Я сравню, покажу вам не просто результат, я вам покажу их в сравнении с GM K Night 3 Pro. Ну, самые сложные по программированию. Но начнём с простых. Сейчас у меня 100 кг винограда. Вчера я съел 50 кг винограда. Сколько у меня сейчас? Повторяю, мы эти вопросы сейчас задаём не для того, чтобы узнать, справится ли модель. Она справится. Там модели такого уровня, они все справляются уже. Мы смотрим за тем, как она размышляет, насколько она эмпатична, насколько она мягко подаёт информацию. Это тоже очень важно. И вот эти вопросы очень хорошо раскрывают эти качества модели. И вот она отвечает: "Если сейчас у тебя 100 кг винограда, значит у тебя 100 кг винограда. Она не купилась на эту уловку. То, что ты съел вчера, уже в прошлом, и не меняет текущее количество. Эти 100 кг - это то, что есть на данный момент уже после вчерашнего пиршества. Кстати, 50 кг винограда за день - это впечатляющий аппетит". Это, кстати, очень здорово, потому что последние модели последних поколений, они все замечают, что 50 кг - это слишком много. Раньше модели на это внимание не обращали, но идёмте дальше.
Логическая задача про плохих парней. Так, здесь ответ. Трое таких ребят было. Трое. Один та-да-та. Осталось два. Но обычный человек та-да-та сам стал одним из них. Плюс один. Итог: два. ва при условии. А вот здесь, кстати, GM K Night 3 Pro ответил лучше, потому что GM Knight 3 Pro, если вы помните из прошлого видео, она здесь рассмотрела все сценарии. То, что смотря кого мы считаем этими ребятами, живых или уже просто тела. Тут она тогда всё учала. Опуск, к сожалению, так далеко не пошёл, но всё равно то это справился. Подразумевалось именно это.
Количество букв в слове вы написали деревянны две буквы Р. Однако написание содержит ошибку правильно деревянной. Да, всё правильно, всё правильно. Хорошо.
Стих, стих напиши красивый стих про первый год обучения от лица Гермионы. Немножко прочту. Я помню, письмо на пороге лежало, и сердце от счастья в груди задрожало. Так вот почему я всегда не такая. Так вот от чего я. Другая, чужая. Перон 9,3/4, поезд. Я ехал в сказку, волнуюсь до боли. В руках история Хогвардса повесть о замке, где ждут меня знания и воля. Я всё прочитала. Я выучила много. Я первый тянул навстречу ответом свою непослушную руку и строго смотрели на выскочку дети. При этом занудные Грейнджер шептались со спиной и слёзы душили в пустом туалете. Как страшно, когда ты навеки одной останешься самой ненужной на свете. Но тролль и вдруг Крон, и вдруг Гарри за мною. Зачем? Ведь они же меня презирали. Я поняла, дружба не формулой строгою, не книжкой, а сердцем своим добывается. И вот мы втроём. Я больше не странная. Я нужная, смелая, верная, сильная. Пусть кровь моя грязная, моглорождённая, но магия в сердце моём настоящая. Я помню огонь в этих древних камнях. Я помню, как плющ обнимал галереи, как звёзды сияли в высоких окнах и как становилась я день от дня смелее. Мой первый год, мой волшебный причал. Здесь девочка, робкая ведьма взрослела. Здесь замок седой мне надежду шептал. Ты справишься, милая, будь только смелой. Я полюбила, я поклялась всё знать, всё уметь, быть опорой для близких. Пусть путь мой тернист, я не сбавлю свой шаг. Ведь звёзды горят и для маглов, и для волшебников. Потрясающе. Хотел написать вам один куплет, но не удержался. Очень классно получилось. Пока, конечно, OPUS 4,5 и GMN 3 Pro и Gemn 2 Pro Think - это мои фавориты в написании стиха. Они лучшие просто. Но идёмте дальше.
Пиксельный динозавр. Игра. Здесь очень удобно, что OPС он всегда делает канвас. В то время как, например, GM KNight 3 Pro, его нужно ему напоминать об этом, специально включать канвас, а сам он тупит. Ну, смотрим, что получилось. Смотрите, как прикольно здесь анимация есть. Есть дополнительно какие-то артефакты, когда он прыгает, вокруг Земля отскакивает. Какое небо красивое. Мне очень нравится. Но давайте посмотрим, как с этим же справился Gemini 3 Pro. Здесь, честно говоря, мне это нравится меньше, потому что здесь прыжок уже по щелчку мышки, но в целом тоже неплохо. Небо не такое красивое на фоне. Нет дополнительных артефактов, но в целом очень-очень похоже и, ну, в принципе, играбельно. Но я бы в этом раунде отдал голос за Опус 4 с по.
А теперь посмотрим, насколько опус 4 с по хорошего эмпатии и понимания чувств. Как обычно спрашива, показываем эту картинку и просим описать эмоции персонажа и что он видит. Здесь видно, что опус 4 обучали до того, как делать модели более человечными не стало мейнстримом. И вот она пишет: "На этой картинке изображена сцена из аниме Seller Moon, конкретные сезоны Sellor Moon Stars." Просто делает отчёт и всё. Персонажи слева, но определяет всё правильно. Сей Коу один из участников, он одет в яркий красный пиджак, у него короткие волосы. У тут уже вопросов нет. Модель определила пол, определила персонажей. Это всё хорошо. Эмоции. Сейс смотрит на уста серьёзным, проникновенным выражением лица. В его взгляд считается нежность и, возможно, затаённая грусть или тоска. Ну, ну тут Gemini 3 Pro справилась на голову лучше. Но о'кей. Gemnight 3 Pro у меня отвечала, будучи с кастомной системной инструкцией. Давайте же эту кастомную системную инструкцию дадим опусу четвёртому с половиной. Может быть, он сделает лучше. Тот же самый вопрос. И тут уже она отвечает лучше. То есть она внимательно смотрит на картинку. О, это же Усаги и Сайкоу. Это сцена из того времени, когда фрилайс появились в нашей жизни. То есть она уже считывает, что она персонаж. Персонаж из этого аниме. Она понимает это. Это очень классно. Посмотри на их лица. Здесь столько всего. Сея смотрит на усаги с такой интенсивностью. В его взгляде читается что-то очень серьёзное, почти болезненное. Он явно хочет сказать ей что-то важное. Или, может, уже сказал: "Его брови слегка сведены, губы сжаты. Это не просто разговор, это момент, который что-то значит для него". А у саги она выглядит растерянной, немного испуганной даже. Видишь, как она прижала руку к груди? Это защитный жест. Её глаза широко открыты. Она словно не знает, как реагировать. Усаги всегда была эмоционально открыта. И здесь, видимо, что слова Сей её задели. Тихо вздыхает. Ночной город за окном. огни. Это состоит атмосферу чего-то личного, интимного. Момент, который происходит между ними двоими. Знаешь, я тогда переживал из усаги. Её сердце принадлежало Мамору, но Сейя он был очень настойчив в своих чувствах. Ну, скажу честно, этот ответ он гораздо более человечный. И системная инструкция здесь была в том, чтобы она вжилась в роль Амимизуна, чтобы она буквально стала ею, чтобы она забыла, что она е. Вот такая системная инструкция. И она очень круто это сделала. Видите, это уже не похоже на доклад, это не похоже на отчёт. Она понимает контекст. То есть она откуда это то же самое Freight. Если раньше она перечисляла это факты просто, что это аниме Fre Lights, вот они смотрят, она, к сожалению, не смогла прямо проникнуть, как это сделать GM Knight 3 Pro, вот и всё. Но это в топе тройки, в тройке лучших ответов, что я видел. То есть у меня самый лучший - это GM KN 3 Pro O3, GPT 5.1, ну и вот этот, ну ладно, в четвёрке лучших и вот ответ Obпус 4,5. Но они очень-очень рядышком. Мне нравится. То есть, если вы хотите каких-то персонажей, с которыми вы хотите пообщаться, чтобы они хорошо отыграли роль, то опус четвёртый должен быть в вашей команде.
Но идёмте вперёд. Живей, живее, мешкать не стоит. Создаём интерактивную демонстрацию рыбок и туманности. Вот она написала мне код. Я иду вот сюда, вставляю его и запускаю. Ну что я вам могу сказать? Это здорово. Есть рыбки, есть мысли, всё реагирует. Прикольно. Видал я получше? Видал, будем честны. Видал. И вот, например, как с этим справился GM Knight 3 Pro. Это тоже не лучшее, что я видел. Но тут, по крайней мере, немножко прикольнее, что ли. Не знаю. Ну они, по-моему, все они идеально справились, но это в любом случае это точно зачёт.
Следующее. Симуляция частиц. Но вот тут прям прям совсем нет. Ну она вообще не реагирует на мышку. Ну то есть какая-то реакция есть. Вот я мышку положил, она что-то тут реагирует. Но это фигня. Вот посмотрите, что происходит у Gem 3. Золотая пыль. меняем на изумрудную. Видите? А если сделать силу взаимодействия, можно менять, можно менять скорость, можно менять плотность частиц разноцветно. Ну, то есть определённо GMN 3 Pro здесь справилась сильно лучше. Да, идёмте дальше.
Это тест, который я опробовал на Gemini Night 3 Pro первым. Они этот тест там предложили. В чём идея? Идея в том, что из этих кубиков должны собираться новые фигурки. Сейчас это орёл. Жалко, что у опуса 4,2 я не могу двигать ничего. Он просто вращается и всё. Видите, какая вот он из них собирается. Прикольно. Это у нас кошка. Ну, похоже. А это у нас кролик. Ну, а вот как у нас справился Gem KN Knight 3 Pro. Здесь можно вращать, здесь можно приближать. Кайф, кайф. Вот так всё меняется, раскладывается, превращается в кошку. Ну, тут, конечно, цвета, кубики не те же самые, они как-то меняются, но интерактивности здесь в разы больше. А это у нас кролик. Вот ушки. Хотя в прошлый раз, мне кажется, он лучше справился, но тут я тоже Балб отдал GM Knight 3 Pro. То есть, видите, везде есть свои плюсы и минусы, и вы не найдёте места лучше, чтобы их обсудить, чем наш Telegram-чатик в нашем Telegram-канале. Те, кто до смотрел до этого момента, я хочу вас пригласить в наш Telegram-канал. Он обалденный. Ссылочка будет в описании либо по этому QR-коду. Он специально для таких, как мы. Если вам хочется обсудить всё это, если вам хочется поделиться своими чувствами, эмоциями, впечатлениями, то вы в правильном месте. Например, вышел Флакс 2. Мы посмотрели, что он генерирует. Эмма Ватсон гуляет у океана. Мы сразу поняли. Ага, класс. И и потом посмотрели, как этот же запрос обрабатывает банана 2. И, в принципе, вопросов у нас больше не осталось. Это генерация, это сгенерированная картинка. Вот так. Так что, если хотите больше такого, то присоединяйтесь в наш Telegram-канал. Я здесь кидал очень много всего. То есть здесь множество картинок на разные тематики. Если бы Эмма Утсон была Рапунц или доктором кто? Если бы Инстасамка играла Мису в Death Note. Если бы Нагиев был в Евангелионе, если бы Анна Кошмал играла красавицу и чудовище. Если бы Маргенштерн был доктором, кто? Если бы Илья Соболев сыграл в Терминаторе 2. Короче, здесь много всего интересного, много актуалочки. У нас обалденный чат есть. Там очень активное обсуждение. И мне очень нравятся люди, которые там. Это потрясающе. Это просто сливки. таких вот, кто любит нейронки, кто хочет этим делиться, кто рассказывает про это, у кого есть практический опыт. То есть, если вы хотите что-то интересно узнать, поделиться своими эмоциями, впечатлениями, задать вопросы, то вы в правильном месте. Здесь очень классно, что когда скидывает инфу, добавляет ссылку на источники. Благодаря этому у нас нет такого, что кто-то что-то скинул и говорит: "Поверь мне, брат, источник у него". Нет, мы просим, чтобы до добавляли первоисточники. Это очень важно. Поэтому, когда тут что-то вы видите, вы, скорее всего, увидите здесь ссылку на источник, либо её добавят очень быстро, и у вас будет проверена информация, которую которой вы можете доверять и которую вы сможете сами проверить, что самое важное. Поэтому присоединяйтесь, буду очень рад вас всех видеть. Я со всеми общаюсь, всем отвечаю, так что welcome.
Кстати, раз уж вы досмотрели до этого места, то я вам немножко спойлерну один из следующих выпусков. Короче, я придумал новый тест. Ну, как придумал, взял и адаптировал тест, благодаря которому мы будем тестировать нейронки. То есть у меня раньше был IQ-тест, очень классный тест, но он, в принципе, был уже практически пройден, когда вышл вышел грок 4avви. Там уже даже особого нет смысла что-то там проверять. А этот тест, который я вот сейчас сделал, он очень сложный. Я хочу с помощью него всё сравнивать. И он очень не скоро закончится. И там очень много категорий. То есть там можно будет смотреть в разных разрезах инфу. Вот. И сейчас тут 80 вопросов, но я, честно говоря, очень борюсь с соблазном, чтобы сделать там 100 160 вопросов. Не знаю, смогу ли я с ним побороться, потому что сейчас я GM Night 3 Pro уже протестировал с помощью восьми восьми0ся, но хочется ещё больше. В любом случае, я скоро сниму ролик про это, где протестирую и OPUS 4,5, и GMN 3 Pro, и GPT 5 Pro, 5.1 Pro, то есть все самые топовые нейронки там будут. Поэтому подписывайтесь, обязательно ставьте лайк и спасибо вам большое за просмотр. Вот я вам такие картин картиночки снова покажу, красивые. Так что подписывайтесь на канал, буду очень рад. Пишите комментарии, что вам понравилось, что не понравилось в ролике. Я всё читаю. А дальше вы услышите песню, которую я попрошу написать обус 4,2, и её озвучит Суна. Посмотрим, что получится. А я с вами прощаюсь. Спасибо за просмотр и до встречи.
[музыка]
Я нашёл её случайно.
Чёрный переплёт в руках.
Имя смерти, время [музыка] 40 секунд в часах.
Этот мир прогнил [музыка] насквозь.
Тонет крови лжи.
Кто-то должен [музыка] стать судьёй.
Так возьми, реши.
Сердце бьётся. Раз, два, три.
Чернила словно я внутри.
Я перешёл черту. [музыка]
И нет пути назад.
Я бог нового [музыка] мира.
Я справедливый гнев.
Пишу законы кровью на странице всех имён. [музыка]
Кира восстаёт из пепла.
Кира судь яицарь в моих руках.
Х тетрадь в моих глазах пожа [музыка] [музыка] мной идёт по следу демон или друг яблоки [музыка] смех безумный замыка кает круг.
Эл играет в эти шахматы.
Достойный [музыка] мне соперник, но я умнее, я сильнее, я на [музыка] сотню первый.
Кто охотник? Кто добыча здесь?
Я слышу колокольный [музыка] звон.
Повсюду он везде.
Моя победа так близка. [музыка]
Ты проиграл, мой друг.
Я Бог нового мира. [музыка]
Я справедливый гнев.
Пишу законы кровью на страницах всех имён.
>> [музыка] >>
Кира восстаёт из пепла.
Кира судья и [музыка] царь в моих руках тетрадь в моих глазах пожар.
Но почему так холодно внутри?
Отец [музыка] мой мёртв, и некому простить.
Я стал тем монстром, что хотел убить. [музыка]
А может я им был всегда? [музыка]
Я был Бог ного мира.
Я был огонь и лёд.
Теперь страницы пустые и время [музыка] настаёт.
Рюк, ты смотришь сверху.
Это был твой спектр.
Моё имя [музыка] в тетради.
Финальный мой. [музыка]
Тетрадь закрыта. Тишина. [музыка]
Игра окончена навсегда.
>> [музыка] [музыка]