Transcription
Всем привет! Теплица на связи.
Вначале хотелось бы напомнить, что в разделе «сообщество» теперь есть постоянная тема, где вы можете делиться своими мыслями и идеями. Так мы сможем вместе сделать канал ещё более интересным и полезным! И ещё – ваши лайки, подписки на канал и уведомления помогают нам продолжать работу. Заранее спасибо – а теперь – к обзору.
Китайские нейросети взорвали инфополе, поражая своими возможностями и стремительным ростом популярности. Мы просто обязаны показать, на что они способны. Однако остаётся вопрос безопасности: неизвестно, какие данные они собирают и как их используют, а механизмы цензуры могут ограничивать доступ к информации. Поэтому мы не можем рекомендовать их безоговорочно. Тестируя такие сервисы, избегайте ввода чувствительных данных и не используйте основные аккаунты.
Сразу скажу, в этом видео не будет про Deep Seek. Про него уже рассказали, пожалуй, все. Посмотрим на его конкурента.
Qwen — это семейство крупных языковых моделей, разработанных Alibaba Cloud. Первая бета-версия была представлена в апреле 2023 года. Qwen 2.5-Max вышла в январе этого года, и сразу продемонстрировала превосходство над моделями GPT-4o, DeepSeek-V3 в ключевых тестах. Для обычного пользователя, самое главное преимущество – полностью бесплатно. Большинство функций доступно и без регистрации. Она нужна, чтобы получить доступ к генерации видео, ну, и сохранять историю своих чатов.
Основные функции Qwen идентичны аналогам – глубокое мышление, deep research, все это разные названия, принцип один и тот же – нейронка рассуждает и делает логически обоснованные выводы. Выдача результатов, основываясь на результатах поиска в сети. Артефакты. Это такая штука, которая позволяет лучше запоминать контекст разговора и сохранять промежуточные результаты. Пригодится, например, при длинной цепочке запросов, исследования больших объемов данных.
Далее – генерация изображения и генерация видео. Я думаю, показывать, как она работает в обычном режиме – это лишнее, все нейронки справляются с этим плюс-минус хорошо. Попробуем сразу режим мышления. Пусть будет вот такая философская дилемма: Что первичнее? Материя или сознание? Привычно видим ход рассуждений. Уже привычно. А как это было удивительно увидеть впервые у ChatGPT… В итоге, получаем вот такой развернутый ответ, где нейросеть попробовала ответить нам на вопрос с точки зрения разных философских школ и подвела сжатые итоги.
Кроме того, в бесплатной версии можно загружать документы, изображения и видео и работать с ними. Сначала возьмём текстовый файл. Попросим кратко резюмировать его и показать сравнительную таблицу. В итоге, вот такой интересный результат, и довольно структурированная таблица. В исходнике был только закадровый текст к видео про нейронки, которые делают презентации. Кстати, посмотрите, если интересно.
Теперь – работа с изображением. Добавляем со своего устройства. Поймёт ли, что за птица на нём изображена? Проверим. Не самая сложная для задачи оказалась. Нашёл, написал. Хотя, если честно, я проверил. Вот по латинскому названию нашёл. Про биторгу не встретил ни слова. Но, может, нужно было поискать лучше. Пробовал возможности редактировать саму картинку – не может.
Теперь – как работает с видео. Грузим видеофайл. Я пытался сделать субтитры, транскрибировать аудио, но, к сожалению, такие возможности недоступны. Вот выдать краткое резюме – о чём, собственно, это видео – это пожалуйста. Изучил, посмотрел, написал. И, в принципе, всё сходится. Зачем нужны артефакты – я рассказывал.
Посмотрим генерацию изображения. Тут мы видим примеры созданных изображений и можем использовать их промпты как референс для себя. Ещё доступно изменить соотношение сторон. И, в принципе, всё. Открываем. Пишем промпт и смотрим результат. Красиво, но для меня – слишком мультяшно. Хотя, возможно, всё дело в промпте. Сделать больше акцентов на реалистичность, и тогда бы получилось ближе к тому, что хотел. В большинстве случаев – всё дело в промпте.
И теперь главное разочарование лично для меня: генерация видео. Здесь так же – примеры видео и возможность выбрать соотношение сторон. Интересно, а почему нельзя выбрать продолжительность видео, подумал я. А всё дело в том, что у меня так и не получилось его сгенерировать. Три попытки. По полчаса ожидания. И ошибка в конце. Печаль. Если у кого получится – отпишитесь, пожалуйста, в комментариях.
Краткий вывод – с текстами и документами – отлично. Изображения – отлично, потому что бесплатно. Видео – не знаю, не получилось.
Про эту нейронку у нас было большое и подробное видео. Ссылка будет в описании. Но там тестили генератор голоса. Вообще у MiniMax есть три ипостаси: чат, где можно выбрать и модель или deep seek; видео и аудио. Сейчас – про видео. В отличие от первой нейронки – уже не бесплатно, но с определённым количеством кредитов. Точнее – 100. Это бесплатный тариф после регистрации. Платный начинается от 10 долларов в месяц. И там в 10 раз больше.
Итак, Hailuo предлагает два вида генерации: на основе текста и на основе изображения. Попробуем промпт, который так и не сработал в Qwen: «Пиратский корабль в море». В последней модели вы можете выбрать референс для эффекта движения камеры. Задать его сразу. Не так много представлено их, но и не 1-2 тоже. Тем более, это необязательно. Дальше можно попросить усилить свой промпт и добавить деталей. Выбрать модель, оставлю, конечно, более свежую. Ну, и всё. 30 кредитов. Жмём и смотрим. Опять же, не супер реалистично, но я этого в промпте и не прописывал. Видео можно скачать. Даже без вотермарков.
Теперь попробуем на основе изображения. Загружаем ту же неопознанную птицу. Снова выбираем стиль движения камеры. И пишем промпт: «Пусть она у нас взлетит». 30 кредитов. Кто бы она ни была: биторга или нет. Но летать теперь она умеет.
И в заключении ещё одна нейронка, о которой уже рассказывали: Kling AI. Она периодически шумит своими новинками в области генерации видео. Попробовал я затестить видео сейчас. Нейронка сообщила, что видео будет генерироваться больше 3 часов. А ускорить можно – платной подпиской. А вот изображения – это пожалуйста. Также несколько возможностей: либо полностью текстовое описание, либо загруженное изображение как референс. Настроек не супермного: соотношение сторон и количество созданных картинок.
Ну что ж, промпт с бабушкой, который пробовали в Qwen. Пусть всего 2 картинки. Оу, всего 2 кредита. Выгодно. Слушайте, а вот это уже совсем другое дело. Промпт тот же, но два очень реалистичных изображения. Круто. Улучшить качество можно только в платной версии.
Теперь загрузим картинку с компьютера. Согласимся со всеми предупреждениями. И теперь можно работать. Здесь можно уточнить и помочь нейронке определиться: есть ли на картинке лица, например. Дальше можно установить уровень соответствия. То есть если на максимум – то нейронка создаст максимально похожее, минимизируя всякую креативность и прочие вольности. Меняем промпт и время года на изображении. Ого! Целых 6 кредитов. Ну ладно. Можем себе позволить. Итак, птица похожа, снег лежит, зима, видимо, наступила. И в завершении – можно выбрать модель, но, наверняка актуальная будет лучше.
И вот что у нас по платным тарифам: от 7 долларов в месяц 660 кредитов. Стоимость генерации разная, но по тексту было – 1 картинка – 1 кредит. Так или иначе, интересно наблюдать за развитием этих нейросетей. Оправдают ли они выданные авансы и смогут ли составить конкуренцию существующим – покажет время.
На этом всё. Пожалуй, в современном мире самое главное – оставаться людьми. Во всех смыслах.
Александр Рыбаков. Теплица социальных технологий.