Transcription
Дорогие друзья, на нашем канале мы рассказываем про разные инструменты искусственного интеллекта. И, конечно же, я люблю рассказывать про инструменты от компании Google. Их множество. Это огромная экосистема, которая включает в себя много разных очень крутых и топовых на сегодняшний день в мире инструментов искусственного интеллекта.
Сегодня мы рассмотрим 10 крутых фишек, 10 крутых функций от разных инструментов искусственного интеллекта Гугла. В частности, мы рассмотрим пять ключевых. Первое — это Geminii. Второе — Google AI Studio. Третье — это всеми любимый ноутбук LM. Четвёртое — это А Flow. И пятое — это Google Labs. Внутри мы будем использовать такие модели и функции, как Nano Banana, Google VO3, Gemini Pro 3.0 и многие другие.
Итак, давайте погрузимся более подробно. Кстати говоря, на нашем канале много уже более подробных видео про отдельные инструменты Google, поэтому подписывайтесь, переходите и смотрите их. Это очень полезно, особенно для бизнеса.
Итак, давайте рассмотрим первую из десяти фишек Гугла, а именно быстрый анализ summory и транскрибацию любого видео из YouTube. Допустим, у вас есть какое-то видео, вам нужно его быстро проанализировать, изучить, оно длинное, и у вас нет времени. Работает это следующим образом. Мы заходим в Gemini по ссылке gemini.google.com. Здесь мы поставляем promт в окне ввода. Посмотри это демо и извлеки каждую упомянутую функцию, организовав их по категориям. Вставляем ссылку на YouTube, используем моде модель fast, потому что она быстрее, и запускаем в работу.
Далее он берёт это видео по ссылке, которую вы ему даёте, а его полностью сам анализирует, а неважно, какой оно будет длины, сколько оно будет там весить. Далее, по итогам подробного анализа, он извлекает все нужные вам вещи, которые вы задавали ему в промпте. В частности, он нам полностью перечислил функции, функционал, который описывается в этом видео. И также, что важно, он указал тайм-коды. Мы можем перейти по тайм-коду и попасть на нужный нам указанный здесь конкретно фрагмент. Также здесь указывается само видео, ну и, соответственно, ссылки на эти тайм-коды.
Следующая функция номер два — это Gemini storybook, а, то есть это превращение сложных каких-то документов, инструкций, текстов, файлов в очень упрощённые, лёгкие, понятные, красивые, простые сказки. Сказки или какие-то книги такие с иллюстрациями, с понятными, которые будут очень доступны и понятны любому, даже самому далёкому от этой темы человеку. То есть также в этом же окне с полемвода вставляем про М. Преврати эту историю о новом сотруднике, который учится безопасно обращаться с данными клиентов. Сделай её увлекательным и включи а иллюстрации. И далее мы просто импортируем файл, а именно политику конфиденциальности.
То есть, допустим, вы занимаетесь бизнесом и вы работаете с клиентами. И очень важно соблюдать законодательство о персональных данных. И ваши сотрудники должны обязательно этому законодательству следовать, поскольку если вы нарушите каким-то образом и допустите утечку персональных данных ваших клиентов, то за это вас могут привлечь к ответственности, вплоть до уголовной ответственности по законодательству разных стран. Поэтому, чтобы ваши сотрудники не читали, а обычно никто не читает эти огромные документы и инструкции по конфиденциальности, тогда вам нужно просто взять эти инструкции, залить их сюда, в эту нейросеть, задать ей этот промт, и тогда он превратит эту сложную инструкцию по правилам конфиденциальности и безопасности в простые понятные, а, сказки, в простые понятные иллюстрированные книжки на простом понятном языке.
Давайте посмотрим. Итак, мы видим, что он сгенерировал нам такой иллюстрированный рассказ в форме книжки. А листая эту книжку, мы видим, а, что здесь есть определённые фрагменты текста и также картинки, иллюстраций. То есть тут получилась у нас такая интересная история, которую ваш сотрудник может прочитать. Ему это будет легко, а будет интересно и понятно. Тут обо всём самом важном из вашей инструкции будет написано, что есть какие-то определённые требования. что необходимо их соблюдать, какие именно это требования, в чём суть и так далее. А, и каждому из этих фрагментов он генерирует иллюстрацию. Соответственно, такую же аналогичную функцию можно использовать как в бизнесе для себя, для ваших сотрудников, для ваших клиентов, так и для ваших детей. Например, у вас есть какой-то рассказ, а, какой-то документ, который вам нужно им объяснить, какую-то сложную тему, они её не понимают, но у вас есть исходные данные. Вы заливаете эту исход эти исходные данные и получаете сказку в виде книжки. И можете даже распечатать это, э, в форме сказки и подарить им, так они больше, легче и быстрее усвоят материал.
Переходим к следующей, третьей функции. Это очень важная, очень интересная функция, на мой взгляд. Вот, например, у меня в моих бизнес-проектах а есть разные сотрудники разных подразделений, и они определённую часть работы выполняют на компьютере. И там есть определённые бизнес-процессы достаточно сложные, которые нужно выполнять, а, на компьютере с помощью облачных сервисов или локальных сервисов. И новые сотрудники, когда приходят на работу, а, устраиваются к нам, у них уходит достаточно много времени, чтобы понять, обучиться, что надо правильно делать, как надо правильно делать и не как не допускать ошибок. И для того, чтобы их этому обучить, а мы создаём видеоинструкции о том, как пользоваться, допустим, той или иной программой, как там, а, производить регистрацию, заселение, выселение и прочие действия. Так вот, создание этих инструкций также даётся нелегко. Это надо проконтролировать, изучить, найти человека, а процессы постоянно меняются, и это всё нужно вовремя обновлять. То есть записывать инструкции — это нелегко, но этот инструмент позволяет сделать это очень быстро. В частности, мы берём просто записываем молча в процесс, как всё это происходит на компьютере. Делаем запись экрана определённых действий на компьютере, и, а, Google может превратить эту запись экрана, а, без какой-либо озвучки в полноценный регламент, текстовый регламент того, как нужно, а, производить тот или иной бизнес-процесс на компьютере.
Итак, посмотрим, как это делается. То есть здесь мы создаём документацию с записи экрана, то есть пошаговую инструкцию на основе молчаливой записи экрана. Вставляем прот. Посмотри эту запись и напиши пошаговую стандартную операционную процедуру, то есть SOP, то есть регламент с временными метками и описанием каждого действия. Вставляем видеофайл. Здесь мы видим видеофайл, да, из и далее он, а, уходит на анализ этого видеофайла, а его подробный разбор на его основе составляет уже SOP, то есть полноценный регламент. В данном случае у нас файл касается скачивания ведомостей в системе PLTONs. Мы видим, что он по шагам разбил все действия, описанные на видео. Также поминутно и посекундно описал, что происходит на видео последовательно, а, от шага к шагу. И далее на основе этой информации мы уже можем создать полноценный регламент.
Следующая функция касается работы с почтой, с вашим Gmail. То есть в экосистему Google входят разные инструменты, в том числе Gmail, Google Drive, Google Sheets, Google Docs и так далее. С этими со всеми инструментами можно работать с помощью NEC Gemini. В частности, что мы можем сделать? Вводим промт. Найди все письма с упоминанием счетов, дедлайнов и утверждений за последнюю неделю. Сгруппируй их по клиентам и скажи мне, что требуется от меня и где требуется мой ответ. Далее он уйдёт на анализ и перебор каждого вашего письма в вашей электронной почте и даст вам раскладку, от кого какие письма вам пришли, где от вас требуется ответ, где от вас требуется какое-то действие. В данном случае у меня почтовый ящик, рабочий почтовый ящик новый и пустой, а на нём ничего нет. И он, соответственно, указывает, что важных срочных писем, требующих вашего ответа, нет в вашем ящике. Если у вас почта полная, у вас будет другой исход.
Следующая функция — это написание статьи для блога с автоматической генерацией соответствующих иллюстраций. То есть вам можно написать статью на сайт, статью на блог, и каждому разделу будет сгенерирована определённая иллюстрация. Вставляем следующий промт. Напиши статью для блога о пяти бюджетных вариантах домашнего офиса. Для каждого варианта сгенерируй реалистичное изображение, показывающее стол, монитор, стул и аксессуары. включи разбивку цен и место для съёмки, то есть место для ссылок. То есть он сделает сам поиск в интернете, подберёт мебель, подберёт компоненты вашего офиса, найдёт ссылки на эти конкретные товары в магазинах, определит цены на них, и вам всё это даст в полном раскладе и сам скомбинирует, скомпонует пять различных вариантов офиса, которые вы можете оборудовать у себя дома.
Итак, мы видим, что произошла генерация статьи для блога с пятью разными вариантами оборудования офиса. А и каждому варианту есть иллюстрация. Что мы получили? Например, первый вариант. Вот он выглядит вот так. Также в нём указан стол определённый IKEA, а, с определённой моделью и со ссылкой на этот стол. Переходим по ссылке и смотрим, что да, действительно, это тот тот стол. И стоит он 49 долларов, так же примерно, как и указано здесь. Или, например, вот такой офис. Также все компоненты этого офиса здесь перечислены с со ссылками и с описании. Переходим, например, по ссылке и видим, что нет, это не совсем тот стол, который указан на картинке. То есть, да, он может ошибаться, его нужно перепроверять.
Следующая фича — это создание многостраничного, подробного, профессионального отчёта на основе одного промта. То есть здесь мы погружаемся в функцию deep resarch от нейронки Gemini или от Google A Studio. И там же производим глубокий анализ и на основе него делаем отчёт. Раньше на это уходило много времени, ресурсов и получалось не совсем качественно, а то сейчас это всё делается быстро, легко и профессионально. Вставляем следующий промт. Изучи пять самых обсуждаемых прорывов в области и за последние 90 дней сосредоточишься на практическом применении для маркетологов, включи ссылки и источники. Он проанализирует огромное множество источников в здесь мы выбираем вот deep research, а эту функцию, а, глубокое исследование, где он проанализирует огромное количество источников в открытом доступе в интернете и не только в открытом доступе, но и в своих закрытых источниках. Здесь нужно выбрать модель. Есть два две альтернативы: Fast или Thinking Pro. Thinking with 3 Pro. Выбираем обязательно Thinking with 3 Pro, поскольку это более думающая, более лучше и глубже размышляющая модель, и она глубже ныряет в информацию, лучше её обрабатывает, качественнее, но, естественно, занимает чуть больше чуть дольше времени, чем модель Фаст.
Здесь мы видим, что для начала при использовании функции Deep Research нам предлагается а план исследования. Этот план мы можем изучить, посмотреть, почитать, вот здесь раскрыть. А, и если нас что-то не устраивает в этом плане исследования, в его логике, мы можем его изменить, либо, если всё устраивает, то нажать начать исследование. Но если у вас нормальный, хороший промт, то, скорее всего, план будет такой, какой нужен. Вот здесь можем его изменить. И нажимаем "Начать исследование". И вот здесь справа всплывает окно, где расписывается сам алгоритм и последовательность проведения исследования. И после чего это занимает время, а появляется сам результат исследования, подробный, глубокий отчёт на нашу тему, то есть о пяти самых обсуждаемых прорывах в области искусственного интеллекта. Мы можем этот документ отправить, поделиться им также кому-то, либо также можем экспортировать его в Google документы, либо просто скопировать весь текст. А мы в данном случае экспортируем Google документы и видим, как весь этот файл преобразуется в Google документ на нашем Google диске. И это готовый отчёт, структурированный, разбитый по разделам.
Итак, переходим к следующей функции. Это нейросеть Notу LM. Моя любимая, крутая, с огромным функционалом, который может быть полезен в огромном количестве направлений, каких-то процессов. И мы здесь не будем подробно рассматривать все функции NouLM. Об этом есть у меня на канале отдельное видео, и мы выпустим более свежее, более обновлённое видео. А сейчас пока рассмотрим одну функцию, а именно аудиопересказ. Мы сгенерировали с вами отчёт с помощью глубокого исследования. Теперь по этому отчёту мы сгенерируем аудиопересказ. Итак, приступим в ноутбук LM. Заходим, создаём новый блокнот. А здесь мы видим, что импортируем с Google Драйва наш а документ, наш план, наш отчёт. А здесь, а, как вы знаете, ноутбук LM работает исключительно с вашими источниками. который вы указываете. Слева у нас видно, что появляется наш источник. Справа в правой части есть функции, что мы можем делать с этим источником. Здесь есть на э функция называется audio overview, то есть аудиопересказ, то есть озвучка данного отчёта. Нажимаем на карандашик, и здесь мы видим разные форматы, в которых может производиться аудиопересказ. В частности, есть четыре формата: deep dive, brief, critique или debate. То есть deep dive глубоко ныряет, глубоко разбирает. Бриф коротко, критик — это критический анализ. И debate — это дебаты, где мы видим, слушаем обсуждение двух людей, двух ведущих на эту тему. Также мы можем выбрать язык, на котором этот аудиопересказ будет производиться, в частности русский. и далее, а длину, то есть либо brief short, то есть коротко, либо default. Мы выберем short и нажимаем сгенерировать.
У нас появился аудиопересказ. Давайте послушаем, что там произошло. >> Осень 2025 года принесла нам то, что сейчас принято называть эпохой агентного интернета. Искусственный интеллект теперь, ну, не просто отвечает на вопросы. >> Есть ещё кое-какая функция, а сейчас мы её покажем. То есть мы можем сгенерировать подкаст на английском языке. Здесь появляется функция interactive. Нажимаем на эту кнопку и слушаем, как слушаем подкаст двух людей на английском языке. Exactly.
Итак, следующая функция — это работа с изображениями. То есть мы берём определённое изображение, которое нам понравилось, неважно, фото, картинка или что, вставляем его прямо сюда в Gemini, просим его проанализировать эту фотографию и расписать промт, а для генерации прямо аналогичной фотографии точно такой же, но с определёнными нюансами. То есть мы можем вместо объекта на фото вставить себя или какой-то предмет или ещё что-то, что нам нужно. Но задача в том, что мы получаем из этой картинки определённый промт, как её генерировать. В частности, выставляем следующий промт. Проанализируй это изображение и напиши подробный промпт, а, который сгенерирует картинку в похожем стиле. Опиши цвета и так далее и тому подобное. Вставляем картинку. Нейросеть анализирует эту картинку или фотографию и расписывает подробный промт, каким образом можно сгенерировать именно такую фотографию. И вот мы здесь получили подробный промт на английском языке, что не является проблемой. Также есть вот на русском. Берём, копируем этот промт. Берём, выбираем функцию нанобана, то есть модель по генерации изображений. Вставляем этот промт и отправляем его в работу. Модель нанобана прекрасно генерирует фотографии, фото, картинки. И вот здесь мы видим, что она на основе этого промта сгенерировала фотографию. Очень похоже. А, прям почти точь-точ. Здесь у нас была девушка по пояс на фоне светящегося объекта, а здесь, а, ну, практически то же самое.
Идём дальше. Теперь следующая функция будет заключаться в а работе с видео. Для этого мы перейдём в новую нейронку, в новый сервис под названием Google AI Studio. По этому сервису, а он очень крутой, и он, я им пользуюсь регулярно, ежедневно, по этому сервису у меня есть отдельное видео на моём канале, можете пройти, посмотреть. Так вот, переходим по ссылке aistudio.google.com. Здесь справа мы выбираем видео и выбираем модель VO2. Можно выбрать VO3. VO2 она бесплатная и безлимитная. Далее вставляем здесь наш промт. Анимируй это как зацикленное видео для веб-сайта. Также мы вставляем сюда картинку из прошлой генерации, которую мы сгенерировали с помощью Gemini. Вот вставили картинку, то есть фотографию. А справа можно выбрать формат горизонтальный или вертикальный. Также можно выбрать количество генерации результатов. В нашем случае выбираем два, чтобы была альтернатива. Формат горизонтальный, вертикальный и длительность видеоролика от 6-8 секунд. Также можно выбрать, сколько кадров в секунду частота кадров и разрешение, то есть качество самого видео при экспорте.
Итак, он сгенерировал два варианта видео. Посмотрим первый вариант, а, анимированного фото, где девушка, да, в движении, присутствуют блики, а, всё максимально реалистично. Второй вариант, точно также анимация, девушка в движении, а свет также максимально реалистичен. Всё абсолютно правдоподобно, но при этом отсутствуют блики. Вот таким образом можно сгенерировать анимацию вашей какой-то фотографии с помощью VO2. Это видео можно скачать либо импортировать в Google Drive.
Итак, следующая функция — это функция по работе с видео. Например, у нас есть какое-то видео, которое нам понравилось, и мы хотим сгенерировать похожее видео, но с нашей какой-то изюминенькой спецификой. Мы берём это видео, которое нам понравилось, скачиваем его, загружаем в Google AI Studio и производим следующие манипуляции. Вставляем в наше диалоговое окно наш видеофайл. То есть здесь более тяжёлая работа, а поэтому расписываем prompt на английском языке. Watch this video then give me a text to video prompt to recreate it using an AI video generator. То есть мы говорим: "Дай мне промт, который бы сгенерировал такое же видео, как я тебе отправляю в приложение". Пока посмотрим видео, которое нам понравилось. Это вот так человек плывёт на лодке, справа появляется существо, переворачивает лодку, далее действие происходят под водой, и он видит, как это существо плывёт. Всё это сопровождается звуками подводного мира. и вот этими звуками существа. Далее мы получили промт. Промт на английском языке, скопировали этот промт и переходим в другой инструмент, который называется Google Labs. Google Labs — это такая лаборатория по созданию креативного и не только креативного контента, других инструментов. И вот такой есть внутри инструмент под названием Flow. То есть здесь конкретно создаётся контент, такая креативная студия, фото, видео, иного рода контент. Здесь берём, выбираем модель тексту to video, вставляем наш промт, выбираем модель VO31 Fast. Попробуем сначала её. Fast — это такая быстрая, простая модель. Так вот, он сгенерировал видео за 20 кредитов в модели Fast. И мы видим, что видео в целом не совсем удачное, хотя оно очень похоже по стилю, по а цвету, по свету на исходное видео, но просто здесь нужно поработать хорошенько с промтом. То есть промт здесь явно а не дорабатывает. Теперь попробуем то же самое, но в модели VO31 Quality. Здесь на это уйдёт уже не не 20, а 100 кредитов. Делаем генерацию. То есть мы видим, что модель хорошая, модель выб вы выбрана лучше, чем предыдущая, но видео такое же несуразное, то есть чудище появляется спереди, а потом просто происходит затопление лодки на ровном месте. А в общем, здесь однозначно проблема в промте.
Итак, мы с вами рассмотрели 10 разных фишек и функций инструментов искусственного интеллекта от Google и рассмотрели пять разных неростей, в которых можно это производить. Также, кроме этих инструментов от Google, есть множество других крутых инструментов, фишек, функций, о которых мы будем рассказывать в следующих видео. Поэтому подпишитесь, чтобы быть в курсе. Пока. Kom.