Transcription
Всем привет. В этом выпуске самые главные свежие новости об искусственном интеллекте и технологиях. Google показала будущее и заменит ли GMNI 3.5 сайты, приложения и людей. Google запускает армию и агентов. Антигравити превращает GMI в систему, которая работает сама, даже без пользователей. Gemini омни шокировала Google io. Видео, звук, текст и картинки теперь генерирует одна модель. Об этом и многом другом в этом выпуске. Смотрите это видео до конца, чтобы ничего не пропустить.
Google выкатил подборку бесплатных AI-курсов с сертификатами без оплаты, без подписок. Я собрал 10 лучших. Переходите и смотрите подборку в моём Telegram-канале по ссылке в описании под видео. На бесплатных курсах вы обучитесь тому, как работает генеративный ИИ, и чем он отличается от классического машинного обучения. База по работе с искусственным интеллектом в ежедневных задачах, промт-инженерии и работа с GNI в реальных кейсах, а также многое другое. Всё в моём Телеграме по ссылке в описании под видео.
Google официально представила Gemini 3.5, новую серию моделей, которую компания называет переходом к Frontier Intelligence with Action, то есть ИИ, способным не только отвечать на запросы, но и самостоятельно выполнять длинные цепочки действий. Главным дебютом стала Gemini 3.5 Flash. Модель, которая должна стать основой для новой волны агентных систем Google. Компания делает ставку на то, что пользователям больше не нужен просто быстрый чатбот. Теперь Google пытается превратить GMI в универсальный движок для автоматизации задач, работать с кодом, браузером, файлами, интерфейсами и сложными рабочими процессами. Анонс появился во время Google IO 2026. Над проектом работали Курай, Кавук, Чуваглу, Джеффи Дин, Ариэль Вильяс и Ноам Шазир, одним из главных руководителей и исследователей Google Deep Mind. В компании прямо заявляют, что GMI 3.5 создавался как модель для агентных систем нового поколения, которые способны выполнять многошаговые задачи почти без участия человека.
>> GEMN i3 был выпущен несколько месяцев назад в полном составе. Это наша самая популярная серия. Нам очень нравится, что разработчики используют флш в повседневной работе и создают невероятные решения, используя глубокие аналитические, мультимодальные возможности ПРО. Мы усердно работали над улучшением этих моделей, уделяя особое внимание агентному кодированию и долгосрочному планированию. Задачи реальные рабочие процессы. И сегодня я рад представить джемы на 3,5 флш, первую из серии моделей, сочетающих в себе передовые интеллектуальные возможности и способность к действию. Я хотел бы обратить ваше внимание на две вещи. По сравнению с моделью 3,1 Pro, Флш превосходит её по всем параметрам, практически по всем бенчмаркам. Она значительно продвинулась в области кодирования. И посмотрите на невероятный скачок в ГДВ бенчмарке, который охватывает множество экономически значимых задач из реальной жизни. Во-вторых, 3,5 флш - это очень мощная модель, которая не уступает лучшим моделям, но при этом работает намного-намного быстрее. Вот почему, если посмотреть на соотношение интеллекта и скорости вывода, она оказывается в совершенно отдельной лиге в правом верхнем квадранте. По количеству выводимых токенов в секунду она в четыре раза быстрее других моделей, работающих на основе передовых технологий, и пользоваться ею невероятно приятно. Новая модель стала для нас в Google настоящим прорывом. Мы используем 3,5 флеш с обновлённой версией нашей платформы для разработки с использованием агентов. Антигравитация значительно ускорила нашу работу. В марте мы представили 3,5 флш, и теперь она доступна всем в наших продуктах и IP. Мы также с нетерпением ждём выхода третьего десятых Pro. Мы уже используем её внутри компании. Она демонстрирует отличные результаты. Я знаю, что вам не терпится её опробовать. Дайте нам ещё месяц, чтобы подготовить её к релизу. >>
Google утверждает, что новая архитектура особенно хорошо справляется с длинными рабочими сценариями, где нужно планировать действия, удерживать контекст и взаимодействовать с внешними инструментами. Главной особенностью GNI 3.5фш стала комбинация высокой скорости и результатов уровня крупнейших флагманских моделей. Google утверждает, что модель показывает производительность, сопоставимую с тяжёлыми фронтир-системами, но работает значительно быстрее. В тесте Terminal Bench 2.1 модель получила 76,2%. В MCP Atlas 83,6%, а в CHR X if Resoning 84,2%. По словам компании, скорость генерации у Gemini 3.5 Flash примерно в четыре раза выше, чем у многих конкурирующих фронтир-моделей. Отдельно Google показывает, что модель резко усилилась именно в программировании и агентных задачах. В рейтингах Artifical Analis Gmin 35 Flash оказалась в верхнем секторе графика, где сравнивается интеллект модели и скорость генерации. Компания делает акцент на том, что пользователям больше не придётся выбирать между качеством и задержкой ответа. При этом Google открыто сравнивает Ginice Clod Sonet 4.6, Clod Opus 4.7 и GPT 5.5. На некоторых тестах новая модель уступает конкурентам, но в ряде агентных сценариев и мультимодальных задач оказывается впереди.
Одной из главных тем презентации стала так называемая Long Horizon Agent Tasks. Длинные автономные задачи. Google утверждает, что Ginite 35 Flash способен выполнять работу, которая раньше занимала у разработчиков дни, а у аналитиков недели. Речь идёт о создании приложений, поддержке больших кодовых баз, обработке документов, финансовом анализе и автоматизации корпоративных процессов. В связке с платформой Google антигравити модель может запускать несколько субагентов одновременно и распределять между ними задачи внутри одного большого процесса. Google также показал, как Gemini 35 генерирует интерфейсы и графику. Во время демонстрации модель автоматически создавала интерактивные веб-интерфейсы, анимации и элементы управления прямо по текстовому запросу. Компания считает, что мультимодальные возможности GMI теперь достаточно сильны для генерации сложных UI-сценариев и визуальных приложений без ручной работы со стороны разработчика.
Большой блок презентации был посвящён реальным корпоративным применениям. Google заявляет, что банки, финтех-компании и аналитические команды уже используют G35 для автоматизации длинных рабочих процессов и анализа огромных массивов данных. В качестве примера компания показала Shopify, где несколько субагентов параллельно анализируют сложные данные для более точной работы с продавцами и бизнес-метриками. Google считает, что агентные модели постепенно начинают переходить из экспериментальной стадии в полноценную производственную инфраструктуру.
Отдельное внимание Google уделила персональным агентам. GMN 3.5 Flash стала основой модели внутри приложения GMNA и AI Mode в поиске Google. Компания представила систему Gemice Park, персонального ИИ-агента, который может работать круглосуточно, выполнять задачи от имени пользователя и помогать управлять цифровой жизнью. На презентации показывали сценарий, где агент самостоятельно отслеживает вакансии, собирает информацию из интернета, готовит отчёты и продолжает работать даже после того, как пользователь закрывает приложение.
Google также попыталась заранее ответить на вопросы о безопасности. Компания заявляет, что GMI 3.5 создавалась в рамках Frontier Safety Framework. По словам разработчиков, модель получила усиленные механизмы защиты в области кибербезопасности и CBRN-рисков. Для проверки внутренних рассуждений система Google использует новые инструменты интерпретируемости, которые должны помогать анализировать логику модели до того, как она выдаст ответ пользователю.
Сейчас GNI 3.5 Flash уже доступен через Gemini IP, Google AI Studio, Android Studio, платформу Gemini Enterprise и сервисы Google Search. Внутри компании также активно тестирует Gemini 3.5 Pro, полноценный релиз которого ожидается в следующем месяце. Судя по презентации Google, компания больше не рассматривает GMНАI как отдельный продукт. Теперь вся стратегия строится вокруг идеи огромной сети ИИ-агентов, встроенных в поиск, браузер, корпоративные сервисы и повседневную цифровую инфраструктуру.
Одним из главных анонсов стала новая платформа Google Antiravity 2.0. Компания описывает её как полноценную экосистему для разработки и агентов. Теперь антигравити выходит из рамки обычного инструмента для экспериментов и превращается в отдельную инфраструктуру, где можно создавать, запускать и координировать сразу несколько агентов одновременно. В новой настольной версии приложение пользователю предоставляет центральную панель управления агентами, которые могут выполнять задачи параллельно, автоматически распределять работу между вспомогательными субагентами и запускать фоновые процессы по расписанию. Google также встроила интеграцию с Google AI Studio, Android и Firebase. Для разработчиков, предпочитающих работать через терминал, компания представила Антигравити CLA - это облегчённая версия платформы без графического интерфейса. Google прямо рекомендует пользователям GNL переходить на новый инструмент. Вместе с этим был показан антигравити SDК - набор инструментов для программного доступа к агентной системе Google. С его помощью разработчики смогут создавать собственных агентов, задавать им поведения и размечать их на любой инфраструктуре.
Мы переходим от инструментов на основе искусственного интеллекта, которые помогают нам писать, к агентам, которые помогают нам действовать. Эти агенты настолько снизили порог входа в разработку, что теперь каждый может стать программистом. Даже занятые руководители. Например, на прошлой неделе Сун использовал Google антигравити, чтобы исправить ошибку в кодовой базе Google. Когда в ноябре мы запустили Google антигравити, мы сосредоточились на улучшении основных функций, связанных с агентами, и добавили экспериментальную функцию. Это был наш первый в своём роде агент для поверхностного взаимодействия, который давал представление о том, в каком направлении мы движемся. Миллионы людей уже активно используют антигравити, и мы рады представить вам ещё больше новых функций. Мы увидели, насколько разнообразны задачи, предпочтения и, честно говоря, отзывы о продукте. Мы учли весь этот опыт и теперь значительно расширяем набор возможностей функций интеграции для агентов. Для начала мы запускаем полнофункциональный интерфейс командной строки CLI для антигравити, встроенную голосовую поддержку с аудиомоделями GEMN и интеграцию со многими сервисами и платформами, такими как Android, Firebase и Google AI Studio. Всё это доступно уже сегодня. Но самое главное - это антиravity 2,0 - новое автономное настольное приложение, которое в полной мере соответствует первоначальному представлению о по-настоящему оптимизированном для агентов интерфейсе. Новая версия антигравити полностью ориентирована на агентов и фокусируется на основной концепции агентов. Это касается диалогов, создаваемых агентами материалов и многоагентной оркестровки. Как я уже сказал, это приложение полностью ориентировано на агентов. Как отметил Сундр, именно с его помощью команды в Google добиваются огромных результатов. Система антиavity harness - невидимая платформа ИИ для выполнения задач реального мира - стала намного мощнее благодаря новым базовым примитивам, таким как субагенты, перехватчики и асинхронное управление задачами. И в основе всего этого лежат модели Gemmen. Причём Gem& 3,5 флш была разработана совместно с Gem 3,5 флеш. Оптимизирован с учётом антигравитации. Пристегните ремни. Конечно, нам, как инженерам, было любопытно посмотреть, насколько далеко мы сможем раздвинуть границы возможного с помощью этих агентов и моделей. Итак, используя новую систему антигравити и вспышку джемы на 3,5, мы попросили нашего агента взяться за то, что мы считаем очень сложным и впечатляет. Впечатляющая задача - создать работающую операционную систему с нуля. Мы были удивлены тем, что обнаружили. В асинхронном режиме антигравити разбила задачу на последовательный план, решала задачи с помощью параллельных субагентов, генерировала, выполняла и повторяла свои собственные тесты. За 1293 субагента, работающих параллельно, выполнили более 15.000 запросов на модель и обработали 2,6 млрд токенов, чтобы принять участие в тестировании от изначально пустого проекта до ядра функционирующей операционной системы. Этого не было. Это было невозможно на Gemмы Night 3,1 Pro, но благодаря производительности и экономичности Gem 3,5 флш для создания полностью функциональной операционной системы потребовалось менее 1.000 долларов кредитов АПИ. Агенты антигравити написали каждую строку кода от планировщика до управления памятью и файловой системы. сгенерировали, проверили и протестировали полностью автономной командой агентов. Если рассматривать это в контексте, то разработка операционной системы с нуля, как известно, является жестоким процессом и может занять много месяцев, чтобы строить. Мы создавали не просто приложение, а полностью функционирующую операционную систему, на которой могут работать приложения. Давайте посмотрим на это вживую и действительно покажем эту операционную систему в действии. Итак, я нахожусь в окне терминала операционной системы, разработанной антигравити. Продемонстрировать работу операционной системы не так-то просто. Давайте попробуем что-нибудь забавное, чтобы проверить, как это работает. Одна из интересных утилит, которую можно установить - это L, что часто пишут вместо l по ошибке. Не буду раскрывать все подробности, но вот что получилось. Работает. На экране появляется крутой локомотив с логотипом антигравити, но это явно не настоящая операционная система, если только я не смогу запустить. Но если я попытаюсь запустить Doom прямо сейчас, ничего не выйдет. Оказывается, в операционной системе пока нет необходимых драйверов для видео и клавиатуры. Давайте попробуем исправить это в новой версии антигравити. У меня есть подготовленная команда, я сейчас её вставлю. Пока она выполняется, давайте посмотрим, что представляет собой антигравити 2,0. Как видите, антигравити 2,0 в первую очередь ориентирована на агента. Все ваши диалоги отображаются на левой боковой панели, а все ваши проекты на правой. Давайте взглянем на один из моих предыдущих диалогов. Для этой демонстрации мне было интересно узнать несколько забавных фактов о Дум, поэтому я попросил агента провести небольшое исследование. На правой боковой панели появились графики, а в конце агент создал для меня классный артефакт. Он даже создал инфографику с помощью на Navaneta Pro. Он построил несколько графиков, используя только что написанный код, а потом создал несколько классных таблиц. Как видите, антиревати 2,0 - это система, в которой всё ориентировано на агента. И она была оптимизирована, чтобы обеспечить наилучшие условия для взаимодействия с агентами. Давайте посмотрим на предыдущий диалог, чтобы узнать, как всё прошло. Анти ГРВти провела целую серию исследований, написала более 100 строк кода и, наконец, создала операционную систему. Давайте проверим, работает ли она. Момент истины. Потрясающе. Это никогда не надоест. Гревити - это весело и впечатляюще, но на этом мы не остановились. Мы поручили этим агентам создать набор инструментов для редактирования фотографий, приложение для обмена сообщениями в реальном времени и многопользовательскую платформу для совместной работы. И всё это с одинаковыми результатами. То, на что раньше уходили дни, теперь делается за часы, если не за минуты. Это стало возможным благодаря новой функции совместной работы субагентов. И мы рады представить вам эту функцию в качестве экспериментальной версии антигравити. И последнее, но не менее важное. Флш- 3,5 невероятно быстр. Как сказал Суunder, он в четыре раза быстрее других моделей фронтир. Но, как мы знаем, агентное программирование - это настоящий монстр. Поэтому в антигравити мы вывели его на новый уровень. Мы оптимизировали флш так, чтобы он был не в четыре, а в 12 раз быстрее в антигравити. И мы рады уже сегодня дать вам возможность попробовать эту технологию. То, что вы увидели сегодня - это не просто концепция. Это то, как мы создаём антигравити, чтобы она стала самой совершенной платформой для разработки с использованием агентов, доступной каждому. Мы делаем это с помощью экосистемы Google, интегрируя в неё уже знакомые вам технологические решения и инструменты или используя агентную платформу Антигравити для создания новых агентных решений. Продукты Google. Сегодня антиvity 2,0 доступно по всему миру для всех желающих. Присоединяйтесь к нам на презентации для разработчиков, где мы продемонстрируем всё новое и возможное. >>
Отдельное внимание Google уделило корпоративному сектору. Теперь антигравити можно напрямую подключать к проектам Google Cloud через платформу Gina Enterprise Agent платформы. По сути, компании пытаются выстроить ИИ-агентов прямо в инфраструктуру крупных организаций, где они смогут работать с внутренними сервисами и автоматизировать сложные процессы. Ещё одним заметным анонсом стал запуск нового тарифа Google AI Ultra стоимостью 100 долларов в месяц. Google объясняет, что подписка рассчитана на пользователей, которым нужен максимальный доступ к новым возможностям. И план даёт лимиты использования антигравити примерно в пять раз выше по сравнению с Google IP. Кроме того, до 25 мая 2026 года подписчики смогут получить дополнительные бонусные кредиты на сумму 100 долларов для работы внутри антигравити.
Параллельно Google представила manage агентств Gemini IP. Теперь разработчики смогут запускать полноценных ИИ-агентов буквально одним вызовом AP. Такие агенты умеют рассуждать, использовать инструменты и выполнять код внутри изолированной Linux среды. В компании подчёркивают, что речь идёт о той же агентной системе, которая используется внутри собственных продуктов Google. Каждый запуск агента создаёт отдельную изолированную среду, состояние которой сохраняется между сессиями. Это позволяет агентам продолжать работу спустя время без потери файлов и контекста. Разработчики также смогут создавать собственных агентов через Markdown инструкции и специальные шаблоны внутри Google AI Studio.
Google AI Studio тоже получила крупное обновление. Компания анонсировала мобильное приложение, которое позволит создавать прототипы прямо со смартфона. В Google описывают сценарий, где пользователь может записать идею в дороге, а к моменту возвращения на компьютер получить уже работающий прототип приложения. Также появилась интеграция с Google Workspace IP, благодаря чему агенты смогут напрямую взаимодействовать с сервисами компании. Кроме того, Google добавила возможность переносить проекты из Google AI Studio в НИГРV буквально одним нажатием кнопки. Вместе с проектом сохраняется весь накопленный контекст. Для Android-разработчиков компания подготовила отдельную интеграцию, которая позволяет создавать приложение простыми текстовыми запросами. Появилась и поддержка Google Play консоль для прямой публикации приложений в тестовом треке магазина.
В завершение Google объявило о запуске глобального хакатона Build Twist Gemini X Price с призовым фондом в 2 млн долларов. Компания называет его крупнейшим хакатоном подобного типа. Участникам предлагают создавать приложение на базе GMI для решения реальных задач от сокращения пищевых отходов до научных исследований. Финалисты выступят на мероприятии Mohot GН в Лос-Анджелесе в сентябре.
Компания Google представила новую систему под названием Gemini Omni, которая стала одной из самых амбициозных попыток объединить генерацию видео, изображений, текста и звука внутри одной модели. В центре презентации оказался запуск первой версии семейства Gemini Omni Flash. Разработчики называют её системой, способной создавать практически любой тип контента из любых входных данных. Пока основной акцент сделан именно на видео, но позже компания обещает добавить полноценную генерацию изображений и аудио.
>> Мы можем ещё больше расширить творческие возможности Gemini. И это обновление номер два. Сегодня в приложении Gemini для платных подписчиков появится Gemй Амни. С его помощью вы сможете воплощать свои идеи в жизнь, используя любые комбинации текстовых, графических и видеоматериалов. И по мере того, как я его использую, мне кажется, что настал момент, когда видео можно создавать за считанные секунды. Ещё никогда не было так просто создавать и редактировать видео. Давайте посмотрим, как это работает в реальной жизни. Я хочу познакомить вас с Сашу. Она работает над новой песней и хочет создать короткий тизер. Она делится исходным видео, добавляет к нему несколько референцев. И вот что самое крутое. Она может изменить стиль видео, может даже сменить ракурс камеры на 360°, а джемы на и соберёт всё воедино. Давайте посмотрим, как это выглядит. Всё сделано с помощью джемней. Как видите, Амни понимает физику движения и грамотно накладывает эти эффекты на реальный мир, не теряя при этом естественности. Создавать, микшировать и редактировать видео ещё никогда не было так просто. Теперь, чтобы она не задумала, она может воплотить это с помощью джемней. Подписчики Google, AI Plus, Pro и Аra по всему миру могут уже сегодня опробовать GM Ани прямо в приложении.
В Google объясняет, что проект стал продолжением идеи, которую компания начала развивать ещё после выхода нанобана. Тогда модель получила возможность редактировать изображения, восстанавливать старые фотографии и создавать новые сцены по эскизам. Теперь похожая логика переносится уже в мир видео. Главная идея омни заключается в том, что пользователь может разговаривать с моделью обычным языком и постепенно изменять ролик прямо во время работы. Система запоминает предыдущие инструкции, сохраняет персонажей, окружение и общую физику сцены. Во время демонстрации Google показала несколько примеров. В одном из случаев модель меняла обычную скульптуру на версию, полностью состоящую из пузырей. В другом человек касался зеркала, после чего поверхность начинала вести себя как жидкость, а рука превращалась в отражающий металлический материал. Компания отдельно подчёркивает, что модель способна сохранять целостность сцены даже после нескольких последовательных правок. Пользователь может менять стиль, освещение, ракурс или окружение, а система продолжает понимать, что происходит в исходном ролике. Разработчики также делают ставку на более реалистичную физику. По словам Гугла, модель получила улучшенное понимание гравитации, кинетической энергии и динамики жидкости. Во время презентации показывали сцену с мраморным шариком, который катится по длинной цепной конструкции практически без визуальных ошибок. Компания утверждает, что Омни пытается не просто генерировать красивые кадры, а предсказывать, как объекты должны вести себя в реальном мире.
Отдельный акцент сделали на способность модели соединять знания и творчество. В качестве примера Google показал ролик, где каждая буква английского алфавита сопровождалась отдельным объектом. Для буквы C использовалась копибара, для D - дискошар, а для L - лавовая лампа. Система одновременно следила за порядком букв, подписью объектов и музыкальным сопровождением. В другом примере Омни создавала пластилиновый обучающий ролик о сворачивании белков в стиле stop motion анимации.
Одной из самых важных особенностей Омни стала работа с разными типами входных данных. Пользователь может загрузить изображение, видео, текстовое описание или аудио, после чего модель объединит всё в единый ролик. Google показала пример научно-фантастического видео, где визуальные эффекты синхронизировались с музыкой из загруженного аудиофайла. В других демонстрациях люди использовали собственные фотографии и рисунки как основу для создания новых сцен.
Компания также объявила о запуске функции цифровых аватаров. Пользователь может создать виртуальную версию самого себя и генерировать видео со своим лицом и голосом. При этом Google отдельно заявляет, что пока осторожно относится к технологиям изменения речи и аудио, поэтому подобные функции будут внедряться постепенно. Все ролики, созданные через Omni, автоматически получают цифровой водяной знак SINS ID, который должен помогать отличить ИИ-контент от обычного видео. Проверка таких материалов будет доступна через Gemini, Браузер Chrome и поисковую систему Google.
На первом этапе Gemini Omni Flash становится доступен подписчикам Google AI Plus Pro и Ultra через приложение Gemini, сервис Google Flow и платформу YouTube Shorts. Позже компания собирается открыть доступ разработчикам и корпоративным клиентам через AP. В Google прямо говорят, что рассматривают Омни как начало новой большой платформы, где искусственный интеллект будет не только отвечать на запросы, но и самостоятельно создавать полноценный медиаконтент из любых источников информации.
Одним из самых амбициозных проектов стал Gemini Spark. Google описывает его как круглосуточного персонального ИИ-агента, который может выполнять работу за пользователя в фоне. Spark работает на Gemine 3.5 и использует систему антигравити Garnes. Это ваш личный помощник, который помогает вам ориентироваться в цифровом пространстве. действует от вашего имени и под вашим руководством. Он работает на выделенных виртуальных машинах в облаке Google круглосуточно и без выходных. И да, вы можете закрыть крышку ноутбука. Он работает на базе GEM на 3,5 и системы Google антигравити, которая позволяет ему легко выполнять длительные задачи в фоновом режиме. Спарк будет легко интегрироваться с другими инструментами, начиная с наших собственных и в ближайшие недели с инструментами сторонних разработчиков через МАП. Вы можете работать со Spark так, как вам удобно. В приложении Джемана или в скором времени по электронной почте и в чате. Давайте попросим Джоша рассказать подробнее. Первое, что вы видите - это панель управления со всеми задачами, которые выполняются в фоновом режиме. Вы можете следить за их выполнением. Я сразу же вставлю одну задачу. Это довольно простой пример, но он очень полезен. Помогите мне составить письмо для команды. Соберите всю информацию о наших недавних прямых эфирах с Gemй и о наших успехах за последнюю неделю. Используйте, привлекайте авторов-призраков. То есть здесь происходит несколько процессов. Соберите всю информацию. Она будет взята из документов, электронных писем, чатов и выберет самую важную информацию, которая нужна для этого обновления. Он также использует все материалы, опубликованные за последнюю неделю с привлечением авторов-призраков. Это мой личный навык, поэтому письмо будет написано в моём стиле. И самое замечательное в Спарк - то, что вы можете загружать свои любимые навыки, которые найдёте в интернете. Давайте запустим этот процесс в фоновом режиме. Вы видите, что он уже начал выполнять различные команды, а я переключусь на другое приложение из нашей личной коллекции. Мы планируем устроить большую вечеринку с барбекю. И вот, как видите, это довольно сложная инструкция. Нам нужна помощь в сборе ответов на приглашение в составлении списка того, что каждый принесёт с собой. Не забудьте отправить электронные письма тем соседям, которые ещё не ответили. И что самое удивительное, Спарк будет выполнять всё шаг за шагом. Посмотрите, сколько шагов он выполняет. Это сэкономит вам массу времени. И снова используйте различные навыки и приложения. И что самое удивительное, он не только разбивает задачу на этапы, но и может генерировать файлы. Вот первый из них - это онлайн-трекер ответов на приглашение прямо в Google таблицах. Вы видите, что он показывает, кто уже подтвердил своё участие, а кто нет. Самое удивительное, что он будет обновляться, потому что подключен к Gmail. Например, когда Томсон из строки восемь подтвердит своё участие, данные обновятся, что просто невероятно. Кроме того, он будет отслеживать всех гостей и отправлять им напоминания. Итак, всё произойдёт следующим образом. Он создаст черновики, и я смогу их отправить. И, наконец, по моей команде он создаст презентацию для вечеринки с барбекю. Вы видите, что она создаётся прямо в Google презентациях с идеальной интеграцией. Он даже подтягивает информацию о нашем огромном надувном батуте, который будет стоять в тупике. И всё это происходит в фоновом режиме и под моим контролем. И что самое удивительное, мы с Джимом можем пойти ещё дальше и узнать, например, что ассоциация домовладельцев вашего района не позволит вам установить это раньше полудня пятницы, то есть 5 июня. Это данные из файла на моём Google диске, так что это невероятно полезная функция, которая позволяет собрать всё воедино. Теперь Spark работает на ноутбуке. SPARK отлично работает и на мобильных устройствах, как на Android, так и на iPhone. Вот смотрите, я открываю его на своём телефоне и захожу в Spark. Вы видите, что обе задачи, которые мы только что выполнили, синхронизируются на всех ваших устройствах, и это очень удобно. Спарк отлично подходит для того, чтобы просто записать всё, что приходит в голову. Если вы очень заняты, то можете просто переложить задачи на него. Спарк подхватит их и выполнит. Смотрите, создайте
Для меня несколько списков. Первый: найти все предстоящие встречи с Сундаром и выделить их ярко-розовым, чтобы я их не пропустил.
Второй. Вчера вечером я познакомился с нашим новым соседом Джоном. Напишите ему и его семье записку и пригласите их на нашу вечеринку, потому что изначально их не было в нашем списке.
Третий. Создайте документ с перечнем того, что нам с женой нужно сделать для детей до конца учебного года. Распределите задачи по срокам и приоритетам. Сделайте так, чтобы было легко ориентироваться. Я не хочу ничего упустить.
Хорошо, мы отправим это вам, и вы сможете посмотреть. Я говорю быстро, и он успевает записать всё, что я говорю, и сохранить контекст. Сначала это будет один поток, а на заднем плане он будет разбивать его на отдельные задачи. Теперь я могу просто отложить телефон и заняться своими делами. Спарк будет работать в фоновом режиме. Позже мы проверим, как он справляется.
Вы видите, что это один из первых случаев, когда мы можем отложить телефон и позволить ему продолжать работать в режиме ожидания ввода-вывода. Это здорово, поскольку безопасность для нас в приоритете, на этой неделе мы запускаем Gem Park для доверенных тестировщиков, а на следующей неделе в качестве бета-версии для подписчиков Google AI Аter в США. Мы хотим, чтобы этот новый тип помощи был доступен как можно большему числу людей.
Для этого мы вводим новый тарифный план Алтра за 100 долларов в месяц. А для тех, кому нужны максимальные возможности, мы снижаем цену на наш премиальный тарифный план Алтра с 250 до 200 долларов в месяц. И это ещё не всё.
Позже этим летом Gem Най Парк будет работать непосредственно в Chrome, выступая в качестве вашего персонального браузера в интернете. Он может выполнять действия в соответствии с вашими задачами. Кроме того, мы создаём специальную домашнюю базу для ваших агентов на вашем телефоне Android, которая появится в конце этого года.
Как сказал Суunder, мы вступаем в новую эру агентных технологий в Google, и нам не терпится увидеть, что вы с их помощью создадите. Агент интегрирован с Gmail, Dogs, Slides и другими сервисами Workspace. А главное отличие заключается в том, что он продолжает работать даже после того, как поиск закрыл ноутбук или заблокировал телефон.
Google показал несколько сценариев работы Спарк. Система умеет автоматически анализировать банковские выписки и искать подозрительные подписки, следить за письмами из школы ребёнка, собирать важные дедлайны и отправлять ежедневные отчёты семье. Также Спарк способен объединить заметки из переписок и встреч, превращать их в готовые документы Google Docs и даже подготавливать письма для запуска новых проектов.
Компания говорит, что это только начало. Уже летом Google собирается расширить список подключаемых сервисов через MCP интеграции. Среди первых партнёров названы Canva, Open Table и Instruct. Позже Spark сможет выполнять действия и внутри этих платформ. Кроме того, Google хочет добавить возможность писать агенту через сообщения и почту, создавать собственных субагентов и управлять браузером пользователя.
При этом компания отдельно подчёркивает тему безопасности. Спарок должен работать только под контролем владельца аккаунта. Поиск сам выбирает, какие сервисы подключать. А перед важными действиями вроде отправки писем или траты денег, система обязана запрашивать подтверждение.
Google также обновляет приложение GNI для MacOS. Летом в него встроят спарк, чтобы агент мог работать уже с локальными файлами и задачами прямо на компьютере пользователя. Помимо этого, компания тестирует новые голосовые функции. Система сможет понимать естественную речь с паузами, оговорками и незавершёнными мыслями, а затем превращать её в аккуратно оформленный текст прямо вместе расположения курсора.
Одним из центральных анонсов стали голосовые функции для Gmail, Docs и Keep. Google делает ставку на то, что люди всё чаще будут взаимодействовать с их голосом без клавиатуры и длинных текстовых запросов. В Gmail появилась система Gmail Life, которая позволяет искать информацию в почте обычной разговорной речью.
>> Мне часто хочется, чтобы дела делались со скоростью моей речи. Сегодня это стало гораздо более возможным благодаря техническому прогрессу в области аудиомоделей. Новая функция под названием Даксle выводит эту возможность на новый уровень. Чтобы создать документ с помощью Gemon, раньше нужно было очень точно сформулировать запрос. С помощью Дакслив вы можете просто наговорить всё, что у вас на уме, а Джемана и сделает всё остальное. Давайте посмотрим, как это работает на примере демонстрации от нашей команды разработчиков. Всё происходит в реальном времени без ускорения.
Хорошо, давайте попробуем. Я только что вспомнил, что завтра буду выступать перед выпускниками школы в рамках Дня карьеры. Мне нужно подготовить тезисы, чтобы рассказать, чем я занимаюсь как инженер-программист. Но я не знаю, с чего начать. О, а можешь просто вытащить моё резюме из Google диска? Хотя это может быть скучно. Может, ты придумаешь какие-нибудь забавные аналогии, чтобы выступление было более увлекательным для школьников? Ах да, мне кажется, школа прислала мне письмо. Тема письма, кажется, связана с организацией дня карьеры. Может, просто возьмёшь оттуда информацию, разместишь её в верхней части документа, чтобы я знал, куда идти и во сколько там нужно быть? Давай просто уточним эти требования и сразу превратим их в черновик. Это круто, но немного сложно для восприятия. Может, оформишь аналогию в виде таблицы, чтобы было понятнее? Мне немного проще сканировать. А ещё я могу добавить примечание с историей о том, как мой брат вдохновил меня стать инженером-программистом. Оно будет вверху списка, выделенное жирным шрифтом, чтобы я его не пропустил. >> Да, отлично получилось.
Этим летом мы запустим догслив для подписчиков с тарифными планами Pro и Аultra. И те же мощные голосовые функции появятся в Gmail и Google Keep Denverвер. >> Поезли может спросить, например, номер входа на посадку для рейса или узнать, что происходит в в школе ребёнка на этой неделе, а система сама проанализирует письма и выдаст короткий ответ. Google фактически превращает почту в разговорного помощника, который умеет быстро ориентироваться в огромном количестве сообщений.
Google Docs появилась функция Docs Life. Она работает как голосовой соавтор и помогает создавать документы практически в режиме диалога. Пользователь просто проговаривает мысли вслух, а система пытается превратить их в структурированный текст и может сам выстраивать план документа, менять стиль изложения и с разрешения позли подтягивать данные из Gmail, Drive, чат и даже из интернета. Google объясняет, что технология рассчитана не только на готовые идеи, но и на хаотичный поток мыслей, которые модель должна постепенно превращать в полноценный черновой текст.
Похожее обновление получило и Кипер. Теперь приложение способно превращать обычные голосовые заметки в организованные списки и структурированные записи. Google делает ставку на сценарии, где человек быстро диктует идеи на ходу, а система уже сама сортирует информацию и превращает её в удобный формат. Все эти голосовые функции начнут распространяться летом для подписчиков Google и Iro и Ultra, а также для корпоративных клиентов Google Workspace.
Отдельный блок презентации был посвящён новому сервису Google Pix. Это инструмент для генерации и редактирования изображений, построенной на модели нанобана. Google пытается решить одну из главных проблем современных генераторов изображений, ситуацию, когда после удачной картинки невозможно аккуратно изменить один элемент без полной перегенерации сцены. В Пикс компания делает упор именно на точное управление изображением.
Система умеет выделять отдельные объекты внутри изображения и редактировать их независимо от остальной сцены. Польтель может перемещать предметы, менять их размеры или полностью заменять объекты, не затрагивая остальные части картинки. В качестве примера Google показала возможность поменять цвет свитера или даже превратить собаку в кошку без разрушения всего изображения. Ещё одна функция позволяет редактировать текст прямо внутри фотографии и автоматически переводить его на другие языки с сохранением оригинального стиля шрифта.
Google также встроит ПИКС в собственные рабочие сервисы. Первая интеграции появится в Слайс и Drive, чтобы пользоли могли редактировать изображение прямо внутри рабочих документов и презентаций. Кроме того, сервис получит совместные холсты, где несколько человек смогут одновременно работать над одной картинкой. Пока Google Pix запускается только для ограниченного числа тестировщиков, но летом сервис планируют открыть для подписчиков Google AI Pro и Ультра по всему миру.
>> Технологии - это холст для творчества. Сегодня я хочу рассказать о трёх продуктах, которые помогут вам воплотить свои идеи в жизнь. Начнём с того, который использует возможности NноO банана и даёт вам ещё больше возможностей для творчества. Представляем Google Pix, новый продукт в Google Workspace. Pix - это инструмент для создания и редактирования изображений, с помощью которого можно создать что угодно, от флаеров для вечеринок до инфографики с нужными вам возможностями для творчества. Посмотрите, как это просто. Вы начинаете с базового изображения, которое служит вам холстом. И что самое классное, Пикс понимает, что изображено на ваших творениях и как объекты сочетаются друг с другом. Вы можете навести курсор на элемент и нажать, чтобы удалить его, или изменить размер объекта, чтобы он поместился в рамку. После того, как макет готов, вы можете добавить или отредактировать текст и перевести его всего в несколько кликов. На всех результатах работы наших инструментов для творчества, включая изображение, проставлен водяной знак с идентификатором Sint ID. Пикс появится этим летом.
Но что, если вам нужно не просто изображение? Может быть, вы хотите разработать приложение или сайт? Сайт. Теперь вы можете создавать пользовательский интерфейс со скоростью мысли. Команды в Google используют наш дизайнерский продукт под названием Стиch, чтобы превратить грубые идеи в красивый дизайн пользовательского интерфейса. Но это касается не только нас. В прошлом году Стич использовали во всём мире для создания более 100 млн пользовательских экранов. И чтобы сохранить этот импульс, сегодня мы внедряем новые способы проектирования. Давайте посмотрим, как это работает.
Мои друзья Тайлер и Дженни владеют пиццерией, и у них есть огромный опыт в приготовлении пиццы, но нет никакого опыта. У них есть опыт в разработки веб-сайтов. Достаточно одного запроса, и Стич приступит к созданию пользовательского интерфейса в режиме реального времени. Сейчас это только первый этап, но если они захотят усовершенствовать его, они могут взаимодействовать со Стич в режиме реального времени, либо записывая подсказки, либо используя свой голос. Например, они могут вмешаться и сказать: "Увеличте текст заголовка и обновите меню, чтобы выделить больше". Варианты пиццы: Макет обновляется в режиме реального времени, а поскольку стич ссылается на множество инструментов, они могут экспортировать свой дизайн в код или запустить свой веб-сайт всего за несколько кликов. Сегодня эти обновления в Стич доступны пользователям по всему миру.
С каждой новой технологией самое захватывающее - это видеть, что люди делают с её помощью. Вот почему с самого первого дня мы не просто создавали модели и инструменты для креативщиков, мы создавали с их помощью. Давайте исходить из того, что именно благодаря духу сотрудничества мы запустили Google Flow вушлом году. Сегодня миллионы людей используют его для создания изображений, фильмов и музыки так как они никогда раньше не могли. И чтобы развить этот прогресс, мы запускаем джемы на Амни, новый агент, пользовательские инструменты и возможность ремикширования музыки.
Взгляните на эти необработанные кадры. Мне нравится, как этот человек ходит, его присутствие, его походка. Давайте не будем ничего менять из этого. С помощью простой подсказки и ссылки на стиль Амне позволяет нам трансформировать окружающую среду, добавлять визуальные эффекты и любые другие элементы, сохраняя при этом оригинальные исполнения. А теперь вы даже можете добавлять новых персонажей, сохраняя при этом всё остальное в сцене.
Далее давайте рассмотрим наше второе крупное обновление. Новый агент в Google Flow. До сегодняшнего дня Flow мог выполнять только одно приглашение за раз. Теперь ваш агент может выполнять несколько действий одновременно. Начав с одного снимка, я могу попросить агента помочь мне найти наилучшие ракурсы съёмки для этой сцены. Программа анализирует происходящее на изображении, выбирает наиболее привлекательные ракурсы и затем бум. Одно изображение превращается в шестна уникальных видеороликов. Агент также может выполнять масштабные правки, например, изменять все сцены с раннего утра до поздней ночи. Он точно понимает контекст. Небо пустыни полностью меняется, темнеет и включаются фары, освещая пыль. Это настоящий коллаборационист, помогающий вам создавать и редактировать в масштабе.
Наше следующее обновление Flow Tools. Теперь вы можете использовать любой креативный инструмент, который только сможете придумать, прямо в Flow. Он создан вами специально для вашего уникального творческого процесса, например, для создания видеоэффектов, рисованной анимации или наложение слоёв текста. Вы можете начать с создание инструментов, обмена ими ремикширование уже сегодня.
Google Flow Music предоставляет такой же творческий контроль, который помогает артистам создавать оригинальные песни. В течение нескольких месяцев у одного из наших товарищей по команде в голове крутился фортепианный риф. Давайте послушаем его оригинальную запись. Это классная основа, но он хотел превратить её в демо-версию, чтобы направлять свою группу. Поэтому он записал своё пианино на Flow Music и пообещал. Эта песня в стиле Аранби с женским вокалом, призванная вдохновить певицу из его группы. Давайте послушаем. Это не финальная версия трека, но она помогла его группе решить, что записывать дальше. Все эти функции Google, в том числе новые функции Google Flow и Google Flow Music доступны уже сегодня.
>> Так, это заявление на увольнение. Тут сразу моё резюме. >> А что тебя не устраивает? >> Что меня не устраивает? >> Что приходят люди на зарплату сразу в два раза выше моей. Почему ты ещё в два раза младше меня? А мне при нашем повышении в 20% надо 5 лет >> Просто работать. >> Нет, чтобы было повышение, надо прям При этом у неё тоже всё это время будет повышение. Получается, я её никогда не догоню. Я как ё пёс за этим хвостом, который никогда его не поймает. Так в трудовой у меня и напишите. А ещё я умру раньше неё. >> Не, ну это не факт. >> Факт, потому что я работаю больше неё, чтобы у меня было повышение. Это бляд. Поэтому мне проще уволиться и заново устроиться. >> В резюме написано стрессоустойчиво. вычеркни на