📱

Get Our Mobile App

Take your business learning on the go!

Download on the App StoreGet it on Google Play

2025 — Обзор прошедшего года ИИ. Что будет в 2026?

Александр Красноложкин33:34

Transcription

Всем привет. Очень стремительно пролетел 2025 год. Вроде бы я только что записывал ролик про двадцать четвёртый год. И вот уже пролетело 12 месяцев, и пришло время сделать новый обзор. И это было очень насыщенное время. Сегодня мы вновь сделаем обзор, попробуем сделать какие-то выводы и даже прикинуть, что нас может ждать в следующем году. А если вы хотите ещё больше проникнуться скоростью прогресса, то рекомендую посмотреть и предыдущий ролик.

А сейчас давайте начнём прямо с самого начала 2025 года. Январь. 20 января 2025 года была выпущена модель Deepsek R1. В двадцать четвёртом году китайский стартап Deeps наделал немало шума, но версия R1, то есть рассуждающая версия модели - это то, что сделало его воистину популярным. Весь последующий месяц мировые СМИ называли deпсик феноменом. в частности, из-за стоимости обучения, которая якобы в сотни или даже тысячи раз ниже, чем затраты на обучение чат GPT или CLТ. И это при том, что R1 не так уж и сильно уступала западным решениям. Но чуть позже всплыли подробности, которые косвенно подтверждают, что Великое китайское чудо, возможно, не такое уж и чудо. Некоторые специалисты подозревают, что реальные и весьма солидные затраты на эту модель просто скрываются. скрываются разработчиками ради хайпа или даже для политических целей самого Китая. Правда это или нет, до сих пор достоверно неизвестно, но выпуск R1 важен в первую очередь тем, что он подтвердил отраслевой стандарт. Именно здесь стало понятно, что рассуждающие модели стали базовой опцией и самым важным направлением для каждого уважающего себя чатбота, что мы будем видеть весь последующий год.

Tesla показала улучшенную версию гуманоидного робота Optimus с более быстрой походкой и лучшей ловкостью рук. Было заявлено, что для развёртывания роботов на заводе Tтеesla, где они будут принимать участие в сборке автомобилей, остались считанные месяцы. В конце месяца вышла GPT O3 Mini от Open AI. Это компактная модель рассуждений, достигшая уровня О1, первой рассуждающей модели, которая вышла несколькими месяцами ранее и показывала невероятные на тот момент результаты по многим тестам. Но при почти одинаковом уровне способности O3 оказалась более быстрой и более дешёвой. Это позволило предоставить доступ к ней даже бесплатным пользователям CH GPT, пускай и по сильно ограниченным лимитам. Так что январь стал месяцем, когда рассуждающие модели стали относительно дешёвыми и доступными почти для всех желающих. И это при том, что запуска первой такой модели О1 прошло менее полугода.

В этом же месяце Open AI, Oracle и Microsoft запускают проект Stargate. Это огромная сеть крупных дата-центров, созданная под работу EИ. Суммарно планируется постройка более 20 дата-центров по всей территории США. Общей мощностью энергопотребления более 10 ГВт. Это в полтора раза больше, чем среднесуточное энергопотребление Нью-Йорка. Первые стройки по программе Stargate начались сразу же в январе.

Февраль. Андрей Карпатый, ведущий мировой специалист в области машинного обучения, впервые вёл в оборот терминкодинг. Так он назвал стиль программирования при помощи нейронок, когда вы даёте команду на естественном языке, а в ответ получаете рабочий код и просто запускаете его. Термин стал настолько понятным и популярным, что в ноябре составители словаря Colin's English Dictionary назвали vibe codдинг словом года.

Google Gemini 2.0 Flash стало доступно для всех пользователей и разработчиков 5 февраля увеличилось контекстное окно со 128.000 токенов до 1 млн. Для разработчиков это был огромный подарок, ведь теперь они смогли работать с более объёмной кодовой базой. Также улучшились мультимодальные способности, то есть работа с входящими изображениями видео и аудио. Ну и, конечно же, увеличена скорость работы модели вместе с более высокими интеллектуальными способностями.

Компания Figer AI представила Helкс, прототип гуманоидного робота, способного помогать по дому. Вероятно, компания рассчитывает производить роботов не только для коммерческого, но и для домашнего использования. Компания OneX того же мнения. Они также представили робота для работы по дому под названием Неомамама, но этот робот стал знаменитостью скорее благодаря мэмам, чем каким-то инновационным технологиям.

17 февраля компания Elна Muska XAI выпускает GRК 3. Эта версия сконцентрировалась на продвинутых режимах рассуждения, сделав их по-настоящему полезными для глубокого анализа математических и научных задач, а также добавили режим поиска в интернете для работы с актуальными данными. Грок 3 интересен тем, что впервые был обучен с использованием суперкомпьютера Colossus, который состоит примерно из 200.000 видеокарт Nvidia H100. В итоге на обучение было затрачено в 10 раз больше вычислительной мощности, чем для предыдущей версии. 200.000 видеокарт для обучения модели. Эта цифра прекрасно демонстрирует просто сумасшедшую гонку вычислительных ресурсов, о которых я много раз говорил в своих других видео. Теперь вы понимаете, почему так подорожали видеокарты и оперативка.

24 февраля компания Antropic запускает Clot Sonet 3.7, самую интеллектуальную на тот момент и первую гибридную модель рассуждений на рынке. Всё как у всех. Более высокие способности в различных задачах, более качественные рассуждения, работающие в нескольких режимах, а также впечатляющие результаты в тестах на навыки программирования.

Яндекс объявил о выпуске своей AI модели пятого поколения Яндекс GPT5 Pro, которая была интегрирована в чат с Алисой Pro. Новая модель предоставила доступ к режиму пошаговых рассуждений, ла-режиму для распознавания объектов через камеру смартфона и к работе с файлами.

В этом же месяце Microsoft представляет F4 мультимоде, модель, способную одновременно обрабатывать текст, изображения и аудио в единой архитектуре, без необходимости собирать конструктор из разных моделей для обработки разных типов данных. В тестах F4 звёзд с неба не хватало, но компенсировало это тремя важными преимуществами: компактностью, которая позволяет запускать её даже на домашних устройствах, нормальным контекстным окном в 128.000 токенов и главное открытым исходным кодом и весами.

Март. В этом месяце крупные китайские компании начали активно вливаться в мейнстрим. АIBA запустила Н 32B, моделью рассуждений с 32 млрдами параметров, которая, по заявлениям, компания превосходила О1 Mini от Open AI и конкурировала с самой мощной открытой моделью рассуждений Deeps R1. Китайская BDO представила сразу две мощные модели Erni 4.5- универсальную версию с базовыми возможностями рассуждений и мультимодальными функциями, а также Erni X1 модель, работающую с углублёнными рассуждениями для задач, требующих сложных многошаговых размышлений. Ernia 4.5 продемонстрировала производительность, превосходящую GPT 4.5 в некоторых бенчмарках при значительно более низкой стоимости обучения и инференса.

На мартовской конференции GTC президент Nvidia представил робота персонажа Blue, разработанного совместно с Disney Resarch и Google Deep Mind. Презентация показала, что Steк Ei может управлять даже физическим агентом с плавными и выразительными движениями, а не просто делать его промышленным манипулятором.

13 марта Сбер выпускает Gigча 2.0 в трёх исполнениях: Lite для быстрых и лёгких задач, про для несложного анализа и генерации творческих текстов и рассуждающую модель Мак для анализа сложных данных и программирования. Также Гигачат научился генерировать сложные медиа, например, музыку и песни длительностью до 3 минут.

А Google вновь удивил. Спустя всего 48 дней после публикации Gemini 2.0 была выпущена версия 2.5 Pro в экспериментальном исполнении. Она стала более продуктивной, показывая высокие результаты в тестах на рассуждение, написание кода и мультимодальном понимании. А пользователи обратили внимание на более человечные ответы по сравнению с предыдущими поколениями Джемини. Контекстное окно было увеличено до 1 млн токенов, как ранее сделали для флш. И в целом модель показала себя очень хорошо в решении логических задач и программирования. Почти на весь оставшийся год версия 2.5 Pro станет флагманской моделью Gemini, ну или Gemini, как вам удобнее говорить, и заставит понервничать конкурентов, постепенно отнимая пользователей даже учат GPT. По моему субъективному мнению, именно с этого момента Google перестаёт отставать в гонке чатботов и крепко занимает лидирующие позиции.

Figer AI объявляет о запуске Botq фабрики. рассчитаны на выпуск до 12.000 гуманоидных роботов в год. Кажется, компания начинает переходить от штучных прототипов к серийному масштабу производства человеко-подобных машин.

Апрель. 4 апреля компания Mме представила Lama 4 Scout и Lama 4 Maveric. Первые открытые нативно-мультимодальные модели с огромной длиной контекста. До 10 млн токенов версии Скаут и 1 млн версии Maverриic. Для понимания 10 млн токенов - это примерно 15.000 страниц текста. А ещё обе модели обрабатывают тексты изображения в едином контуре без отдельных вспомогательных модулей. Однако в них не оказалось механизма глубокого рассуждения.

Свершился релизмеджур версии 7. Она стала первым большим обновлением почти за год. Улучшенный фотореализм, анатомия рук и лица и понимание промтов, а также работа с текстом на изображениях.

16 апреля Open AI выпускает для всех пользователей модели O3 и O4 Mini. O3 - это следующее поколение рассуждающих моделей, которые обучено думать ещё дольше и глубже, показывая лучшие результаты по многошаговым рассуждениям математике, научных задачах и программировании. Естественно, на момент выхода она разрывает не только все остальные модели многочисленных тестах, но и все YouTube каналы, посвящённые ИИ технологиям. Выпущенная вместе с ней Они - это более компактная версия модели, которая заменила О3 Mini, которая, с одной стороны даёт вам рассуждение, а с другой стороны не берёт слишком много денег.

А на следующий день, 17 апреля, в экспериментальной версии выкатили Gemini 2.5 Flash. По сравнению с версией 2 улучшили производительность, понимание и рассуждения, которое можно вызвать по требованию. А ещё научили лучше следовать инструкциям пользователя.

Май. 20 мая Google проводит крупную конференцию Google IO и, естественно, выкатывает новые модели: Imagine 4 для генерации изображений и VO3 для генерации видео. Именно с VO 3 началась волна тех самых псевдореалистичных шорсов, которые летом буквально заполонили весь YouTube. Кроме того, что модель генерировала видео высокой детализации, она создавала его сразу с фоновыми звуками и даже речью, позволяя создавать полноценные видеоролики. Ул Смит, поедающий спагетти одобряет огромный прогресс, который видеомодели прошли всего за 2 года.

22 маяropic представляет клод OPUS 4 и Sonet 4. Новые гибридные рассуждающие модели, поддерживающие до 200.000 токенов в контексте. Они унаследовали и прокачали идеи предыдущих моделей, а именно поддержку двух режимов мышления: быстрого отклика и углубленного рассуждения. К этому моменту модели антроopic прочно заняли две ниши: программирование и творческое письмо. Кажется, Антропик поняла, в чём сильны её модели, и стала делать акцент именно на пользе для разработчиков. Однако люди, которые используют ИИ и для создания рекламных текстов, сценариев или текстовых ролевых игр, также часто отдают предпочтение именно Клоду за счёт более человечных и в чём-то даже более эмпатичных ответов.

Малоизвестная компания Локи представила своего робота для уборки помещений. Возможно, будущее роботов-пылесосов выглядит именно так.

29 мая французский стартап Мистраль выпустил сразу несколько моделей: Medium 3, код и документ AI для работы с базовыми мультимодальными задачами, кодом и корпоративными документами. Некоторые модели были выпущены каксы, а другие остались закрытыми. В целом в 2025 году MRI AI слегка ушёл в тень, особенно на фоне ожесточённой борьбы между Google Antropic и Open AI. Но всё же Мистраль остаётся одним из самых крупнейших и стартапов Европы. Он стабильно привлекает финансирование, вероятно, используя его для разработки моделей с узкоспециализированными задачами.

Июнь. Этот месяц оказался самым прохладным месяцем в индустрии и обошёлся без крупных релизов. Google запустил Gemini CLI, агент E с открытым исходным кодом, предназначеный для работы прямо в терминале. А ещё была запущена модель Flash Light. Экстремально быстрая и дешёвая модель для работы с простейшими задачами, например, переводом или расшифровкой текста.

Фигр показали своего робота O2, обученного сортировки мусора. На видео заметен хороший прогресс в работе с мелкой моторикой.

Компания Tesla показала видео, в котором её автомобиль Tesla Model Y сам доставляет себя до клиента. Таким образом, Tesla показывает, что автоиндустрия почти преодолела последние препятствия к полностью автономному вождению. По крайней мере, в городской местности. Также компания объявила о первом запуске её собственного Ротакси.

Июль. Спустя 5 месяцев после релиза третьей версии XAI выпускает грок 4. Вновь улучшение мультимодальности, понимания, рассуждения и так далее. Ну, вы уже поняли, что почти каждый месяц релиз каждой компании будет прокачивать именно эти показатели. И я даже не буду повторять это вновь. Также контекст Грок 4 повышен до 265.000 тысяч токенов и добавлен режим Heavy, мультиагентная версия, где несколько моделей параллельно решают задачу, повышая качество результата. А ещё Code- специализированная версия для программирования с улучшенной производительностью в задачах создания, отладки и понимания кода. В отдельных тестах модели четвёртой серии потеснили конкурентов от Open AI и Antropic, но ненадолго.

А ещё компания X представила Анни. Это первый виртуальный компаньон, позиционируемый как и девушка. системой визуальных реакций и даже режимом для взрослых. Ани представлена в стиле аниме девушки, лисы, панды и других аватаров, с которыми можно общаться голосом или текстом.

Компания UBTтеch показала робота S2, который способен самостоятельно заменять собственную аккумуляторную батарею. Весьма очевидный, но вполне рабочий способ поддерживать автономность роботов. По крайней мере, на производстве.

Google Deepmind выпускает альфагеном, глубокую EИ модель для интерпретации человеческого генома. Например, для предсказания, как генетические вариации влияют на регуляцию генов, экспрессию, структуру хроматина и другие биологические процессы. В отличие от традиционных языковых моделей, альфа-геном ориентирована не на текст, а на биологические последовательности ДНК, где она изучает функцию и регуляцию на молекулярном уровне. Deepmind продолжает прокачивать научное направление для создания, скажем так, биологического ИИ, который наряду с Альpфафол помогает лучше понять биологию человека на микроуровне.

AIB представила Квен 3, следующее поколение своей открытой модели с улучшенными возможностями рассуждения и мультимодальной обработки. Эта модель с открытым исходным кодом вошла в топ-5 лучших языковых моделей июля 2025 года, по крайней мере, по результатам некоторых рейтингов.

И поисковик Perplexity выпускает собственный интернет-браузер Comet с функциями агентов. Он способен выполнять действия по запросам пользователя, например, анализировать, суммировать или автоматизировать некоторые задачи.

Август. В начале месяца Antropic представил уклод OPUS 4.1, улучшенную версию с усилениями в агентских задачах и программировании. Релиз произошёл на фоне впечатляющего роста антроopic. Годовая повторяющаяся выручка с подписок выросла с 1 млрд до 5 млрд всего за 7 месяцев.

7 августа Open AI выпустила долгожданную модель GPT5. С релиза предыдущей генеральной версии GPT4 прошло почти 2 12 года, поэтому выпуск пятёрки стал значимым событием. Она стала самой интеллектуальной моделью Open, ey, лидирующей в бенчмарках по рассуждениям и знаниям, и обладая более острыми и адаптивными способностями рассуждений по сравнению с той же GPT 4.5. Однако перегретые и, я бы даже сказал, перехайпленные ожидания от этой модели вызвали неоднозначную реакцию пользователей по самым неожиданным причинам. Это было странное явление, о котором я даже снял отдельное видео. Но как бы там ни было, Open показали серьёзный технический рывок, который подтвердился множественными тестами.

Google Deepmind выпустила Джен 3, универсальную мировую EI модель, способную генерировать разнообразные интерактивное окружение из одного текстового запроса. Система создаёт целые виртуальные миры, с которыми пользователи могут взаимодействовать в реальном времени, на ходу, меняя их своими промтами. В каком-то смысле Дженни 3 - это прабабушка Галадека из Стартрека.

UNI3 объявила о старте продаж доступного гуманоидного робота R1. Стоимость примерно от 5.900 долларов. А тем временем Международная федерация работотехники опубликовала аналитический документ, где прямо называют гуманоидов следующим большим шагом и подчёркивает роль Китая как крупнейшего рынка промышленных роботов.

В конце месяца Google выдала нам новую модель Nнобана, топовую модель генерации и, главное, для редактирования изображений. С помощью неё можно не просто создавать суперреалистичные изображения, а по сути создавать фотографии, но и редактировать уже существующие фото. Например, можно попросить отредактировать какую-то мелочь, восстановить повреждённые изображения или даже смешать несколько фотографий в одну. И всё это по одному текстовому запросу. Помните, как раньше про сомнительные фото говорили: "Это Photoshop". Вот теперь про такие фото можно говорить: это нанобана.

Ещё Google выпустил Gemini Nano, модель для локальной работы на телефонав Pixel. Это первые шаги в тренде на развёртывание моделей прямо на устройствах, так что уже в недалёком будущем и будет в каждом кармане. Вероятно, простые задачи будут выполнять локальные модели даже без доступа в интернет, а более сложные будут обрабатываться уже в облаке. А также в августе Google стал активно внедрять EИ функции прямо в поиск. По сути, отбирая хлеб у специализированных EИ поисковиков, таких как Perplexity.

Сентябрь. By Dance представила Cdream 4.0. Комплексный инструмент для генерации редактирования изображений, созданный, вероятно, для конкуренции с нанобана от Google. Система объединяет создание и редактирование изображений, позволяя генерировать постеры, инфографику и реалистичные изображения с помощью текстовых запросов.

Antropic выкатила Clotet 4.5, флагманскую модель, позиционируемую как лучшая модель для кодирования в мире. Она продемонстрировала способность автономной работы более 30 часов. Также модель показала снижение использования токенов на 84% при редактировании контекста и нулевой процент ошибок в редактировании кода по внутренним бенчмаркам Replit.

Open AI запустила со 2, улучшенную модель генерации видео. Она была выпущена сразу вместе с Седакой социальной сетью для создания и обмена и видео. Модель сильно превзошла первую версию в качестве генерированного видео, реалистичности движений и точности следования инструкциям пользователя.

Apple выпустила крупное обновление Apple Intelligence для своих устройств. Из наиболее интересного функция Live Translation для перевода текста и голоса в реальном времени в приложениях Message, FaceTime и телефонных звонках.

AIbabба представила 3 Max. флагманскую модель с триллионом параметров, оснащённую как режимом рассуждений, так и обычным режимом. Модель способна обрабатывать до 260.000 токенов, поддерживает вызов инструментов и показала замечательные результаты в кодировании, сложных рассуждениях и даже агентских задачах.

Google Deepmind представила семейство Gemini Robotics 1.5, открыв эру физических агентов. Эти модели позволяют роботам видеть, планировать, думать и использовать инструменты для решения сложных многоступенчатых задач и делают это значительно лучше, чем предыдущие версии.

Microsoft запускает проект Fairwer AI Super Factory в Висконсине, который позиционирует как самый мощный EИ дата-центр в мире. Окончание проекта планируется на 2028 год.

Октябрь. В середине месяца Antropic выпустила клод Хайку 4.5, самую быструю модель в семействе Clot с 10 млрдами параметров. Модель оптимизирована для задач, требующих качественных, но быстрых ответов, включая суммаризацию и понимание текстов.

NVIDIA показала 4 модель на 340 млрд параметров, позиционируемую как чемпион в генерации синтетических данных. Как я рассказывал в предыдущем видео, недостаток новых данных для обучения моделей, которые по сути уже выкачали весь интернет - это большая проблема для многих компаний. И Нетron решает эту задачу, ведь он разработан для создания обучающих датасетов для других EИ -систем.

Google AI объявила о запуске Oncology Model. Это новая модель для открытия методов лечения рака, использующая генеративную биосимуляцию для идентификации потенциальных терапий. Ранее результаты показывают повышенную точность предсказаний взаимодействий терапии в онкологических испытаниях.

Также в этом месяце запускает АТLС веб-браузер с глубокой интеграцией искусственного интеллекта Chat GPT. Он способен выполнять многозадачные операции, такие как бронирование билетов или выполнение сложного поиска.

Ноябрь. XAI выпускает GRК 4.1, улучшенную версию с расширенными возможностями рассуждений и интеграции с платформой X для доступа к данным в реальном времени. Модель показала высокую производительность на бечмарке Lifecode Bench, почти 89%.

Open AI представила GPT 5.1, улучшенную версию GPT5 с двумя режимами. Instant предназначен для диалогов с адаптивными рассуждениями, ангing для продвинутых рассуждений с динамическим распределением вычислений. По заявлениям разработчиков, версия 5.1 стала теплее в общении, лучше следует инструкциям и показывает превосходную скорость работы.

Google буквально взорвала рынок выпуском Gemini 3 Pro, флагманской версии нового поколения Gemini. Прошка сильно превзошла конкурентов в визуальных и мультимодальных задачах. качественная работа с текстом, изображениями, аудио и видео одновременно. Модель показала очень сильные результаты в задачах, требующих понимания изображения и видео, а также в программировании, математике и даже научных задачах. Также был представлен сервис Антигравити, интерфейс для развёртывания агентов, которые автономно планируют, выполняют и верифицируют сложные задачи в программировании. Вместе с этим была представлена Nano Banana Pro, улучшенная версия и без того топовые модели генерации и редактирования изображений. Теперь можно генерировать изображение в разрешении до 4К, а также модель научилась лучше работать с текстами.

Китайская Moonshot AI выпустила Kimi K2. Open source модель с производительностью, конкурирующей с крупнейшими конкурентами. Слегка уступает в тестах, но открытость кода компенсирует этот недостаток.

Представлена Simo 2 от Google Deep Mind. Это новое поколение иагента на базе Gemini, способного действовать в виртуальной среде. Агент может выполнять задачи в сложных 3D-играх и мирах, анализируя визуальный поток, то есть экран, и действуя через виртуальная мышь или клавиатуру, как это делает человек, когда играет в игры. Sма понимает высокоуровневые цели, может разбивать их на подзадачи, строить план действий и рассуждать о своём поведении, что превращает простую реакцию уже в аналитическое управление действиями. Кроме того, она показывает хорошие навыки самообучения и перенос знаний между разными виртуальными мирами. По сути, это ещё один шаг KJI. Обучившись работать в виртуальной среде на основе входящих данных, подобная система, помещённая, например, в робота, сможет научиться жить и в реальной среде.

Декабрь. 1 декабря DeepsК выпустила модель версии 3.2. 680 млрд параметров в некоторых тестах помогают достичь производительности сопоставимый с GPT5 и Gemini 3 Pro. Модель использует новую архитектуру, которую на русском проще всего назвать как разреженное внимание. Благодаря ей версия 3.2 демонстрирует сильные результаты в математике и кодирования. И в отличие от только что названных конкурентов, это открытая модель.

LA Times выпустила репортаж о невероятном росте инвестиций в гуманойных роботов. Издание сообщает, что в 2020 году было инвестировано всего 42 млн, тогда как в 2025 эти цифры выросли до 2,8 млрд. По их мнению, рынок поверил в будущее универсальных роботов и активно вкладывает в них деньги.

После выпуска Gemini 3 Pro, который Google буквально разгромила конкурентов, Openi объявила красный код внутри компании и кинула все силы на скорый выпуск GPT 5.2. В ней увеличили контекст, улучшили рассуждение, прокачали агентские задачи. И знаете, версия 5.2 - это то, чем должна была быть GPT 5.0, которую выпустили в августе. В отличие от смазанного, невнятного и даже слегка скандального летнего старта пятёрки, версия 5.2 действительно показывает мощные результаты, как в тестах, так и в жизни. У Openi получилось сделать GPT снова великой, по крайней мере, на какое-то время.

Вскоре после этого Google выпускает Gemini 3 Flash модель, превосходящую ещё недавнюю флагманскую Gemini 25.pro по 18 из двадцати основных бенчмарков. Скорость генерации до 218 токенов в секунду при экономии до 30% токенов, что делает её весьма выгодной для работы приложений в реальном времени.

XAI объявляет о начале стройки дата-центра на 500 МВт в Саудовской Аравии. А если смотреть в целом по всем странам и всем компаниям, то совокупная заявленная стоимость всех сделок по дата-центрам в 2025 году составила почти 61 млрд долларов.

Сервис Робот Аксивейма заявил о росте своего автопарка на 50% за последний год. Компания утверждает, что её автомобили еженедельно совершают 450.000 беспилотных поездок. Вейма планируют осваивать не только крупные американские города, но также и зарубежные страны. В ближайшее время сервис запустится в Лондоне и Токио.

Ну что ж, давайте подведём итоги. Конечно, это далеко не все события, которые произошли в двадцать пятом году, потому что буквально каждый день выходили новости разной степени важности, и впихнуть их все в один ролик просто невозможно. На первый взгляд может показаться, что прошедший год был менее интересным на события, чем прошлые, но это далеко не так. Во-первых, обратите внимание на короткий выпуск новых поколений или хотя бы обновление моделей всего от 3х месяцев до полугода. Это как если бы флагманская модель Самсунга или Айфона выходила бы не раз в год, а раз в квартал. при этом каждый раз повышая свои характеристики, как если бы за год мы перешли от процессора Intel 486 к какому-нибудь Pentium 2. На мой взгляд, всё, что происходило в двадцать пятом году - это логичное завершение того, что было начато в конце двадцать четвёртого. Разработчики досуха выжимали потенциал наработок прошлого года. Весь год непрерывно улучшались и совершенствовались рассуждающие модели, повышалась эффективность мультимодальности, чтобы нейросети теперь могли и видеть, и слышать, а не только читать. стали доступны первые нормальные браузерные агенты. Вдумайтесь, всего 3 года назад многие впервые увидели умного чатбота, который мог разве что ответить на вопрос, и то с ошибками, а теперь он сам ищет товары и покупает билеты. Большого прогресса достигли агентные системы, заточенные именно под программирование. Теперь профессионалы могут кодить быстрее, даже если учитывать время на вылавливание ошибок и отладку. Но что важнее, создавать сайты, мини-игры и даже лёгкие программные продукты теперь могут люди даже без навыков программирования и технического бэкграунда. Начали активно строиться и даже открываться первые огромные дата-центры, на которые деньги были выделены буквально год-полтора назад. Гуманоидные роботы улучшили свою координацию и мелкую моторику, а разработчики выпускали много софта для тренировки роботов симуляции, чтобы они были жизнеспособны и в нашей с вами реальности. Автономные роботаси запускались по всему миру весь год, и парк таких машин растёт месяц от месяца. Как я рассказывал в недавно вышедшем ролике, ведущие и их специалисты уже сами подтверждают, что из текущих технологий улучшения моделей выжато почти всё. А значит, компаниям уже совсем скоро придётся вернуться к активным исследованиям и разработкам, чтобы продолжать развитие технологий. И, как мы сегодня убедились, Google это отлично понимает. Я бы вообще назвал двадцать пятый год годом Гугла. Именно тут Google перестал быть отстающим среди разработчиков чатботов и во многом даже опередил их, выкатив огромное количество моделей под работотехнику, науку и медицину. Инсайды предсказывают, что Google ведёт разработки и тестирование новых архитектур, которые придут на смену к классическому трансформеру и, возможно, даже будут всё больше применять методы, похожие на методы мышления человека. Нейросети всё больше и больше проникают в нашу жизнь. Даже те люди, которые далеки от высоких технологий, всё чаще и чаще признаются в их использовании, в том числе для работы. Появились первые следы использования нейросетей даже в судебной российской практике. Причём используют их не только пользователи, но и помощники судей. На мой взгляд, прогресс огромен, и единственной реальной проблемой стало то, что активное развитие технологий нас попросту избаловало. Даже при выходе с самой сверхспособной модели уже нет такого удивления и такого восторга, как при выходе первой версии Chat GPT. Большинство людей уже неважно, какой версии Deepsi, 3.0 или 3.2, если он может вменяемо объяснить рецепт борща или помочь решить школьный тест. Уже неважно, какая версия модели вышла, раз она теперь показывает пять пальцев на руке, а не шесть, как раньше. Да, каждая модель становится всё лучше и лучше в работе с программированием, математикой или наукой, но всё это абсолютно не важно обычным людям, это важно только специалистам. И всё это указывает на то, что в следующем году акценты в и сфере могут измениться. Развитие ассистента в браузерах и мобильных устройствах продолжится, и я надеюсь, что мы увидим что-то более интересное, чем бронирование столика в ресторане, которое, по крайней мере, в России вообще никому не нужно. А в корпоративной сфере агентов могут начать зашивать в CRM или системы управления задачами для автономной работы, по крайней мере, с простыми операциями. В двадцать шестом году наверняка улучшится понимание моделями реальности для инструктажа пользователя в режиме онлайн. Я почти уверен, что также появятся механизмы увеличения контекстного окна с одновременным снижением галлюцинации, что позволит вести очень длинные беседы без потери качества ответов. Сейчас это всё ещё остаётся проблемой. Также можно рассчитывать на выпуск видеомоделей с повышенным качеством, консистентностью и, самое главное, длиной видео. В целом модели продолжат развитие в программировании и научных дисциплинах. Это поможет в разработке софта, но что ещё важнее, ускорит работу самих разработчиков и -моделей. А ещё за год покажут несколько интересных научных открытий или доказательства теорем, которые сделали нейросети. Кстати, в теории именно так запускается цикл так называемой технологической сингулярности. Я предполагаю, что время для массового появления робота в наших домах ещё не пришло, но это не исключает возможный запуск каких-то простых и недорогих моделей для частных пользователей в 2026 году. Ну и, конечно же, будет строиться всё больше и больше дата-центров. А также нас ждёт волна регуляции ИИ со стороны правительств, наверное, по всему миру. И как я говорил в прошлогоднем ролике, 2027 год остаётся, пускай не гарантированным, но достаточно вероятным годом для получения чего-то похожего на AGI, общий искусственный интеллект. Пожалуй, на этом я закончу разбор 2025 года, тем более, что прямо сейчас в работе находится видео, которое гораздо глубже раскрывает всю эту тему. И да, если вы хотите ускорить выпуск новых роликов или увеличить их тайминг, то можете поучаствовать в этом на бусте. Ссылка в описании. Средства, собранные при вашей поддержке, идут на покупку материалов с авторскими правами, которые часто нужны для производства новых видео. Спасибо за просмотр. Ну а с теми, кто подписан на мой канал, мы обязательно увидимся в следующих видео.