📱

Get Our Mobile App

Take your business learning on the go!

Download on the App StoreGet it on Google Play

Why Developers Are Switching to Qwen 3.7 Over GPT & Claude

AIlithic9:29

Transcription

Итак, у кого сейчас лучшая модель ИИ? Большинство людей, вероятно, сказали бы GPT, возможно, Claude, возможно, Gemini, но почти никто не упомянул бы Qwen. И вот теперь разработчики сравнивают Qwen 3.7 от Alibaba напрямую с передовыми моделями от OpenAI и Anthropic. Не как дешевую альтернативу, не как что-то, что просто хорошо для открытого исходного кода, а как серьезную систему ИИ для кодирования, автоматизации, долгосрочного рассуждения и автономных агентов. И, честно говоря, самая странная часть — это даже не тесты производительности, а направление, которое выбирает Qwen. Они начали участвовать в эре агентов, эре, где ИИ не просто отвечает на вопросы, а планирует, выполняет, отлаживает, повторяет попытки, использует инструменты и работает автономно часами. Фактически, Alibaba заявляет, что Qwen 3.7 Max успешно работал непрерывно более 35 часов без человеческого руководства во время задачи инженерной оптимизации. Это совсем не нормально. Большинство людей думают, что Qwen 3.7 — это просто Qwen 3.6, но умнее. На самом деле это не совсем так. Qwen 3.6 по-прежнему разрабатывался скорее как традиционный разговорный ИИ. Быстрые ответы, общий чат, стандартный вывод, но Qwen 3.7 полностью перешел на архитектуру, ориентированную на агентов. Вместо того чтобы оптимизировать исключительно для быстрых разговоров, Qwen 3.7 уделяет большое внимание долгосрочному рассуждению, автономным рабочим процессам, выполнению инструментов, постоянному планированию и решению многошаговых задач. Одно из самых больших обновлений — это режим глубокого мышления. В отличие от старых моделей Qwen, которые отдавали приоритет быстрой генерации текста, Qwen 3.7 Max намеренно замедляется, чтобы обдумать проблемы перед ответом. Вот почему его тесты производительности рассуждений резко выросли. Но, честно говоря, увеличение тестов производительности — это даже не самая сумасшедшая часть. Alibaba продемонстрировала, как Qwen 3.7 Max полностью автономно оптимизировал незнакомую аппаратную архитектуру в течение 35 часов подряд. Во время этой сессии он выполнил более 1100 вызовов инструментов, провел сотни оценок, исправил ошибки компиляции, переписал код и самостоятельно постоянно улучшал производительность. Это совершенно другая категория поведения ИИ. Традиционные помощники ИИ по-прежнему ведут себя как «спроси, ответь». Qwen все больше ведет себя как «цель, автономное выполнение». И именно поэтому разработчики начали обращать на него внимание.

Теперь самое главное. Qwen не объективно лучше GPT или Claude во всем. На самом деле, Claude по-прежнему доминирует по качеству предпочтений человека в рейтингах LM Arena. GPT 5.5 по-прежнему лидирует в нескольких тестах производительности рассуждений и остается более эффективным по количеству токенов. Но, несмотря на это, многие разработчики по-прежнему выбирают Qwen. Почему? Потому что рабочий процесс важнее тестов производительности, а рабочий процесс Qwen ощущается очень по-другому. Qwen ощущается более агрессивным, экспериментальным, настойчивым и высокооптимизированным для автономного выполнения, особенно для кодирования. Согласно отчетам о тестах производительности, Qwen 3.7 Max достиг 80,4 в проверенном SWE-bench, 69,7 в terminal bench и показал значительный прогресс в оценках долгосрочного кодирования. Этот показатель terminal bench очень важен. Потому что в терминальных рабочих процессах многие модели ИИ терпят неудачу. Они теряют состояние, выдумывают команды, забывают предыдущие действия или застревают в циклах. Qwen был специально обучен выживать в этих длинных цепочках выполнения, и именно поэтому разработчики, создающие агентов для кодирования, системы автоматизации, ИИ-работников, инструменты инфраструктуры и автономные конвейеры, все чаще серьезно тестируют Qwen.

Еще одна огромная причина — контекстное окно в 1 миллион токенов. Теперь, чтобы быть ясным, все передовые модели стремятся к миллиону токенов контекста. Но Qwen агрессивно оптимизируется специально для автономных рабочих процессов с длинным контекстом, и это различие имеет значение, потому что ИИ-агенты ломаются очень по-разному по сравнению с чат-ботами. Ценообразование, вероятно, является самой большой причиной перехода, потому что передовой автономный ИИ становится очень дорогим. Вот скрытая проблема, которую большинство людей не осознают. Агентные рабочие процессы сжигают безумное количество токенов, и если вы выполняете тысячи вызовов инструментов, длинные сессии кодирования или автономные рабочие процессы, ваш счет за API может быстро взлететь. Вот где Qwen становится чрезвычайно привлекательным. Сообщается, что цена Qwen 3.7 Max составляет около 2,50 доллара за миллион входных токенов и 7,50 доллара за миллион выходных токенов. Между тем, Qwen Plus еще дешевле, примерно 40 центов за вход и 1,20 доллара за выход за миллион токенов. Это значительно дешевле, чем многие западные передовые модели. И внезапно, немного менее отполированная модель становится экономически более разумной, особенно для стартапов или разработчиков, экспериментирующих с ИИ-агентами, или компаний, масштабирующих системы автоматизации. Это то же самое, что произошло в облачных вычислениях. В какой-то момент эффективность затрат становится важнее, чем наличие самой умной модели, и Alibaba знает это. Qwen больше не конкурирует только по интеллекту. Он конкурирует по соотношению цены и производительности.

Итак, какой же из них вам на самом деле следует использовать: Max или Plus? Qwen 3.7 Max и Qwen 3.7 Plus созданы для совершенно разных задач. И, честно говоря, большинство людей выбирают неправильный. Qwen 3.7 Max — это модель для тяжелых рассуждений. Он создан для кодирования, продвинутых рассуждений, автономных агентов, терминальных рабочих процессов, генерации стратегий и долгосрочного планирования. Это модель ИИ-инженера. Между тем, Qwen 3.7 Plus разработан для скорости, мультимодальных задач, изображений, OCR, визуального понимания, суммаризации и более дешевых крупномасштабных рабочих процессов. И вот важная часть. Max — только текст. Он не может обрабатывать изображения. Plus — это мультимодальная модель. Так что, если вы загружаете скриншоты, диаграммы, PDF-файлы, схемы или изображения, вам нужен Plus. Вот почему многие разработчики теперь используют рабочий процесс из двух моделей. Max обрабатывает рассуждения, планирование, архитектуру и глубокий анализ. Затем Plus обрабатывает быстрое выполнение, генерацию контента, OCR, форматирование и визуальные задачи.

Теперь давайте будем очень ясны. Qwen не доминирует в каждой категории, но есть несколько областей, где он действительно становится лучшим выбором. Номер один, долгосрочное автономное выполнение. Это, вероятно, самая большая сила Qwen. Модель была специально разработана для поддержания рассуждений на протяжении чрезвычайно длинных цепочек выполнения. Это имеет огромное значение для ИИ-агентов, систем кодирования, автоматизации инфраструктуры и терминальных рабочих процессов. Номер два, экономически эффективное масштабирование, особенно с Qwen Plus. Если ваш бизнес обрабатывает миллионы или миллиарды токенов, ценообразование Qwen становится невероятно привлекательным. Номер три, импульс открытой экосистемы. Alibaba подтвердила, что ожидается, что Plus будет двигаться в сторону экосистем с открытыми весами, в то время как Max останется проприетарным. И разработчики любят открытые экосистемы, потому что разработчики хотят гибкости, интеграции, локальных вариантов развертывания и меньшего количества ограничений. Номер четыре, выносливость в кодировании. Qwen не просто хорош в написании кода. Он хорош в поддержании рабочего процесса. Это огромное различие. Многие модели ИИ могут генерировать хорошие фрагменты кода, но поддержание согласованности в огромных кодовых базах, терминальных сессиях, циклах отладки и многофайловых рассуждениях намного сложнее. Вот где Qwen становится интересным. И номер пять, долгосрочное контекстное рассуждение. Контекстное окно в миллион токенов действительно меняет рабочие процессы для исследований, юридического анализа, гигантских репозиториев и задач, требующих большого количества документации. Вы перестаете тратить время на управление контекстом и начинаете тратить время на решение проблем.

Теперь, если это видео прозвучало слишком про-Qwen, давайте сбалансируем вещи должным образом. Потому что GPT, Claude и Gemini по-прежнему доминируют в нескольких важных областях. Claude по-прежнему лидирует по качеству диалогов, отточенности письма и более естественным ответам. GPT продолжает доминировать по зрелости экосистемы, стабильности производства и надежным рабочим процессам автоматизации. А Gemini по-прежнему имеет огромное преимущество благодаря экосистеме Google, интеграции с Android и мультимодальной инфраструктуре. Между тем, у Qwen по-прежнему есть слабости. Он иногда может казаться более многословным, медленнее во время глубоких рассуждений и менее отточенным для обычных разговоров. Фактически, Qwen 3.7 намеренно отказывается угадывать чаще, чем предыдущие модели. Его уровень галлюцинаций значительно улучшился, но это также означает, что он гораздо чаще говорит: «Я не уверен». И, честно говоря, для серьезных рабочих процессов этот компромисс, вероятно, того стоит. Потому что после всего, что мы видели, одно становится очень ясно. Qwen больше не просто еще одна альтернатива ИИ. Alibaba официально вступила в гонку передовых ИИ. И более масштабное изменение, происходящее прямо сейчас, заключается не только в том, какой чат-бот звучит умнее. Оно становится о том, какая система ИИ может действительно работать автономно. Это настоящая битва сейчас. Если вам понравилось это видео, обязательно поставьте лайк и подпишитесь. Перешли бы вы с GPT или Claude на Qwen 3.7? Дайте мне знать в комментариях. Спасибо за просмотр, и увидимся в следующем.