НовостиАкцииAlibaba выпускает Qwen3.8-Max с открытыми весами, бросая вызов Claude и ChatGPT по стоимости и распространению

Alibaba выпускает Qwen3.8-Max с открытыми весами, бросая вызов Claude и ChatGPT по стоимости и распространению

Автор: Decrypt·

Ключевые выводы

  • Alibaba опубликовала Qwen3.8-Max с открытыми весами, сделав её первой моделью класса Max, доступной для бесплатного скачивания и самостоятельного хостинга.
  • Модель на 2,4 триллиона параметров использует архитектуру Mixture-of-Experts, активирующую лишь 95 миллиардов параметров за одно вычисление для снижения затрат на инференс при сохранении общей ёмкости.
  • Qwen3.8-Max лидирует в большинстве категорий бенчмарков для мультимодальных задач с документами, видео и пространственным мышлением, но выиграла только семь из тридцати одного текстового теста и один из двенадцати тестов на программирование.
  • Alibaba заявляет, что Qwen3.8-Max работает примерно за 30% от стоимости Claude Fable 5 от Anthropic, что делает её значительно более дешёвую альтернативой даже при необходимости дополнительных этапов рассуждения.
  • Релиз с открытыми весами знаменует стратегический разворот по сравнению с апрелем, когда Alibaba упразднила бесплатный уровень Qwen Code в рамках более широкого перехода к закрытым платным моделям.
Alibaba выпускает Qwen3.8-Max с открытыми весами, бросая вызов Claude и ChatGPT по стоимости и распространению

Alibaba выпустила Qwen3.8-Max — самую мощную модель искусственного интеллекта из когда-либо созданных компанией. Это первый случай, когда Alibaba предоставила модель класса Qwen Max в формате открытых весов.

Веса модели будут опубликованы на Hugging Face и ModelScope на неделе после запуска в понедельник. Общий объём модели составляет 2,4 триллиона параметров, из которых 95 миллиардов активируются в любой момент времени. Модель использует архитектуру Mixture-of-Experts, которая направляет каждое вычисление через подмножество специализированных подсетей, а не задействует всю модель целиком. Такая конструкция сохраняет общую ёмкость модели при одновременном снижении затрат на инференс. Она предназначена для того, чтобы малые предприятия и исследовательские лаборатории с достаточным оборудованием могли запускать передовую систему без затрат на токены, связанных с обращением к API крупного дата-центра.

Упор на автономную производительность

Вместо того чтобы начинать с традиционных сравнений в бенчмарках, Alibaba сделала акцент на устойчивых автономных возможностях модели. По словам компании, Qwen3.8-Max потратила 16 дней на самостоятельную разработку инструмента для программирования, создав 265 коммитов, 127 pull-запросов и 151 issue без участия человека. Также сообщается, что за пять дней модель воспроизвела научную статью, исходный код которой у неё отсутствовал, а затем превзошла оригинальные результаты статьи на 2,7 балла. На 24-часовом соревновании по машинному обучению модель обошла 458 из 526 участвующих команд человека.

Совместимость с инструментами конкурентов

Qwen3.8-Max поставляется с инструкциями по настройке для Claude Code от Anthropic и Codex от OpenAI — обе являются конкурирующими платформами. API Alibaba совместим с протоколами обеих компаний, и большинство бенчмарков модели по программированию проводились внутри Claude Code.

Однако результаты бенчмарков неоднозначны. Из 31 текстового теста в собственной таблице оценок Alibaba первое место в 15 категориях заняла Fable 5 от Anthropic, GPT-5.6 Sol от OpenAI взяла девять, а Qwen3.8-Max выиграла семь. Из 12 тестов, специфичных для программирования, Qwen выиграла ровно один.

Модель выделяется экономической эффективностью. Alibaba заявляет, что Qwen3.8-Max работает примерно за 30% от того, что Anthropic берёт за Claude Fable 5. Это означает, что даже при необходимости дополнительных итераций или этапов рассуждения общая стоимость выполнения задачи остаётся существенно ниже.

Ранжирование существенно меняется в мультимодальных задачах, включающих работу с документами, видео и пространственным мышлением, где Qwen3.8-Max лидирует в большинстве категорий бенчмарков.

Стратегический разворот в сторону открытого доступа

Релиз знаменует собой заметное изменение направления. В апреле Alibaba упразднила бесплатный уровень Qwen Code, и команда перешла к закрытым платным моделям после уходов из руководства. В обзоре Qwen 3.7 Max от Decrypt ранее отмечалось, что хотя версия Plus будет открытой, вариант Max, как ожидалось, останется доступным только через API.

Время релиза с открытыми весами совпадает с более широкими изменениями в ландшафте ИИ. Доля китайских моделей с открытыми весами выросла с менее 2% токенов, обрабатываемых на OpenRouter в конце 2024 года, примерно до 61% к середине 2026 года. Qwen превзошла Llama от Meta, став самой используемой моделью для самостоятельного хостинга в мире.

Доступность открытых весов означает, что организации могут скачивать, проверять и запускать модель на собственной инфраструктуре — привлекательное предложение для предприятий с требованиями к суверенитету данных или желающих избежать привязки к поставщику, особенно на фоне геополитической напряжённости, усложняющей трансграничные зависимости от API.

Тем временем Вашингтон ввёл ограничения на экспорт Fable 5 и Mythos 5 в июне, а Пекин, как сообщается, рассматривает собственные ограничения на развёртывание китайских моделей за рубежом.

Хотя Qwen3.8-Max уступает конкурентам в ряде рейтингов бенчмарков, Alibaba, по-видимому, отдаёт приоритет распространению и доступности, позиционируя модель как бесплатную загружаемую альтернативу, которая приближается к производительности ведущих проприетарных систем при доле их стоимости.