🛠 AI-инструменты

Qwen 3.8 Max: модель Alibaba, которая работает неделями

Михаил ИванинМихаил Иванин5 августа 2026 г.7 мин чтения
✈️
Свежие гайды и обзоры выходят в моём Telegram первыми
Подписаться →

Qwen 3.8 Max: модель Alibaba, которая работает неделями

Qwen 3.8 Max - новая флагманская модель Alibaba на 2,4 триллиона параметров, вышла 3 августа 2026. Главное отличие от предыдущих Qwen и от конкурентов - не бенчмарки, а выносливость: модель заявлена как рабочая лошадка для задач, которые длятся не минуты, а дни и недели. Alibaba сама на ней проектирует чипы и воспроизводит научные статьи. Попробовать бесплатно можно на chat.qwen.ai, API стоит $2 за миллион входных токенов и $6 за миллион выходных.

Что за Qwen 3.8 Max и почему все обсуждают выносливость

Qwen 3.8 Max - MoE-модель (Mixture of Experts) на 2,4 триллиона суммарных параметров, из которых на каждый токен активны 95 миллиардов. Плюс гибридный механизм внимания и контекст в 1 миллион токенов, максимум 131 тысяча токенов на выход. Мультимодальная: работает и с текстом, и с картинками.

По архитектуре это шаг в сторону агентов, а не чат-бота. Обычная модель хороша спринтами: задал вопрос - получил ответ, дальше про твой контекст она забыла. Такая модель тянет чат и черновики, но плохо годится для задач, где нужно неделю копать одну проблему. Alibaba целенаправленно строила Qwen 3.8 Max так, чтобы удержать нить на длинной дистанции. Отсюда и позиционирование - long-horizon model.

Как модель работает днями и что это меняет на практике

По данным Alibaba, в закрытых прогонах Qwen 3.8 Max делала такое:

  • 16 дней подряд собирала CLI-инструмент, выдав 265 коммитов.
  • Около 5 дней и 125 часов вычислений уходило на воспроизведение научной статьи с улучшением результата.
  • Полный финансовый год прогоняла в симуляции e-commerce - и учетверила стартовый капитал.
  • Около 500 итераций самостоятельного цикла "править - симулировать - синтезировать - раскладывать" в задаче на дизайн чипа.

Цифры внутренние, воспроизвести дома не получится - но важна сама рамка. Появляется класс задач, которые можно поставить один раз и уйти. Миграция большой базы, разбор архива документов за годы, крупный рефакторинг легаси, реверс-инжиниринг чужого протокола. Не "напиши мне текст", а "разбери это за неделю и покажи результат".

Пример на чипе: 8298 → 678 логических ячеек

Самая наглядная демка от Alibaba - оптимизация цифровой схемы. Модель гоняла собственный цикл: правила Verilog, запускала симуляцию, синтез, физическую раскладку, смотрела результат, снова правила. Порядка 500 итераций без человека в середине.

Итог: исходную схему сжали с 8298 логических ячеек до 678, при этом уложились в исходные ограничения по таймингам. По площади - минус 81%. Это не подсказка человеку и не автокомплит, а полноценный агент, который сам управляет длинным техническим процессом.

Что показали бенчмарки

Замеры Alibaba собственные, независимой верификации на момент выхода нет. Держи это в голове. Ключевые цифры:

БенчмаркQwen 3.8 MaxGPT-5.6 SolClaude Fable 5Claude Opus 4.8
PaperBench (воспроизведение статей)93,090,588,880,3
OSWorld-Verified (агент в десктопе)86,183,285,0-
TerminalBench 2.1 (терминал)86,6---

В агентных сценариях - работа с экраном, терминал, воспроизведение исследований - Qwen 3.8 Max сейчас лучший из показанных публично. В общих чат-задачах модель занимает 5-е место в Text Arena и 2-е в Vision Arena. То есть в разговорной части она не лидер, а вот в длинных агентных задачах - да.

Как попробовать бесплатно - chat.qwen.ai

Самый быстрый путь. Заходишь на chat.qwen.ai, выбираешь Qwen 3.8 Max из списка моделей, работаешь как с обычным чатом. Без карты, без VPN, без плясок с аккаунтом. Хороший вариант, чтобы просто пощупать модель на своих задачах и понять, стоит ли она подписки на API.

Для программной работы через API - через Alibaba Cloud Model Studio. Новым аккаунтам дают 1 миллион токенов бесплатно на активацию, но только в сингапурском (международном) регионе. После этого включается платный тариф.

Цены API

ЧтоСтоимость
Вход (input)$2 за 1 млн токенов
Выход (output)$6 за 1 млн токенов
Кэшированный вход$0,25 за 1 млн токенов

Для сравнения: предыдущий Qwen 3.7 Max стоил $2,50 и $7,50. Новая модель дешевле старой - редкий случай, обычно наоборот. API поддерживает форматы OpenAI Chat Completions и Anthropic - то есть подключается почти в любой готовый агентный харнесс без переделки клиента.

Работает с Claude Code

Alibaba отдельно указала, что Qwen 3.8 Max стабильно ходит внутри разных агентных обёрток - QwenWork, Claude Code, Codex, OpenClaw. Это значит, что в Claude Code можно подцепить не только модели Anthropic, но и Qwen через совместимый API.

Если надо переключить свой Claude Code на Qwen для длинной задачи, где важна выносливость и цена - вот готовый запрос:

В Claude Code вставь запрос:
"Настрой у меня Claude Code так, чтобы он ходил не в Claude, а в
Qwen 3.8 Max через Anthropic-совместимый эндпоинт Alibaba Cloud
Model Studio. Мой API-ключ Qwen лежит в переменной окружения
QWEN_API_KEY. Покажи, что именно поменял в конфиге, и прогони
одну проверочную команду, чтобы убедиться, что модель отвечает."

Он разберётся с базовым URL, заголовками аутентификации, форматом сообщений и проверит, что всё живо. Если Claude Code для тебя в новинку - начни с гайда для новичков.

Открытые веса и что это значит

Alibaba впервые в линейке Max выкатывает не только API, но и открытые веса. По анонсу от 3 августа 2026 - веса пойдут на Hugging Face и ModelScope "на следующей неделе", то есть примерно 10-16 августа 2026. Лицензия конкретно не указана, но факт открытых весов у 2,4-триллионного флагмана - это событие само по себе.

Что это даст на практике: возможность гонять ту же модель локально или в приватном облаке, без отправки данных в Alibaba. Порог по железу будет запретительный для большинства (сотни ГБ VRAM в топовой квантизации), но появятся GGUF-варианты через квартал-два, как получилось с Kimi K3 - и тогда возникнет реальный сценарий локального запуска для больших команд.

Qwen 3.8 Max vs GPT-5.6 Sol vs Claude Fable 5 vs Kimi K3

Крупные модели сейчас идут почти вровень, различаются акцентами.

  • GPT-5.6 Sol от OpenAI - широкий чат-агент, лучшая интеграция экосистемы, самая большая база пользователей.
  • Claude Fable 5 от Anthropic - сильнее всех в коде и рассуждениях, лучший partner для программирования, самый строгий по безопасности.
  • Qwen 3.8 Max от Alibaba - выносливость на длинных задачах, дешёвый API, скоро откроют веса.
  • Kimi K3 от Moonshot AI - топовая опен-сорс модель, лицензия Apache 2.0, гоняется даже локально на 8 ГБ ОЗУ.

Правило простое: чат и черновики - что удобно и оплачено; длинная агентная задача с прицелом "поставил и ушёл" - смотри Qwen 3.8 Max; данные не должны уходить наружу - смотри Kimi K3 локально.

Кому реально пригодится

По-честному, для большинства задач хватит того, что уже подключено. Qwen 3.8 Max имеет смысл смотреть в трёх сценариях:

  1. Длинные автономные прогоны. Реверс, миграция, разбор архива, аудит большой кодовой базы - там, где Claude или GPT теряют нить на многочасовой задаче.
  2. Дешёвый API для агентов. $2/$6 против $15/$75 у Claude Opus - разница на порядок. Если крутишь много агентных вызовов, экономия ощутимая.
  3. Работа из РФ. Alibaba Cloud российским аккаунтам и картам не отказывает - в отличие от OpenAI и Anthropic. Проверять на своём кейсе, но барьер входа ниже.

FAQ

Реально работает 10 дней подряд?

В примерах Alibaba - да и больше: 16 дней на CLI-проекте с 265 коммитами, 5 дней на воспроизведении статьи, полный симулированный финансовый год в e-commerce. Замеры внутренние, независимой проверки пока нет.

Сколько стоит попробовать?

Бесплатно через chat.qwen.ai - без карты и без ограничений на пробу. Через API - $2 за миллион входных токенов, $6 за миллион выходных на Alibaba Cloud Model Studio, плюс 1 миллион бесплатных токенов на новый аккаунт в сингапурском регионе.

Можно подключить в Claude Code?

Да. Qwen 3.8 Max держит формат Anthropic API, Claude Code подключается через смену базового URL и ключа. Alibaba сама указывает Claude Code в списке проверенных агентных харнессов.

Работает из России?

Alibaba Cloud российским IP и картам не отказывает, регистрация проходит без VPN на момент выхода модели. chat.qwen.ai открывается напрямую. Проверять на своём кейсе, инфраструктура Alibaba может меняться.

Веса открытые?

Обещаны на Hugging Face и ModelScope в неделю 10-16 августа 2026. На момент выхода статьи (3 августа) веса ещё не выложены, доступна только API-версия. Это будет первый "открытый" флагман в линейке Max от Alibaba.

Она лучше Claude или GPT?

Зависит от задачи. В длинных агентных прогонах и работе с десктопом - по бенчмаркам Alibaba, да. В разговорной части и коде - паритет или отставание. Считай Qwen 3.8 Max специализированной моделью под долгие автономные задачи, а не универсальной заменой.

Что дальше

Если хочешь собрать такую систему у себя - у меня есть курс по вайбкодингу и работе с нейросетями в клубе Мандарин Лаб: mandarinedu.ru. Первые уроки открыты бесплатно.

Если нужно внедрить ИИ в бизнес - процессы, агентов, автоматизацию под вашу задачу - пишите мне напрямую: t.me/Philigranchik. Разберу задачу и скажу, что реально автоматизируется, а что нет.

Бесплатный первый урок

Хочешь собрать это сам - с нуля до первого клиента?

В первом уроке показываю весь путь по шагам: ставим Claude Code, собираем первый рабочий инструмент и как на этом начать зарабатывать. Без воды и без кода.

Смотреть первый урок →
Михаил Иванин
Об авторе
Михаил Иванин

Вайбкодер-разработчик и маркетолог с 9-летним опытом, основатель «Мандарин Лаб». Собирает на ИИ то, за что раньше платили подрядчикам сотни тысяч: CRM, ботов, автоматизации, монтаж. Одну из систем строил под агентство недвижимости с базой в 400 000 лидов. Теперь учит этому с нуля - как за вечер собрать свой инструмент через Claude Code и зарабатывать на нейросетях.

Telegram @mike_cmo →
#qwen 3.8 max#alibaba#long-horizon ai#ии-агенты#открытые веса#chat.qwen.ai