Qwen 3.8 Max: модель Alibaba, которая работает неделями
Qwen 3.8 Max: модель Alibaba, которая работает неделями
Qwen 3.8 Max - новая флагманская модель Alibaba на 2,4 триллиона параметров, вышла 3 августа 2026. Главное отличие от предыдущих Qwen и от конкурентов - не бенчмарки, а выносливость: модель заявлена как рабочая лошадка для задач, которые длятся не минуты, а дни и недели. Alibaba сама на ней проектирует чипы и воспроизводит научные статьи. Попробовать бесплатно можно на chat.qwen.ai, API стоит $2 за миллион входных токенов и $6 за миллион выходных.
Что за Qwen 3.8 Max и почему все обсуждают выносливость
Qwen 3.8 Max - MoE-модель (Mixture of Experts) на 2,4 триллиона суммарных параметров, из которых на каждый токен активны 95 миллиардов. Плюс гибридный механизм внимания и контекст в 1 миллион токенов, максимум 131 тысяча токенов на выход. Мультимодальная: работает и с текстом, и с картинками.
По архитектуре это шаг в сторону агентов, а не чат-бота. Обычная модель хороша спринтами: задал вопрос - получил ответ, дальше про твой контекст она забыла. Такая модель тянет чат и черновики, но плохо годится для задач, где нужно неделю копать одну проблему. Alibaba целенаправленно строила Qwen 3.8 Max так, чтобы удержать нить на длинной дистанции. Отсюда и позиционирование - long-horizon model.
Как модель работает днями и что это меняет на практике
По данным Alibaba, в закрытых прогонах Qwen 3.8 Max делала такое:
- 16 дней подряд собирала CLI-инструмент, выдав 265 коммитов.
- Около 5 дней и 125 часов вычислений уходило на воспроизведение научной статьи с улучшением результата.
- Полный финансовый год прогоняла в симуляции e-commerce - и учетверила стартовый капитал.
- Около 500 итераций самостоятельного цикла "править - симулировать - синтезировать - раскладывать" в задаче на дизайн чипа.
Цифры внутренние, воспроизвести дома не получится - но важна сама рамка. Появляется класс задач, которые можно поставить один раз и уйти. Миграция большой базы, разбор архива документов за годы, крупный рефакторинг легаси, реверс-инжиниринг чужого протокола. Не "напиши мне текст", а "разбери это за неделю и покажи результат".
Пример на чипе: 8298 → 678 логических ячеек
Самая наглядная демка от Alibaba - оптимизация цифровой схемы. Модель гоняла собственный цикл: правила Verilog, запускала симуляцию, синтез, физическую раскладку, смотрела результат, снова правила. Порядка 500 итераций без человека в середине.
Итог: исходную схему сжали с 8298 логических ячеек до 678, при этом уложились в исходные ограничения по таймингам. По площади - минус 81%. Это не подсказка человеку и не автокомплит, а полноценный агент, который сам управляет длинным техническим процессом.
Что показали бенчмарки
Замеры Alibaba собственные, независимой верификации на момент выхода нет. Держи это в голове. Ключевые цифры:
| Бенчмарк | Qwen 3.8 Max | GPT-5.6 Sol | Claude Fable 5 | Claude Opus 4.8 |
|---|---|---|---|---|
| PaperBench (воспроизведение статей) | 93,0 | 90,5 | 88,8 | 80,3 |
| OSWorld-Verified (агент в десктопе) | 86,1 | 83,2 | 85,0 | - |
| TerminalBench 2.1 (терминал) | 86,6 | - | - | - |
В агентных сценариях - работа с экраном, терминал, воспроизведение исследований - Qwen 3.8 Max сейчас лучший из показанных публично. В общих чат-задачах модель занимает 5-е место в Text Arena и 2-е в Vision Arena. То есть в разговорной части она не лидер, а вот в длинных агентных задачах - да.
Как попробовать бесплатно - chat.qwen.ai
Самый быстрый путь. Заходишь на chat.qwen.ai, выбираешь Qwen 3.8 Max из списка моделей, работаешь как с обычным чатом. Без карты, без VPN, без плясок с аккаунтом. Хороший вариант, чтобы просто пощупать модель на своих задачах и понять, стоит ли она подписки на API.
Для программной работы через API - через Alibaba Cloud Model Studio. Новым аккаунтам дают 1 миллион токенов бесплатно на активацию, но только в сингапурском (международном) регионе. После этого включается платный тариф.
Цены API
| Что | Стоимость |
|---|---|
| Вход (input) | $2 за 1 млн токенов |
| Выход (output) | $6 за 1 млн токенов |
| Кэшированный вход | $0,25 за 1 млн токенов |
Для сравнения: предыдущий Qwen 3.7 Max стоил $2,50 и $7,50. Новая модель дешевле старой - редкий случай, обычно наоборот. API поддерживает форматы OpenAI Chat Completions и Anthropic - то есть подключается почти в любой готовый агентный харнесс без переделки клиента.
Работает с Claude Code
Alibaba отдельно указала, что Qwen 3.8 Max стабильно ходит внутри разных агентных обёрток - QwenWork, Claude Code, Codex, OpenClaw. Это значит, что в Claude Code можно подцепить не только модели Anthropic, но и Qwen через совместимый API.
Если надо переключить свой Claude Code на Qwen для длинной задачи, где важна выносливость и цена - вот готовый запрос:
В Claude Code вставь запрос:
"Настрой у меня Claude Code так, чтобы он ходил не в Claude, а в
Qwen 3.8 Max через Anthropic-совместимый эндпоинт Alibaba Cloud
Model Studio. Мой API-ключ Qwen лежит в переменной окружения
QWEN_API_KEY. Покажи, что именно поменял в конфиге, и прогони
одну проверочную команду, чтобы убедиться, что модель отвечает."
Он разберётся с базовым URL, заголовками аутентификации, форматом сообщений и проверит, что всё живо. Если Claude Code для тебя в новинку - начни с гайда для новичков.
Открытые веса и что это значит
Alibaba впервые в линейке Max выкатывает не только API, но и открытые веса. По анонсу от 3 августа 2026 - веса пойдут на Hugging Face и ModelScope "на следующей неделе", то есть примерно 10-16 августа 2026. Лицензия конкретно не указана, но факт открытых весов у 2,4-триллионного флагмана - это событие само по себе.
Что это даст на практике: возможность гонять ту же модель локально или в приватном облаке, без отправки данных в Alibaba. Порог по железу будет запретительный для большинства (сотни ГБ VRAM в топовой квантизации), но появятся GGUF-варианты через квартал-два, как получилось с Kimi K3 - и тогда возникнет реальный сценарий локального запуска для больших команд.
Qwen 3.8 Max vs GPT-5.6 Sol vs Claude Fable 5 vs Kimi K3
Крупные модели сейчас идут почти вровень, различаются акцентами.
- GPT-5.6 Sol от OpenAI - широкий чат-агент, лучшая интеграция экосистемы, самая большая база пользователей.
- Claude Fable 5 от Anthropic - сильнее всех в коде и рассуждениях, лучший partner для программирования, самый строгий по безопасности.
- Qwen 3.8 Max от Alibaba - выносливость на длинных задачах, дешёвый API, скоро откроют веса.
- Kimi K3 от Moonshot AI - топовая опен-сорс модель, лицензия Apache 2.0, гоняется даже локально на 8 ГБ ОЗУ.
Правило простое: чат и черновики - что удобно и оплачено; длинная агентная задача с прицелом "поставил и ушёл" - смотри Qwen 3.8 Max; данные не должны уходить наружу - смотри Kimi K3 локально.
Кому реально пригодится
По-честному, для большинства задач хватит того, что уже подключено. Qwen 3.8 Max имеет смысл смотреть в трёх сценариях:
- Длинные автономные прогоны. Реверс, миграция, разбор архива, аудит большой кодовой базы - там, где Claude или GPT теряют нить на многочасовой задаче.
- Дешёвый API для агентов. $2/$6 против $15/$75 у Claude Opus - разница на порядок. Если крутишь много агентных вызовов, экономия ощутимая.
- Работа из РФ. Alibaba Cloud российским аккаунтам и картам не отказывает - в отличие от OpenAI и Anthropic. Проверять на своём кейсе, но барьер входа ниже.
FAQ
Реально работает 10 дней подряд?
В примерах Alibaba - да и больше: 16 дней на CLI-проекте с 265 коммитами, 5 дней на воспроизведении статьи, полный симулированный финансовый год в e-commerce. Замеры внутренние, независимой проверки пока нет.
Сколько стоит попробовать?
Бесплатно через chat.qwen.ai - без карты и без ограничений на пробу. Через API - $2 за миллион входных токенов, $6 за миллион выходных на Alibaba Cloud Model Studio, плюс 1 миллион бесплатных токенов на новый аккаунт в сингапурском регионе.
Можно подключить в Claude Code?
Да. Qwen 3.8 Max держит формат Anthropic API, Claude Code подключается через смену базового URL и ключа. Alibaba сама указывает Claude Code в списке проверенных агентных харнессов.
Работает из России?
Alibaba Cloud российским IP и картам не отказывает, регистрация проходит без VPN на момент выхода модели. chat.qwen.ai открывается напрямую. Проверять на своём кейсе, инфраструктура Alibaba может меняться.
Веса открытые?
Обещаны на Hugging Face и ModelScope в неделю 10-16 августа 2026. На момент выхода статьи (3 августа) веса ещё не выложены, доступна только API-версия. Это будет первый "открытый" флагман в линейке Max от Alibaba.
Она лучше Claude или GPT?
Зависит от задачи. В длинных агентных прогонах и работе с десктопом - по бенчмаркам Alibaba, да. В разговорной части и коде - паритет или отставание. Считай Qwen 3.8 Max специализированной моделью под долгие автономные задачи, а не универсальной заменой.
Что дальше
Если хочешь собрать такую систему у себя - у меня есть курс по вайбкодингу и работе с нейросетями в клубе Мандарин Лаб: mandarinedu.ru. Первые уроки открыты бесплатно.
Если нужно внедрить ИИ в бизнес - процессы, агентов, автоматизацию под вашу задачу - пишите мне напрямую: t.me/Philigranchik. Разберу задачу и скажу, что реально автоматизируется, а что нет.

Вайбкодер-разработчик и маркетолог с 9-летним опытом, основатель «Мандарин Лаб». Собирает на ИИ то, за что раньше платили подрядчикам сотни тысяч: CRM, ботов, автоматизации, монтаж. Одну из систем строил под агентство недвижимости с базой в 400 000 лидов. Теперь учит этому с нуля - как за вечер собрать свой инструмент через Claude Code и зарабатывать на нейросетях.
Telegram @mike_cmo →