Qwen 3.7 и 3.7 Max: что умеет модель для кода в 2026

Опубликовано 03.08.202621 мин чтенияБазовый
Знак Qwen на процессоре внутри прозрачного облака с метками версии 3.7 Max
Что узнаешь
  • Чем 3.7 Max отличается от Plus, Flash и от прошлой версии 3.6
  • Почему файлы модели 3.7 нельзя скачать ни в каком размере, хотя их ищут
  • Три разные цены на одну модель и какая из них твоя
  • Что показывают независимые замеры вместо цифр из анонса
  • Что меняет Qwen 3.8, вышедшая 3 августа
Применить за 15 мин
Сэкономит 4 ч
Базовый
3просмотров

За Qwen 3.7 приходят с двумя разными вопросами. Первый хочет скачать веса - файлы самой модели, чтобы гонять её на своём компьютере без интернета и без счетов за каждый запрос. Второй присматривается к ней как к замене Claude, потому что слышал про цену втрое ниже. Первого я расстрою сразу, второму придётся считать.

Разбираю линейку по документации Alibaba Cloud и по независимым замерам. Отдельно показываю, где цифры из анонса расходятся с живыми тестами, и что со всем этим делает Qwen 3.8, вышедшая 3 августа.

В Telegram-канале - что нового в вайб-кодинге: инструменты, находки, ошибки. Подпишись.

Что такое Qwen 3.7 и кто за ним стоит?

Alibaba выпускает модели с 2023 года и до 2026-го выкладывала веса открыто. Про эту экосистему я писал ещё в начале 2025-го, на поколении Qwen 2.5: семейство шло от 0,5B до 72B, всё под свободной лицензией, и главным аргументом была бесплатность.

К поколению 3.7 логика поменялась на противоположную. Старшие модели закрыли: скачать их больше нельзя, только платить за доступ. Открытым остался средний уровень предыдущего поколения. Что из этого следует для того, кто хотел скачать файлы модели, разбираю ниже, в разделе про открытые веса.

Qwen 3.7 Max объявили на облачной конференции Alibaba в Ханчжоу 20 мая 2026 года. Позиционируют её как агентскую: длинная самостоятельная работа вместо коротких ответов в чате. Для вайб-кодера это значит, что модель метит ровно в ту работу, которую ты делаешь через Claude Code - файлы в проекте, команды в терминале, цепочка шагов без твоего участия.

Чем 3.7 Max отличается от Plus, Flash и прошлой 3.6?

Путаница начинается с того, что все версии продаются одновременно и под одним именем «Qwen 3.x». По номеру этого не видно: между Max и Flash разница в цене в пятьдесят раз.

МодельДатаЧто принимаетВесаЦена входа за 1M
Qwen 3.6 (27B, 35B-A3B)апрель 2026текст, картинки, видеооткрытые, Apache 2.0бесплатно, своё железо
Qwen 3.7 Max20 мая 2026текстзакрытые$1,48 на OpenRouter
Qwen 3.7 Plus26 мая 2026текст, картинки, видеозакрытые$0,32
Qwen 3.7 Flash15 июля 2026текст, картинки, видеозакрытыеот $0,03
Qwen 3.8 Max3 августа 2026текст, картинки, видеообещаны открытыми$2,00

У самой Max несколько версий, и различаются они датой в названии. Это отдельно путает. qwen3.7-max без даты - майская сборка, она понимает только текст. Картинки и видео появились в версии qwen3.7-max-2026-06-08. Половина обзоров называет Max мультимодальной, умалчивая, что базовая версия картинок не понимает.

На форуме разработчиков Hacker News Plus называют выгодной серединой поколения.

Qwen3.7 Plus выдаёт похожий результат примерно за одну двадцатую стоимости.

- cogman10, Hacker News, https://news.ycombinator.com/item?id=48447492

Это мнение одного человека без замеров, и цену он сравнивает с Opus. Но направление верное: если берёшь Qwen ради экономии, младшие модели экономят заметнее старшей. Подписка Alibaba за 50 долларов в месяц подтверждает то же самое: qwen3.7-max в неё вообще не входит, доступен только Plus.

Где скачать открытые веса Qwen 3.7 на 27B и 35B?

Этот раздел здесь потому, что таких весов ищут много, а находят пустоту. Люди приходят за файлами модели, которых нет, и уходят ни с чем.

Проверяется это одной командой без всякой веры на слово:

bash
curl -s "https://huggingface.co/api/models?author=Qwen&limit=1000" \
  | jq -r '.[].id' | grep -iE "3\.7|3\.8"

Ответ пустой: в организации Qwen на Hugging Face моделей поколения 3.7 нет. Единственный репозиторий с похожим именем принадлежит стороннему пользователю и к Alibaba отношения не имеет.

Значит, выбор сегодня такой:

  1. Нужны файлы модели на своей машине - берёшь Qwen3.6-27B или Qwen3.6-35B-A3B, лицензия Apache 2.0, никаких платежей. Контекст у них 262 144 токена, растягивается почти до миллиона.
  2. Нужна старшая модель 3.7 Max - только платный доступ по API, локально её не запустить никак.
  3. Готов подождать неделю - Alibaba обещала открыть веса Qwen 3.8 Max и отдельной модели на 27 миллиардов. Про это ниже, в разделе про 3.8.

Разница между 27B и 35B-A3B, если непонятно из названий. В первой все 27 миллиардов работают на каждый ответ: в сжатом виде это примерно 17 ГБ, влезает на одну игровую видеокарту. Вторая устроена иначе - параметров 35 миллиардов, но на ответ включается около трёх, поэтому она быстрее при том же качестве.

Что Qwen 3.7 Max умеет по официальным характеристикам?

Цифры ниже я взял в документации Alibaba Cloud.

ПараметрЗначение
Окно контекста1 000 000 токенов
Максимум на вход991 808 токенов
Максимум на вход с размышлением983 616 токенов
Максимум ответа65 536 токенов
Максимум размышления262 144 токена
Вызов инструментовесть
Поиск в интернетеесть
Кэширование контекстаесть
Строгий формат ответанет
Настройка под свои данныенет

Миллион токенов - это примерно 700 тысяч слов, то есть проект целиком вместе с документацией. Звучит как решение всех проблем с памятью, а на практике качество начинает сыпаться задолго до этой отметки - разбираю в разделе про то, где модель проседает.

Про два «нет» из таблицы. Строгий формат ответа - это когда модель обязана вернуть данные ровно по заданной схеме, без импровизации. Без него любая автоматизация, где ответ уходит дальше в программу, требует подстраховки: проверять формат придётся самому. Настроить модель на своих данных тоже нельзя, остаётся работа через контекст.

Число параметров самой модели Alibaba не раскрывает нигде. У вышедшей 3.8 Max назван хотя бы общий размер, 2,4 триллиона, но активная часть не раскрыта и там.

Хочешь собрать связку, на которой модель выдумывает заметно реже? Одним выбором модели это не лечится. Окно на миллион токенов само по себе ничего не решает: контекст-инжиниринг - это про то, что ты в это окно кладёшь. На практикуме за 3 эфира собираешь все три кита: ИИ-клон + Второй мозг + Контекст-инжиниринг. Три кита, без которых ИИ галлюцинирует.

Практикум по вайб-кодингу
+Твой второй мозг
3 вечера - инструменты, метод, первый проект
Старт 25–27 августа  ·  2 000 ₽
Записаться →

Сколько стоит Qwen 3.7 Max на самом деле?

Обзоры путаются в ценах именно потому, что берут цифру из одного региона и выдают за общую. Вот все три на 3 августа 2026. Четвёртой строкой добавил среднюю модель поколения, чтобы был масштаб:

ГдеВход за 1MВыход за 1MКэш
Alibaba Cloud, Сингапур$2,50 (со скидкой $1,25)$7,50 (со скидкой $3,75)-
Alibaba Cloud, Пекин$1,65 (со скидкой $0,83)$4,95 (со скидкой $2,48)$0,33 за повтор текста
OpenRouter$1,48$4,43не публикуется
Qwen 3.7 Plus, Сингапур$0,40$1,60-

Скидка помечена как временная, дату окончания Alibaba не называет. Пакетный режим в пекинском регионе делит цену пополам, но ответ приходит не сразу.

С бесплатным доступом есть три подводных камня, и все три ломают то, что написано в чужих обзорах:

  1. Миллион бесплатных токенов дают на модель, на 90 дней с момента подключения и только на международной площадке Alibaba, которая работает через Сингапур. В Пекине бесплатной квоты нет вовсе.
  2. Бесплатный вход в Qwen Code через аккаунт Qwen отключён 15 апреля 2026. Формулировка в документации однозначная. Все материалы, где обещают бесплатный вход через аккаунт Qwen, описывают то, чего уже нет.
  3. Двести бесплатных запросов в день к 3.7 Max давали в отдельном продукте Alibaba под названием Qoder. Это промо закончилось 31 июля 2026, три дня назад.

Цена за токен и счёт за работу расходятся у этой модели сильнее обычного. Площадка Artificial Analysis прогоняет все модели через один набор задач и считает израсходованные токены. Qwen 3.7 Max выдал 100 миллионов токенов ответа при медиане 63 миллиона по остальным моделям.

Модель многословная, а выход стоит втрое дороже входа, поэтому болтливость обходится дороже всего.

Площадка Vals меряет то же самое в деньгах: одинаковый набор тестов через все модели, на выходе цена одного прогона. У Qwen 3.7 Max он стоил 5,22 доллара при точности 57,49%, у DeepSeek V4 Flash - 6 центов при точности 63,95%: точнее и в восемьдесят семь раз дешевле по итоговому счёту. Низкая цена за токен не спасает, когда токенов уходит втрое больше.

Правда ли Qwen 3.7 Max обгоняет Claude?

Начну с цифры, которая гуляет по рунету. Несколько сайтов пишут, что Qwen 3.7 Max взял второе место в мире по программированию с 1541 баллом в рейтинге Code Arena. Я открыл сам рейтинг: на 1 августа 2026 модель стоит там на 23-м месте с 1517 баллами. Первое место у Claude Opus 5 с 1705, второе у Kimi K3 с 1676.

Отдельная оговорка про майский анонс Alibaba, где модель сравнивали с Claude Opus 4.6. Цифры оттуда до сих пор кочуют по обзорам, а проверить их сегодня нельзя: страница анонса на сайте Qwen отдаёт пустую заготовку без единой цифры, и то же самое отдаёт зеркало в сообществе Alibaba Cloud. Я такие числа не переношу.

Что проверяется, то и привожу:

ЗамерQwen 3.7 MaxЛучший результатДата замера
Индекс интеллекта Artificial Analysis46 (31 место из 185)Claude Opus 5 - 613 августа 2026
Скорость вывода206,4 токена в секунду (5 место)Gemini 3.6 Flash - 2133 августа 2026
Vals Index57,49% (ранг 19 из 42)DeepSeek V4 Flash - 63,95%31 июля 2026
Terminal-Bench 2.1записи нетClaude Code с Fable 5 - 83,8%3 августа 2026
Arena по коду1517 (ранг 23)Claude Opus 5 Max - 17051 августа 2026

В августовском анонсе 3.8 Alibaba переизмерила майскую 3.7 Max на свежих наборах: на DeepSWE 1.1 у той вышло 21,6 против 56,6 у новой версии, на FrontierSWE - 40,7 против 73,5. Разрыв в два с половиной раза за одиннадцать недель, и показала его не независимая площадка, а сам производитель.

А вот скорость у неё настоящая. 206 токенов в секунду против 57 у Claude Opus 4.8, ответ начинает приходить через две с половиной секунды вместо десятков. Получается, что Qwen 3.7 Max - быстрый исполнитель среднего уровня: когда задача расписана до шагов, модель справляется и делает это шустро.

В июне я столкнул Claude Code и Qwen 3.7 Max на одной задаче и снял это на видео. Результат тогда меня удивил: китайцы подошли гораздо ближе, чем следовало из цифр. Вывод у меня с тех пор не поменялся - если Claude по какой-то причине недоступен, вариант выглядит достойно. Именно как запасной вариант, равной заменой я его не считаю.

Где Qwen 3.7 проседает в реальной работе?

Дальше идут жалобы живых людей. Замеров тут нет, проверить их я не могу, поэтому и подаю как жалобы. Часть из них вообще про облако Alibaba и её инструменты, к конкретной версии модели отношения не имеет.

Миллион токенов заявлен, но работает не весь. На прошлом поколении Qwen про это писали прямо: чем ближе к миллиону, тем медленнее ответы. Проверенных замеров качества на длинном контексте именно по 3.7 Max я не нашёл, так что держу это как ожидание. Установленным фактом это не считаю.

Облако не держит нагрузку. В день выхода 3.8, 3 августа, обсуждение на Hacker News наполнилось одинаковыми жалобами.

Облако Alibaba, похоже, не справляется со спросом после этого анонса, у меня сплошные таймауты.

- efficax, Hacker News, https://news.ycombinator.com/item?id=49150470

Там же описывают отказ в доступе при оплаченном тарифе: и на подписке, и на ключе с предоплаченным балансом инструмент отвечает ошибкой авторизации.

Программа отчитывается об успехе, которого не было. Тот же день, настольное приложение Qwen.

Оно сообщило, что всё получилось, и дало ссылку на папку, которую якобы создало. Папки не существовало. Я спросил, где файлы, и оно попыталось создать их заново.

- jjcm, Hacker News, https://news.ycombinator.com/item?id=49150470

Без опыта такое не поймаешь: агент говорит «готово», а на диске пусто.

Модели нужно детальное задание. Расплывчатую формулировку Qwen понимает хуже Claude. Тут расслоение по типу пользователя: программист напишет техническое задание и получит хороший результат за небольшие деньги, предприниматель напишет «сделай мне красиво» и получит не то.

Есть и хорошие отзывы, без них картина будет однобокой. Человек, проработавший две недели на предварительной версии 3.8, пишет, что в своём закрытом репозитории она закрыла столько же задач, сколько Fable 5, и по старшим моделям он не скучает. Хвалят Qwen на небольших проектах, ругают на больших.

Через что попробовать Qwen 3.7 без установки?

Начинать я советую с браузера. Открываешь чат, даёшь модели свою реальную задачу и смотришь на ответ. Пять минут экономят вечер настройки, если модель тебе не подойдёт.

Дальше по возрастанию сложности:

  1. Чат в браузере. Ничего не ставится, регистрация обычная. Годится, чтобы понять манеру ответов.
  2. Доступ по API. Заводишь ключ в Alibaba Cloud Model Studio или на OpenRouter, вставляешь его в свою программу. Так модель попадает в редактор, в бот, в собственную автоматизацию.
  3. Qwen Code в терминале. Открытый инструмент Alibaba под лицензией Apache 2.0, ставится через npm install -g @qwen-code/qwen-code@latest при установленном Node.js 22 и выше. Умеет ходить не только в Qwen, но и в модели OpenAI, Anthropic, Google, а также в локальные через Ollama и vLLM.

Есть ещё один способ: у Alibaba есть API, совместимый с Anthropic, и Claude Code подключается к Qwen напрямую. Рецепт лежит в документации Alibaba Cloud:

bash
npm install -g @anthropic-ai/claude-code
export ANTHROPIC_BASE_URL=https://coding-intl.dashscope.aliyuncs.com/apps/anthropic
export ANTHROPIC_AUTH_TOKEN=<твой_ключ>
export ANTHROPIC_MODEL="qwen3.7-plus"
claude

Модель в последней строке - Plus, и это не опечатка: старшая Max в подписку Alibaba не входит вовсе, за неё платят отдельно по расходу.

Привычный интерфейс остаётся, модель внутри меняется. Дешевле способа сравнить я не знаю: одна задача, одна программа, один вечер.

Одна оговорка, которую в чужих инструкциях обычно забывают. Ключ в последней строке - от Alibaba, ключ Anthropic сюда подставлять нельзя. И после такой настройки твои запросы и куски проекта уходят на серверы Alibaba, до Anthropic они не доходят. Что с ними там происходит - в разделе про данные ниже.

Пошаговую установку Qwen Code с заведением ключа, выбором тарифа и разбором ошибки 401 я расписал отдельно - в материале про Qwen Code как замену Claude Code. Здесь не дублирую.

Что с доступом и оплатой из России?

Тема платежей заслуживает отдельного материала, а раздавать советы по обходу чего бы то ни было я не буду: это не моя область и не моя ответственность.

Что можно сказать по факту:

  • Регионы: Пекин, Гонконг, Сингапур, Токио, Франкфурт, Вирджиния. Международная версия сервиса работает через сингапурский адрес.
  • Нужен аккаунт Alibaba Cloud и ключ доступа из консоли Model Studio.
  • Альтернатива без аккаунта Alibaba - те же модели через OpenRouter.
  • Оплата подписки или пополнение баланса зарубежного поставщика - валютная операция, её регулирует ФЗ-173. Требования к инструментам расчётов меняются, закон отсылает к решениям органов валютного регулирования.
  • Перед оплатой имеет смысл сверить действующую редакцию закона и условия своего банка.

Отдельно про материалы, которые обещают готовый список способов оплаты. Они обычно ведут на посредников, которых никто не проверял, и заканчиваются переводом денег в никуда. Такие ссылки я не даю принципиально.

Если нужна модель, к которой из России проще подступиться, посмотри на соседей: разбор GLM-5.2 и сравнение DeepSeek с Claude Code. У каждой своя история с доступом и своя цена.

Что происходит с твоими данными в Alibaba Cloud?

Вопрос «а мои данные не утекут?» мне задают чаще любого технического. Поэтому формулировки я проверил по официальным документам, обзоры для этого не годятся.

Первый документ говорит прямо:

Alibaba Cloud защищает приватность данных и никогда не использует ваши данные для тренировки моделей.

- Alibaba Cloud Model Studio, https://www.alibabacloud.com/help/en/model-studio/what-is-model-studio

Второй документ, посвящённый данным для тренировки, говорит то же самое иначе: без явного согласия клиента данные не идут на развитие моделей. Разница между «никогда» и «без явного согласия» существенная, поэтому обе формулировки привожу как есть.

ВопросОтвет по документам
Тренировка на данных клиентовзаявлено, что не ведётся
Шифрование передачиAES-256
СертификацияSOC 2 с безоговорочным заключением
Где хранятся данныев регионе, выбранном при создании рабочего пространства
Срок хранения запросовне опубликован
Срок хранения служебных логов30 дней по умолчанию

Регион выбирается один раз и определяет юрисдикцию хранения: Франкфурт и Сингапур - не то же самое, что Пекин. А вот срока хранения самих запросов в открытых документах нет. Это дыра, и делать вид, что её нет, я не буду.

То, что нельзя показать посторонним, я в чужую модель не отправляю - с любым поставщиком. Ни ключи доступа, ни данные клиентов, ни договоры.

Что меняет Qwen 3.8, вышедшая 3 августа?

Модель, про которую ты сейчас читаешь, вчера перестала быть флагманом.

ПризнакQwen 3.7 MaxQwen 3.8 Max
Дата20 мая 20263 августа 2026
Параметрыне раскрыты2,4 трлн, активная часть не раскрыта
Что принимаеттекст, в версии от 8 июня картинки и видеотекст, картинки, видео
Максимум ответа65 536 токенов131 072 токена
Строгий формат ответанетесть
Место в Arena по коду23 (1517)4 (1668)
Открытые весанетобещаны на следующей неделе

Про открытые веса Alibaba объявила отдельно: это первый случай, когда она открывает веса модели старшего класса, и выйти они должны на следующей неделе. Вместе с самой 3.8 Max обещана отдельная модель на 27 миллиардов параметров - её как раз можно держать на своём железе.

Alibaba заявляет 86,6 на Terminal-Bench 2.1 против 84,6 у Claude Opus 4.8. Притормозить стоит по двум причинам. Часть сравнений в анонсе идёт против Qwen3.7-Plus, средней модели прошлого поколения, вместо собственной старшей Max, отчего прирост выходит больше, чем на самом деле. И независимых замеров у 3.8 пока нет вообще, кроме предварительного голосования, где голосов набралось около полутора тысяч.

Что из этого следует практически:

  1. Присматриваешься к Qwen как к рабочей модели - смотри сразу на 3.8. Платить за 3.7 сегодня смысла мало: в сингапурском регионе 3.8 даже дешевле, 2 доллара против 2,50 на входе.
  2. Нужны открытые веса - подожди неделю. Обещаны и сама 3.8 Max, и отдельная модель на 27 миллиардов под своё железо.
  3. Уже работаешь на 3.7 и всё устраивает - не дёргайся. Независимых замеров по 3.8 нет, а менять рабочую модель по анонсу - плохая примета.

История повторяется примерно раз в квартал: Kimi K3, GLM-5.2, DeepSeek выходили с теми же обещаниями. Гнаться за каждым релизом дороже, чем один раз выстроить работу так, чтобы модель менялась одной строкой в настройках.

Кому Qwen 3.7 подойдёт, а кому нет

Короткий разбор по типам работы, чтобы не гадать.

ЗадачаСтоит ли брать Qwen
Однотипные правки по чёткому описаниюда, быстро и дёшево
Большой объём простых запросовда, скорость решает
Разбор большого проекта целикомскорее нет, качество падает на длинном контексте
Длинная самостоятельная работа агентанет, на агентских замерах отставание сильное
Задача, которую надо додуматьнет, нужно детальное описание
Работа с чувствительными данныминет, срок хранения запросов не опубликован

Мой вывод после разбора цифр: на повседневную работу вместо Claude Code эта модель не тянет. Вторым инструментом под массовые однотипные задачи - вполне. Ровно так я использую бесплатные и дешёвые модели: тяжёлое остаётся на старшей модели, поток уходит на дешёвую.

Прежде чем менять модель, посчитай, сколько ты платишь за переделки. Если агент переписывает одно и то же по три раза, переделки съедают больше, чем токены. Смена модели этого не чинит, надо разбираться, что у него в контексте.

Источники

Полная схема вайб-кодинга за три вечера: ИИ-клон + Второй мозг + Контекст-инжиниринг. Записи эфиров в личном кабинете, доступ 30 дней.

Практикум по вайб-кодингу
+Твой второй мозг
3 вечера - инструменты, метод, первый проект
Старт 25–27 августа  ·  2 000 ₽
Записаться →

Новые материалы - дайджестом, без спама

Гайды выходят регулярно. Подпишись, чтобы не пропускать: пришлю подборку в Telegram или на email. Раз в неделю или каждый день - выбираешь сам.

Была инструкция полезна?
Артемий Миллер
Автор
Артемий Миллер
Предприниматель и вайб-кодер

Артемий Миллер - предприниматель и вайб-кодер. Бывший программист, собирает продукты исключительно вместе с ИИ-агентами, без найма разработчиков.

Связанные концепты