За Qwen 3.7 приходят с двумя разными вопросами. Первый хочет скачать веса - файлы самой модели, чтобы гонять её на своём компьютере без интернета и без счетов за каждый запрос. Второй присматривается к ней как к замене Claude, потому что слышал про цену втрое ниже. Первого я расстрою сразу, второму придётся считать.
Разбираю линейку по документации Alibaba Cloud и по независимым замерам. Отдельно показываю, где цифры из анонса расходятся с живыми тестами, и что со всем этим делает Qwen 3.8, вышедшая 3 августа.
В Telegram-канале - что нового в вайб-кодинге: инструменты, находки, ошибки. Подпишись.
Материал справочный, я не юрист и юридических рекомендаций не даю. Оплата зарубежного сервиса резидентом России - валютная операция, её регулирует ФЗ-173 «О валютном регулировании и валютном контроле». Требования к расчётам и отчётности со временем меняются, закон отсылает к решениям органов валютного регулирования. Перед оплатой сверься с действующей редакцией и уточни условия в своём банке.
Что такое Qwen 3.7 и кто за ним стоит?
Alibaba выпускает модели с 2023 года и до 2026-го выкладывала веса открыто. Про эту экосистему я писал ещё в начале 2025-го, на поколении Qwen 2.5: семейство шло от 0,5B до 72B, всё под свободной лицензией, и главным аргументом была бесплатность.
К поколению 3.7 логика поменялась на противоположную. Старшие модели закрыли: скачать их больше нельзя, только платить за доступ. Открытым остался средний уровень предыдущего поколения. Что из этого следует для того, кто хотел скачать файлы модели, разбираю ниже, в разделе про открытые веса.
Qwen 3.7 Max объявили на облачной конференции Alibaba в Ханчжоу 20 мая 2026 года. Позиционируют её как агентскую: длинная самостоятельная работа вместо коротких ответов в чате. Для вайб-кодера это значит, что модель метит ровно в ту работу, которую ты делаешь через Claude Code - файлы в проекте, команды в терминале, цепочка шагов без твоего участия.
Чем 3.7 Max отличается от Plus, Flash и прошлой 3.6?
Путаница начинается с того, что все версии продаются одновременно и под одним именем «Qwen 3.x». По номеру этого не видно: между Max и Flash разница в цене в пятьдесят раз.
| Модель | Дата | Что принимает | Веса | Цена входа за 1M |
|---|---|---|---|---|
| Qwen 3.6 (27B, 35B-A3B) | апрель 2026 | текст, картинки, видео | открытые, Apache 2.0 | бесплатно, своё железо |
| Qwen 3.7 Max | 20 мая 2026 | текст | закрытые | $1,48 на OpenRouter |
| Qwen 3.7 Plus | 26 мая 2026 | текст, картинки, видео | закрытые | $0,32 |
| Qwen 3.7 Flash | 15 июля 2026 | текст, картинки, видео | закрытые | от $0,03 |
| Qwen 3.8 Max | 3 августа 2026 | текст, картинки, видео | обещаны открытыми | $2,00 |
У самой Max несколько версий, и различаются они датой в названии. Это отдельно путает. qwen3.7-max без даты - майская сборка, она понимает только текст. Картинки и видео появились в версии qwen3.7-max-2026-06-08. Половина обзоров называет Max мультимодальной, умалчивая, что базовая версия картинок не понимает.
На форуме разработчиков Hacker News Plus называют выгодной серединой поколения.
Qwen3.7 Plus выдаёт похожий результат примерно за одну двадцатую стоимости.
Это мнение одного человека без замеров, и цену он сравнивает с Opus. Но направление верное: если берёшь Qwen ради экономии, младшие модели экономят заметнее старшей. Подписка Alibaba за 50 долларов в месяц подтверждает то же самое: qwen3.7-max в неё вообще не входит, доступен только Plus.
Где скачать открытые веса Qwen 3.7 на 27B и 35B?
Этот раздел здесь потому, что таких весов ищут много, а находят пустоту. Люди приходят за файлами модели, которых нет, и уходят ни с чем.
Проверяется это одной командой без всякой веры на слово:
curl -s "https://huggingface.co/api/models?author=Qwen&limit=1000" \
| jq -r '.[].id' | grep -iE "3\.7|3\.8"Ответ пустой: в организации Qwen на Hugging Face моделей поколения 3.7 нет. Единственный репозиторий с похожим именем принадлежит стороннему пользователю и к Alibaba отношения не имеет.
Значит, выбор сегодня такой:
- Нужны файлы модели на своей машине - берёшь Qwen3.6-27B или Qwen3.6-35B-A3B, лицензия Apache 2.0, никаких платежей. Контекст у них 262 144 токена, растягивается почти до миллиона.
- Нужна старшая модель 3.7 Max - только платный доступ по API, локально её не запустить никак.
- Готов подождать неделю - Alibaba обещала открыть веса Qwen 3.8 Max и отдельной модели на 27 миллиардов. Про это ниже, в разделе про 3.8.
Разница между 27B и 35B-A3B, если непонятно из названий. В первой все 27 миллиардов работают на каждый ответ: в сжатом виде это примерно 17 ГБ, влезает на одну игровую видеокарту. Вторая устроена иначе - параметров 35 миллиардов, но на ответ включается около трёх, поэтому она быстрее при том же качестве.
Что Qwen 3.7 Max умеет по официальным характеристикам?
Цифры ниже я взял в документации Alibaba Cloud.
| Параметр | Значение |
|---|---|
| Окно контекста | 1 000 000 токенов |
| Максимум на вход | 991 808 токенов |
| Максимум на вход с размышлением | 983 616 токенов |
| Максимум ответа | 65 536 токенов |
| Максимум размышления | 262 144 токена |
| Вызов инструментов | есть |
| Поиск в интернете | есть |
| Кэширование контекста | есть |
| Строгий формат ответа | нет |
| Настройка под свои данные | нет |
Миллион токенов - это примерно 700 тысяч слов, то есть проект целиком вместе с документацией. Звучит как решение всех проблем с памятью, а на практике качество начинает сыпаться задолго до этой отметки - разбираю в разделе про то, где модель проседает.
Про два «нет» из таблицы. Строгий формат ответа - это когда модель обязана вернуть данные ровно по заданной схеме, без импровизации. Без него любая автоматизация, где ответ уходит дальше в программу, требует подстраховки: проверять формат придётся самому. Настроить модель на своих данных тоже нельзя, остаётся работа через контекст.
Число параметров самой модели Alibaba не раскрывает нигде. У вышедшей 3.8 Max назван хотя бы общий размер, 2,4 триллиона, но активная часть не раскрыта и там.
Хочешь собрать связку, на которой модель выдумывает заметно реже? Одним выбором модели это не лечится. Окно на миллион токенов само по себе ничего не решает: контекст-инжиниринг - это про то, что ты в это окно кладёшь. На практикуме за 3 эфира собираешь все три кита: ИИ-клон + Второй мозг + Контекст-инжиниринг. Три кита, без которых ИИ галлюцинирует.
Сколько стоит Qwen 3.7 Max на самом деле?
Обзоры путаются в ценах именно потому, что берут цифру из одного региона и выдают за общую. Вот все три на 3 августа 2026. Четвёртой строкой добавил среднюю модель поколения, чтобы был масштаб:
| Где | Вход за 1M | Выход за 1M | Кэш |
|---|---|---|---|
| Alibaba Cloud, Сингапур | $2,50 (со скидкой $1,25) | $7,50 (со скидкой $3,75) | - |
| Alibaba Cloud, Пекин | $1,65 (со скидкой $0,83) | $4,95 (со скидкой $2,48) | $0,33 за повтор текста |
| OpenRouter | $1,48 | $4,43 | не публикуется |
| Qwen 3.7 Plus, Сингапур | $0,40 | $1,60 | - |
Скидка помечена как временная, дату окончания Alibaba не называет. Пакетный режим в пекинском регионе делит цену пополам, но ответ приходит не сразу.
С бесплатным доступом есть три подводных камня, и все три ломают то, что написано в чужих обзорах:
- Миллион бесплатных токенов дают на модель, на 90 дней с момента подключения и только на международной площадке Alibaba, которая работает через Сингапур. В Пекине бесплатной квоты нет вовсе.
- Бесплатный вход в Qwen Code через аккаунт Qwen отключён 15 апреля 2026. Формулировка в документации однозначная. Все материалы, где обещают бесплатный вход через аккаунт Qwen, описывают то, чего уже нет.
- Двести бесплатных запросов в день к 3.7 Max давали в отдельном продукте Alibaba под названием Qoder. Это промо закончилось 31 июля 2026, три дня назад.
Цена за токен и счёт за работу расходятся у этой модели сильнее обычного. Площадка Artificial Analysis прогоняет все модели через один набор задач и считает израсходованные токены. Qwen 3.7 Max выдал 100 миллионов токенов ответа при медиане 63 миллиона по остальным моделям.
Модель многословная, а выход стоит втрое дороже входа, поэтому болтливость обходится дороже всего.
Площадка Vals меряет то же самое в деньгах: одинаковый набор тестов через все модели, на выходе цена одного прогона. У Qwen 3.7 Max он стоил 5,22 доллара при точности 57,49%, у DeepSeek V4 Flash - 6 центов при точности 63,95%: точнее и в восемьдесят семь раз дешевле по итоговому счёту. Низкая цена за токен не спасает, когда токенов уходит втрое больше.
Правда ли Qwen 3.7 Max обгоняет Claude?
Начну с цифры, которая гуляет по рунету. Несколько сайтов пишут, что Qwen 3.7 Max взял второе место в мире по программированию с 1541 баллом в рейтинге Code Arena. Я открыл сам рейтинг: на 1 августа 2026 модель стоит там на 23-м месте с 1517 баллами. Первое место у Claude Opus 5 с 1705, второе у Kimi K3 с 1676.
Отдельная оговорка про майский анонс Alibaba, где модель сравнивали с Claude Opus 4.6. Цифры оттуда до сих пор кочуют по обзорам, а проверить их сегодня нельзя: страница анонса на сайте Qwen отдаёт пустую заготовку без единой цифры, и то же самое отдаёт зеркало в сообществе Alibaba Cloud. Я такие числа не переношу.
Что проверяется, то и привожу:
| Замер | Qwen 3.7 Max | Лучший результат | Дата замера |
|---|---|---|---|
| Индекс интеллекта Artificial Analysis | 46 (31 место из 185) | Claude Opus 5 - 61 | 3 августа 2026 |
| Скорость вывода | 206,4 токена в секунду (5 место) | Gemini 3.6 Flash - 213 | 3 августа 2026 |
| Vals Index | 57,49% (ранг 19 из 42) | DeepSeek V4 Flash - 63,95% | 31 июля 2026 |
| Terminal-Bench 2.1 | записи нет | Claude Code с Fable 5 - 83,8% | 3 августа 2026 |
| Arena по коду | 1517 (ранг 23) | Claude Opus 5 Max - 1705 | 1 августа 2026 |
В августовском анонсе 3.8 Alibaba переизмерила майскую 3.7 Max на свежих наборах: на DeepSWE 1.1 у той вышло 21,6 против 56,6 у новой версии, на FrontierSWE - 40,7 против 73,5. Разрыв в два с половиной раза за одиннадцать недель, и показала его не независимая площадка, а сам производитель.
А вот скорость у неё настоящая. 206 токенов в секунду против 57 у Claude Opus 4.8, ответ начинает приходить через две с половиной секунды вместо десятков. Получается, что Qwen 3.7 Max - быстрый исполнитель среднего уровня: когда задача расписана до шагов, модель справляется и делает это шустро.
В июне я столкнул Claude Code и Qwen 3.7 Max на одной задаче и снял это на видео. Результат тогда меня удивил: китайцы подошли гораздо ближе, чем следовало из цифр. Вывод у меня с тех пор не поменялся - если Claude по какой-то причине недоступен, вариант выглядит достойно. Именно как запасной вариант, равной заменой я его не считаю.
Где Qwen 3.7 проседает в реальной работе?
Дальше идут жалобы живых людей. Замеров тут нет, проверить их я не могу, поэтому и подаю как жалобы. Часть из них вообще про облако Alibaba и её инструменты, к конкретной версии модели отношения не имеет.
Миллион токенов заявлен, но работает не весь. На прошлом поколении Qwen про это писали прямо: чем ближе к миллиону, тем медленнее ответы. Проверенных замеров качества на длинном контексте именно по 3.7 Max я не нашёл, так что держу это как ожидание. Установленным фактом это не считаю.
Облако не держит нагрузку. В день выхода 3.8, 3 августа, обсуждение на Hacker News наполнилось одинаковыми жалобами.
Облако Alibaba, похоже, не справляется со спросом после этого анонса, у меня сплошные таймауты.
Там же описывают отказ в доступе при оплаченном тарифе: и на подписке, и на ключе с предоплаченным балансом инструмент отвечает ошибкой авторизации.
Программа отчитывается об успехе, которого не было. Тот же день, настольное приложение Qwen.
Оно сообщило, что всё получилось, и дало ссылку на папку, которую якобы создало. Папки не существовало. Я спросил, где файлы, и оно попыталось создать их заново.
Без опыта такое не поймаешь: агент говорит «готово», а на диске пусто.
Модели нужно детальное задание. Расплывчатую формулировку Qwen понимает хуже Claude. Тут расслоение по типу пользователя: программист напишет техническое задание и получит хороший результат за небольшие деньги, предприниматель напишет «сделай мне красиво» и получит не то.
Есть и хорошие отзывы, без них картина будет однобокой. Человек, проработавший две недели на предварительной версии 3.8, пишет, что в своём закрытом репозитории она закрыла столько же задач, сколько Fable 5, и по старшим моделям он не скучает. Хвалят Qwen на небольших проектах, ругают на больших.
Через что попробовать Qwen 3.7 без установки?
Начинать я советую с браузера. Открываешь чат, даёшь модели свою реальную задачу и смотришь на ответ. Пять минут экономят вечер настройки, если модель тебе не подойдёт.
Дальше по возрастанию сложности:
- Чат в браузере. Ничего не ставится, регистрация обычная. Годится, чтобы понять манеру ответов.
- Доступ по API. Заводишь ключ в Alibaba Cloud Model Studio или на OpenRouter, вставляешь его в свою программу. Так модель попадает в редактор, в бот, в собственную автоматизацию.
- Qwen Code в терминале. Открытый инструмент Alibaba под лицензией Apache 2.0, ставится через
npm install -g @qwen-code/qwen-code@latestпри установленном Node.js 22 и выше. Умеет ходить не только в Qwen, но и в модели OpenAI, Anthropic, Google, а также в локальные через Ollama и vLLM.
Есть ещё один способ: у Alibaba есть API, совместимый с Anthropic, и Claude Code подключается к Qwen напрямую. Рецепт лежит в документации Alibaba Cloud:
npm install -g @anthropic-ai/claude-code
export ANTHROPIC_BASE_URL=https://coding-intl.dashscope.aliyuncs.com/apps/anthropic
export ANTHROPIC_AUTH_TOKEN=<твой_ключ>
export ANTHROPIC_MODEL="qwen3.7-plus"
claudeМодель в последней строке - Plus, и это не опечатка: старшая Max в подписку Alibaba не входит вовсе, за неё платят отдельно по расходу.
Привычный интерфейс остаётся, модель внутри меняется. Дешевле способа сравнить я не знаю: одна задача, одна программа, один вечер.
Одна оговорка, которую в чужих инструкциях обычно забывают. Ключ в последней строке - от Alibaba, ключ Anthropic сюда подставлять нельзя. И после такой настройки твои запросы и куски проекта уходят на серверы Alibaba, до Anthropic они не доходят. Что с ними там происходит - в разделе про данные ниже.
Пошаговую установку Qwen Code с заведением ключа, выбором тарифа и разбором ошибки 401 я расписал отдельно - в материале про Qwen Code как замену Claude Code. Здесь не дублирую.
Что с доступом и оплатой из России?
Тема платежей заслуживает отдельного материала, а раздавать советы по обходу чего бы то ни было я не буду: это не моя область и не моя ответственность.
Что можно сказать по факту:
- Регионы: Пекин, Гонконг, Сингапур, Токио, Франкфурт, Вирджиния. Международная версия сервиса работает через сингапурский адрес.
- Нужен аккаунт Alibaba Cloud и ключ доступа из консоли Model Studio.
- Альтернатива без аккаунта Alibaba - те же модели через OpenRouter.
- Оплата подписки или пополнение баланса зарубежного поставщика - валютная операция, её регулирует ФЗ-173. Требования к инструментам расчётов меняются, закон отсылает к решениям органов валютного регулирования.
- Перед оплатой имеет смысл сверить действующую редакцию закона и условия своего банка.
Отдельно про материалы, которые обещают готовый список способов оплаты. Они обычно ведут на посредников, которых никто не проверял, и заканчиваются переводом денег в никуда. Такие ссылки я не даю принципиально.
Если нужна модель, к которой из России проще подступиться, посмотри на соседей: разбор GLM-5.2 и сравнение DeepSeek с Claude Code. У каждой своя история с доступом и своя цена.
Что происходит с твоими данными в Alibaba Cloud?
Вопрос «а мои данные не утекут?» мне задают чаще любого технического. Поэтому формулировки я проверил по официальным документам, обзоры для этого не годятся.
Первый документ говорит прямо:
Alibaba Cloud защищает приватность данных и никогда не использует ваши данные для тренировки моделей.
Второй документ, посвящённый данным для тренировки, говорит то же самое иначе: без явного согласия клиента данные не идут на развитие моделей. Разница между «никогда» и «без явного согласия» существенная, поэтому обе формулировки привожу как есть.
| Вопрос | Ответ по документам |
|---|---|
| Тренировка на данных клиентов | заявлено, что не ведётся |
| Шифрование передачи | AES-256 |
| Сертификация | SOC 2 с безоговорочным заключением |
| Где хранятся данные | в регионе, выбранном при создании рабочего пространства |
| Срок хранения запросов | не опубликован |
| Срок хранения служебных логов | 30 дней по умолчанию |
Регион выбирается один раз и определяет юрисдикцию хранения: Франкфурт и Сингапур - не то же самое, что Пекин. А вот срока хранения самих запросов в открытых документах нет. Это дыра, и делать вид, что её нет, я не буду.
То, что нельзя показать посторонним, я в чужую модель не отправляю - с любым поставщиком. Ни ключи доступа, ни данные клиентов, ни договоры.
Что меняет Qwen 3.8, вышедшая 3 августа?
Модель, про которую ты сейчас читаешь, вчера перестала быть флагманом.
| Признак | Qwen 3.7 Max | Qwen 3.8 Max |
|---|---|---|
| Дата | 20 мая 2026 | 3 августа 2026 |
| Параметры | не раскрыты | 2,4 трлн, активная часть не раскрыта |
| Что принимает | текст, в версии от 8 июня картинки и видео | текст, картинки, видео |
| Максимум ответа | 65 536 токенов | 131 072 токена |
| Строгий формат ответа | нет | есть |
| Место в Arena по коду | 23 (1517) | 4 (1668) |
| Открытые веса | нет | обещаны на следующей неделе |
Про открытые веса Alibaba объявила отдельно: это первый случай, когда она открывает веса модели старшего класса, и выйти они должны на следующей неделе. Вместе с самой 3.8 Max обещана отдельная модель на 27 миллиардов параметров - её как раз можно держать на своём железе.
Alibaba заявляет 86,6 на Terminal-Bench 2.1 против 84,6 у Claude Opus 4.8. Притормозить стоит по двум причинам. Часть сравнений в анонсе идёт против Qwen3.7-Plus, средней модели прошлого поколения, вместо собственной старшей Max, отчего прирост выходит больше, чем на самом деле. И независимых замеров у 3.8 пока нет вообще, кроме предварительного голосования, где голосов набралось около полутора тысяч.
Что из этого следует практически:
- Присматриваешься к Qwen как к рабочей модели - смотри сразу на 3.8. Платить за 3.7 сегодня смысла мало: в сингапурском регионе 3.8 даже дешевле, 2 доллара против 2,50 на входе.
- Нужны открытые веса - подожди неделю. Обещаны и сама 3.8 Max, и отдельная модель на 27 миллиардов под своё железо.
- Уже работаешь на 3.7 и всё устраивает - не дёргайся. Независимых замеров по 3.8 нет, а менять рабочую модель по анонсу - плохая примета.
История повторяется примерно раз в квартал: Kimi K3, GLM-5.2, DeepSeek выходили с теми же обещаниями. Гнаться за каждым релизом дороже, чем один раз выстроить работу так, чтобы модель менялась одной строкой в настройках.
Кому Qwen 3.7 подойдёт, а кому нет
Короткий разбор по типам работы, чтобы не гадать.
| Задача | Стоит ли брать Qwen |
|---|---|
| Однотипные правки по чёткому описанию | да, быстро и дёшево |
| Большой объём простых запросов | да, скорость решает |
| Разбор большого проекта целиком | скорее нет, качество падает на длинном контексте |
| Длинная самостоятельная работа агента | нет, на агентских замерах отставание сильное |
| Задача, которую надо додумать | нет, нужно детальное описание |
| Работа с чувствительными данными | нет, срок хранения запросов не опубликован |
Мой вывод после разбора цифр: на повседневную работу вместо Claude Code эта модель не тянет. Вторым инструментом под массовые однотипные задачи - вполне. Ровно так я использую бесплатные и дешёвые модели: тяжёлое остаётся на старшей модели, поток уходит на дешёвую.
Прежде чем менять модель, посчитай, сколько ты платишь за переделки. Если агент переписывает одно и то же по три раза, переделки съедают больше, чем токены. Смена модели этого не чинит, надо разбираться, что у него в контексте.
Источники
- Характеристики qwen3.7-max в Alibaba Cloud Model Studio - окно контекста, лимиты, версии и снимки модели
- Прайс моделей Alibaba Cloud Model Studio - цены по регионам, скидка, кэширование
- Что такое Alibaba Cloud Model Studio - регионы, адреса доступа, заявление про тренировку на данных
- Уведомление о приватности Model Studio - шифрование, сертификация, обработка данных
- Раскрытие данных, на которых тренировали Qwen и Wan - формулировка про явное согласие
- Подключение Claude Code к моделям Alibaba - рабочий адрес и переменные окружения
- Характеристики qwen3.8-max - параметры, цены, строгий формат ответа
- Организация Qwen на Hugging Face - какие модели действительно выложены открыто
- Карточка Qwen3.6-27B - лицензия Apache 2.0, размер, контекст
- Страница модели Qwen 3.7 Max на Artificial Analysis - индекс интеллекта, скорость, объём вывода
- Qwen 3.7 Max на площадке Vals - Vals Index, стоимость одного теста, ранги
- Таблица SWE-bench на площадке Vals - результаты моделей на починке настоящих ошибок
- Таблица Terminal-Bench 2.1 - работа агентов в терминале
- Рейтинг Arena по коду - голосование людей, места и баллы моделей
- Страница Qwen 3.7 Max на OpenRouter - фактическая цена и окно контекста
- Репозиторий Qwen Code - установка, лицензия, поддерживаемые поставщики
- Документация Qwen Code про вход - отмена бесплатного уровня 15 апреля 2026
- Разбор выхода Qwen3.8-Max на MarkTechPost - параметры и планы по открытым весам
- Обсуждение выхода Qwen 3.7 Max на Hacker News - отзывы практиков сразу после релиза
- Обсуждение выхода Qwen 3.8 Max на Hacker News - жалобы на таймауты, отказы доступа и настольное приложение
Полная схема вайб-кодинга за три вечера: ИИ-клон + Второй мозг + Контекст-инжиниринг. Записи эфиров в личном кабинете, доступ 30 дней.
Новые материалы - дайджестом, без спама
Гайды выходят регулярно. Подпишись, чтобы не пропускать: пришлю подборку в Telegram или на email. Раз в неделю или каждый день - выбираешь сам.

