Инструменты · 17 мин · обновлено 4 августа 2026 г.

Qwen3.8-Max: бесплатный доступ из России и проверка вместо ChatGPT (2026)

Alibaba выложила Qwen3.8-Max на 2,4 триллиона параметров: модель работает над задачей сутками. Разбираем, как зайти из России без VPN и бесплатно, сколько стоит API в рублях и на каких пяти запросах проверить, тянет ли она работу вместо ChatGPT.

Qwen3.8-Max: бесплатный доступ из России и проверка вместо ChatGPT (2026)

Qwen3.8-Max от Alibaba вышел 3 августа 2026 года: 2,4 триллиона параметров, контекст в миллион токенов и главная фишка в том, что модель тренировали работать над одной задачей сутками. Попробовать его из России можно бесплатно и без VPN: чат на chat.qwen.ai открывается напрямую, модель выбирается в списке сверху. Платная часть начинается только на API, и вот там уже нужна зарубежная карта.

Дальше по шагам: что в этой модели нового по сравнению с прошлыми Qwen, как зайти из России за пару минут, какие цифры Alibaba показала и насколько им можно верить, сколько стоит API в рублях, и пять конкретных запросов, на которых видно, тянет ли Qwen3.8-Max твою повседневную работу вместо ChatGPT.

Qwen3.8-Max - флагман Alibaba на 2,4 триллиона параметров (95 миллиардов активны на каждый запрос), контекст 1 млн токенов. Заточен под длинные автономные задачи: в примерах компании модель 16 дней вела разработку утилиты и за 5 дней воспроизвела научную статью. Из России доступен бесплатно через chat.qwen.ai без VPN. API стоит $2 за миллион входных токенов и $6 за миллион выходных, оплата только зарубежной картой. Открытые веса обещаны через неделю после релиза.

Словарик: шесть терминов, без которых дальше непонятно

Что нового в Qwen3.8-Max по сравнению с прошлыми версиями

Прошлые Qwen были хорошими собеседниками. Ты задаёшь вопрос, получаешь ответ, дальше сам. Qwen3.8-Max Alibaba собирала под другой сценарий: дать модели задачу и уйти на несколько дней.

Архитектура выросла из Qwen3.5, но обучение переделали. Модель тренировали на вложенных структурах папок, на разных агентских оболочках, на многодневных сценариях работы. По данным Alibaba, оптимальный результат обучения с подкреплением получился примерно на 4000 сред, а внутренний сводный индекс по десятку с лишним бенчмарков вырос с 0,474 до 0,725.

2400млрд параметров

всего в модели, архитектура Mixture-of-Experts

95млрд активных

реально считаются на каждый запрос, отсюда низкая цена

1млн токенов

контекст: около 750 тысяч слов или сотня страниц PDF с запасом

131тыс. токенов

максимальный ответ за один раз, бюджет размышлений до 262 тысяч

Из практичного: контекст в миллион токенов позволяет закинуть документ на 200+ страниц целиком и не резать его на куски. Видео модель тоже принимает, заявленный потолок больше ста часов записи.

Ещё одна деталь для тех, кто уже сидит на других моделях. API совместим сразу с двумя протоколами: формат OpenAI Chat Completions и протокол Anthropic. Это значит, что готовый скрипт под ChatGPT или Claude переключается на Qwen сменой адреса и названия модели, без переписывания кода.

Прямой конкурент вышел за неделю до этого: Kimi K3 от Moonshot, 2,8 триллиона параметров и тот же миллион токенов контекста, релиз 27 июля 2026. Китайские лаборатории сейчас выкатывают флагманы с разницей в дни, так что расклад «кто сильнее» меняется быстрее, чем успевают выйти обзоры.

Как открыть Qwen3.8-Max из России бесплатно

Главная хорошая новость: ничего героического делать не нужно. Alibaba не блокирует российские IP, платёжной информации для чата не просит.

Открыть сайт ≈ 1 мин

  • заходишь на chat.qwen.ai с обычного российского интернета
  • VPN не нужен, страница грузится напрямую
  • если провайдер капризничает, помогает смена DNS на 1.1.1.1
1

Зарегистрироваться ≈ 2 мин

  • почта плюс пароль или вход через Google
  • российская почта на mail.ru и yandex.ru проходит
  • карта и телефон не требуются
2

Выбрать модель ≈ 30 сек

  • в списке моделей сверху выбираешь Qwen3.8-Max
  • по умолчанию может стоять модель попроще
  • язык интерфейса переключается в настройках на русский
3

Проверить, что работает ≈ 1 мин

  • пишешь запрос на русском, ответ должен прийти на русском
  • прикладываешь PDF или картинку и просишь разобрать
  • если ответы приходят от другой модели, проверь выбор сверху
4

Итого около пяти минут от «никогда не слышал» до рабочего чата. Никаких зарубежных карт, номеров и посредников. Если Qwen у тебя вообще первый раз, базовые вещи по интерфейсу и первым промптам разобраны в отдельном гайде Qwen: что за нейросеть и как пользоваться из России.

Бесплатный чат работает на серверах китайской компании и подчиняется китайскому законодательству. Рабочие документы с персональными данными клиентов, коммерческие тайны, паспорта и договоры туда грузить не надо. Это правило одинаково для любой зарубежной нейросети, но с китайскими его нарушают чаще, потому что «зато бесплатно».

Новая модель полезна ровно настолько, насколько ты умеешь ставить ей задачу. Пройди мини-курс «Claude за вечер»: от установки до первых результатов на твоих задачах.

Пройти мини-курс →

Что модель реально сделала: пять кейсов от Alibaba

Тут важно сразу поставить рамку. Всё, что ниже, это примеры самой Alibaba из релиза. Независимых проверок на начало августа 2026 ещё нет, а компания показывает свои лучшие прогоны. Читать стоит как «на что модель способна в удачном случае», а не как обещание такого результата у тебя.

ЗадачаСколько занялоРезультат по данным Alibaba
Разработка утилиты Oh-my-CLI16 дней автономно265 коммитов, 127 пул-реквестов, 151 закрытая задача
Воспроизведение научной статьиоколо 5 дней, 125 часов вычислений7600 строк кода, 33 запуска обучения на GPU, результат выше оригинала на 2,7 балла по AIME24
Соревнование Tianchi24 часарешение обошло 458 команд из 526 живых участников
Проектирование микросхемыне указаносхема ужалась с 8298 вентилей до 678, площадь кристалла меньше на 81%
Симуляция электронной торговлине указанокапитал вырос со 100 тысяч юаней до 416 252, на 38% лучше второго места

Кейс с шестнадцатидневной разработкой интереснее остальных, потому что он ближе всего к реальной работе. Модель не просто писала код: она вела репозиторий, открывала пул-реквесты, разбирала задачи, возвращалась к своим же ошибкам. Именно этот сценарий раньше разваливался у всех моделей примерно на второй день, когда контекст переполнялся и агент забывал, зачем он вообще всё начал.

Главный сдвиг: раньше нейросеть измеряли качеством одного ответа. Теперь измеряют тем, сколько дней она способна не потерять нить задачи.

Бенчмарки: где Qwen3.8-Max сильнее ChatGPT и Claude

Alibaba заявляет, что модель идёт вровень или выше Claude Opus 4.8, Claude Fable 5 и GPT-5.6 Sol по нескольким категориям. Цифры такие:

Баллы Qwen3.8-Max по бенчмаркам (из 100)

PaperBench
93
GPQA Diamond
92.6
Parametric CAD
91.5
Terminal-Bench 2.1
86.6
OSWorld-Verified
86.1

PaperBench с результатом 93 это лучший показатель в сравниваемой группе: бенчмарк проверяет, насколько модель способна воспроизвести научную работу по её описанию. А вот на Terminal-Bench 2.1, где меряют работу в терминале, GPT-5.6 Sol с 88,8 балла держится впереди Qwen с его 86,6.

Отдельно стоит смотреть на публичные арены, где модели сравнивают вслепую живые люди. Там Qwen3.8-Max занимает пятое место в текстовой арене, второе в визуальной и четвёртое во фронтенд-коде. Картина честнее рекламной: топ, но не первое место по всем фронтам.

Бенчмарки от вендора почти всегда подобраны под сильные стороны модели. Полезнее смотреть на две вещи: где производитель сам признаёт отставание (тут это терминал против GPT-5.6 Sol) и какие места модель занимает в слепых аренах. Если и там и там результат приличный, цифрам можно доверять хотя бы наполовину.

Сколько стоит и как оплатить из России

Чат бесплатный, но у него есть потолок по числу сообщений в сутки и нет доступа к настройкам вроде reasoning_effort. Как только задача становится серьёзной, упираешься в API.

ЧтоЦена за 1 млн токеновВ рублях по курсу ~90 ₽/$
Входные токены$2~180 ₽
Выходные токены$6~540 ₽
Неявный кеш (повтор запроса)$0,25~23 ₽
Явный кеш, чтение$0,17~15 ₽
Явный кеш, создание$2,50~225 ₽

По подсчётам Alibaba это примерно 40% от цены Claude Opus 5 по входу и 24% по выходу. Разница ощутимая, особенно на длинных сессиях, где модель много пишет. Для сравнения полезно посмотреть разбор цены Claude Opus 5 и оплаты из России: там те же расчёты, но с другой стороны.

Лимиты по скорости щедрые: 2 миллиона токенов в минуту и 15 тысяч запросов в минуту. Для одного человека это недостижимый потолок.

Теперь про оплату. Регистрация в консоли Alibaba Cloud Model Studio идёт по международной процедуре, и карты российских банков там не проходят: ни Мир, ни Visa, ни Mastercard, выпущенные в РФ. Российский номер телефона при этом принимается. Варианта три:

  1. Зарубежная карта. Wise, Revolut, карта банка Казахстана или Грузии. Alibaba при привязке снимает около доллара на проверку и возвращает за несколько дней.
  2. Сервис-посредник. Сервис оплаты подписок оплатит зарубежной картой за рубли (реферальная ссылка: тебе тот же прайс, мне небольшой процент). Способ рабочий, но сверху ляжет комиссия сервиса.
  3. Агрегатор или роутер. Qwen3.8-Max появляется у OpenRouter и у российских агрегаторов вроде BotHub и MashaGPT, где платишь рублями и без зарубежной карты. Наценка есть, зато возни ноль.

Общая логика оплаты зарубежных ИИ-сервисов из России со всеми подводными камнями разобрана в гайде как оплатить нейросети из России.

Первым делом после привязки карты поставь лимит расходов в кабинете. Модель заточена под длинные автономные сессии, а «работай, пока не решишь» в промпте означает ровно это. Без потолка забытый на ночь агент превращается в трёхзначный счёт к утру.

Проверка на бытовых задачах: пять запросов вместо ChatGPT

Бенчмарки про воспроизведение научных статей мало говорят о том, заменит ли модель твой ежедневный ChatGPT. Ниже пять запросов, которые прогоняются за полчаса в бесплатном чате и показывают разницу быстрее любого обзора. Прогони их на Qwen3.8-Max и на своей текущей нейросети, сравни ответы в лоб.

Тест 1. Длинный документ. Сильная сторона модели это контекст, поэтому проверять надо им.

Прикладываю PDF на [N] страниц. Сделай три вещи.
 
1. Выпиши 7 главных тезисов документа, каждый одним предложением, с указанием страницы.
2. Найди места, где документ сам себе противоречит или где цифры не сходятся. Если таких мест нет, честно напиши, что нет.
3. Составь список из 5 вопросов, ответов на которые в документе нет, но они критичны для решения.
 
Не пересказывай документ целиком. Никакой воды и вступлений.

Что смотреть: находит ли модель противоречия на разных концах документа. Модели с коротким контекстом честно читают начало и конец, а середину проскакивают.

Тест 2. Разбор таблицы или счёта. Кидаешь фото квитанции, выписки или прайса.

На фото [квитанция / выписка / прайс]. Переведи всё в таблицу: позиция, количество, цена за единицу, сумма.
 
Дальше проверь арифметику: сходится ли итог с суммой строк. Если не сходится, укажи на сколько и в какой строке ошибка.
 
В конце одной фразой скажи, есть ли позиции, которые выглядят завышенными или непонятными.

Что смотреть: не выдумывает ли модель цифры, которых на фото не видно. Это самая частая поломка на нечётких снимках.

Тест 3. Многошаговая задача без подсказок. Тут проверяется та самая автономность.

Задача: спланировать переезд из съёмной квартиры в другую по тому же городу через 3 недели. Бюджет 60 тысяч рублей, вещей на однушку, машины нет, работаю до 18:00 в будни.
 
Составь план по неделям с конкретными действиями и датами. Для каждого пункта укажи, сколько он стоит и сколько времени займёт. Отдельно вынеси то, что надо сделать заранее, иначе не успеть.
 
В конце посчитай итоговую смету и покажи, укладываюсь ли я в бюджет. Если не укладываюсь, предложи, что урезать.

Что смотреть: держится ли модель ограничений (бюджет, отсутствие машины, рабочие часы) до конца ответа или забывает их к третьему абзацу.

Тест 4. Русский язык без китайского акцента. Слабое место многих китайских моделей.

Перепиши текст ниже так, чтобы его прочитал занятой человек с телефона: короткие абзацы, живой разговорный язык, без канцелярита.
 
Запрещено: длинное тире, эмодзи, слова «таким образом», «более того», «в современном мире».
 
Сохрани все цифры и факты без изменений. Длина примерно та же.
 
Текст: [вставь свой абзац]

Что смотреть: соблюдает ли модель запреты. Правило «без длинного тире» роняет большинство моделей с первой попытки.

Тест 5. Код без программирования. Даже если ты не программист, это полезная проверка.

Сделай один HTML-файл: калькулятор стоимости доставки. Поля: вес в кг, расстояние в км, тип груза (обычный / хрупкий / срочный).
 
Формула: 300 рублей база, плюс 40 рублей за кг, плюс 15 рублей за км. Хрупкий груз плюс 25% к итогу, срочный плюс 50%.
 
Всё в одном файле, без внешних библиотек. Стиль спокойный, светлый, шрифт системный. Сразу покажи результат при изменении любого поля.
 
Выдай готовый код целиком, без сокращений и комментариев вида «здесь ваш код».

Что смотреть: открывается ли файл двойным кликом и правильно ли считает. Проверь на весе 10 кг и расстоянии 100 км со срочным грузом: 300 плюс 400 плюс 1500 это 2200, со срочной надбавкой должно выйти 3300 рублей.

Прогоняй все пять тестов в одном формате: один и тот же промпт, одна и та же приложенная картинка, ответы рядом в двух окнах. Ощущение «эта модель как-то поумнее» почти всегда обманывает, а разница на конкретной задаче видна сразу.

Открытые веса: что это меняет и для кого

Alibaba обещала выложить веса на Hugging Face и ModelScope в течение недели после релиза 3 августа 2026. Для компании это первый случай, когда открывается модель такого масштаба.

Для домашнего пользователя это ничего не меняет. Модель на 2,4 триллиона параметров не запускается на ноутбуке и не запустится: там нужны серверные стойки с десятками видеокарт. Практический смысл открытых весов в другом.

Первое: вместе с флагманом идёт компактная версия Qwen3.8-27B, и вот её при желании реально поднять на своём железе. Как это делается на обычном компьютере, разобрано в гайде нейросеть на компьютере через Ollama.

Второе: открытые веса означают, что модель смогут хостить сторонние провайдеры, включая российских. Отсюда конкуренция по цене и доступ без зарубежной карты. Именно так до этого стали доступны DeepSeek и другие китайские модели, и тема доступа без обходных путей подробно разобрана в гайде нейросети без VPN в России.

Где Qwen3.8-Max проседает

Честная картина выглядит так.

Что пока держится на слове Alibaba

  • все кейсы с многодневной работой это внутренние прогоны компании
  • независимой проверки бенчмарков на август 2026 нет
  • непонятно, сколько таких сессий разваливается на каждый показанный успех
  • лицензия на открытые веса на момент анонса не объявлена

Что проверяется прямо сейчас

  • чат открывается из России без VPN и бесплатно
  • цены API опубликованы и заметно ниже флагманов OpenAI и Anthropic
  • места в слепых аренах: топ-5 по тексту, второе по картинкам
  • совместимость API с форматами OpenAI и Anthropic

Плюс три прикладных ограничения, о которых стоит знать заранее.

Терминал. По собственным данным Alibaba, GPT-5.6 Sol на Terminal-Bench 2.1 идёт впереди. Если основная работа это агент в консоли, преимущество Qwen пока не очевидно, и тут стоит смотреть на терминальный агент от той же Alibaba: он разобран в гайде Qwen Code как альтернатива Claude Code.

Данные. Всё, что уходит в чат, обрабатывается по китайскому праву. Для личных задач нормально, для клиентских документов нет.

Скорость движения рынка. Kimi K3 вышел за неделю до Qwen3.8-Max, следующий флагман выйдет через две. Строить рабочий процесс намертво под одну модель сейчас плохая идея, лучше держать совместимый по API слой, чтобы менять модель одной строкой.

Чек-лист: что у тебя теперь есть

Начни с бесплатного чата и третьего теста про переезд: он занимает три минуты и показывает главное отличие этой модели от прошлых, то есть способность держать ограничения задачи до последнего абзаца. Если результат понравился, дальше уже имеет смысл разбираться с API и оплатой.

Хочешь общую картину по свежим релизам, посмотри обзор какие нейросети вышли летом 2026.

По материалам The Decoder: https://the-decoder.com/alibabas-open-weight-qwen3-8-max-takes-on-long-horizon-ai-tasks-with-2-4-trillion-parameters/

Рассылка

Подпишись на еженедельную рассылку

Полезные материалы и скиллы, которые усилят твою работу с нейросетями и помогут больше зарабатывать. Раз в неделю, без воды и спама.

Частые вопросы

Работает ли Qwen3.8-Max в России без VPN?

Да. Чат на chat.qwen.ai открывается из России напрямую, без VPN и зарубежной карты, регистрация по почте или через Google. Модель Qwen3.8-Max выбирается в списке сверху. Платить не нужно: чат бесплатный, лимиты мягкие. VPN и карта понадобятся только для API через консоль Alibaba Cloud.

Сколько стоит Qwen3.8-Max по API?

2 доллара за миллион входных токенов и 6 долларов за миллион выходных. По курсу августа 2026 это примерно 180 и 540 рублей. Кеш дешевле: повторное чтение из явного кеша стоит 0,17 доллара за миллион. Alibaba заявляет цену около 40% от Claude Opus 5 по входу и 24% по выходу.

Чем Qwen3.8-Max отличается от обычного Qwen?

Это флагман на 2,4 триллиона параметров с архитектурой Mixture-of-Experts, из которых на каждый запрос работают 95 миллиардов. Главное отличие в другом: модель специально тренировали на многодневных автономных задачах, поэтому она держит длинную работу с кодом и файлами, а не только диалог в чате.

Правда, что Qwen3.8-Max работает над задачей несколько дней?

По данным Alibaba, да. В их примерах модель 16 дней вела разработку CLI-утилиты (265 коммитов, 127 пул-реквестов) и за 5 дней воспроизвела научную статью, потратив 125 часов вычислений. Это цифры самой компании, независимой проверки на август 2026 ещё нет.

Когда выложат веса Qwen3.8-Max и что это даёт?

Alibaba обещала открытые веса на Hugging Face и ModelScope в течение недели после релиза 3 августа 2026. Это первый случай, когда компания открывает модель такого масштаба. Домашнему пользователю это ничего не даёт: 2,4 триллиона параметров не запустятся на обычном компьютере. Смысл в компактной версии Qwen3.8-27B и в том, что модель смогут хостить другие провайдеры.

Мини-курс «Claude за вечер»

За один вечер настроишь Claude под свои задачи: внутри 35+ промптов, скиллов и агентов. Гарантия возврата 7 дней. Дальше есть Лаборатория ИИ-маркетинга, где из нейросети собирается целый отдел маркетинга.

Пройти мини-курс