«Qwen 3.8» — это не одна модель, а пять: облачный флагман, две быстрые модели и две открытые. Разбираем линейку и то, что важно знать тем, кто пользуется Qwen.
Qwen 3.8 Max и Open 2.4T
Флагман Max анонсирован 3 августа: 2,4 трлн параметров, окно на 1 млн токенов, мультимодальность. На старте рейтингов Arena он был пятым по тексту и вторым по зрению.
Open 2.4T — открытые веса того же флагмана, но с ограничениями: только текст, родное окно 262 тысячи токенов (расширяется примерно до миллиона), собственная лицензия qwen3.8-max вместо Apache 2.0.
Открытая модель среднего размера
Самая «народная» модель линейки: её можно скачать и запустить на мощной видеокарте в сжатом формате. Лицензия Apache 2.0, понимает изображения и видео, сильна в коде.
Qwen 3.8 Omni Flash и Flash
Omni Flash вышла 18 сентября: принимает текст, изображения, аудио и видео, отвечает текстом, понимает речь на 113 языках. Окно — 1 млн токенов, цена в API — $0,15 за миллион входных токенов. Flash — лёгкая модель для потока простых задач.
Что ещё вышло в сентябре
- У xAI — Grok 4.7: вышла 21 сентября, в тесте CursorBench прибавила почти шесть пунктов к Grok 4.6. Окно — 500 тысяч токенов, в API — $2 за миллион входных токенов.
- Claude Opus 5.5 — новая модель Anthropic для длинных задач: кода, аналитики, работы с большими документами. Вышла 22 сентября, окно на 1 млн токенов, знания до июня 2026 года; в API — $4 за миллион входных токенов.
- У китайской Zhipu AI — GLM 5.3 (753 млрд параметров, окно 1 млн токенов) и мультимодальные GLM 5.3 Flash и FlashX. Веса GLM 5.3 Flash открыты под свободной лицензией MIT.
- DeepSeek V4.1 Flash вышла 10 сентября: понимает изображения, держит 1 млн токенов контекста и, по заявлению DeepSeek, обходит даже собственный флагман V4 Pro. С 14 сентября запросы к V4 Pro в API обслуживает именно она.
- Meta* 2 сентября выпустила Muse Spark 1.3 — модель рассуждений с окном на 1 млн токенов, которая понимает изображения, видео и документы. По заявлению компании, на те же задачи она тратит на четверть меньше токенов, чем версия 1.2.
- OpenAI выпустила поколение GPT-6 из трёх моделей. Флагман Astra (общий доступ с 4 сентября) рассчитан на сложный анализ, код и длинные задачи, Sol (22 сентября) — рабочая модель на каждый день, Luna — самая быстрая и дешёвая. У всех трёх окно на 1,05 млн токенов и понимание картинок.
Что объединяет новинки
Почти у всех новинок окно контекста — около миллиона токенов: в один запрос помещаются книги, архивы переписки или целый программный проект. Второй тренд — быстрые модели резко подешевели: GPT-6 Luna стоит в API $0,10 за миллион входных токенов, DeepSeek V4.1 Flash и GLM 5.3 Flash — около $0,15.
Что это значит для чат-ботов
В чат-ботах главное изменение — окно на миллион токенов стало нормой: в один разговор помещаются книги и пачки документов. А быстрые модели вроде GPT-6 Luna и DeepSeek V4.1 Flash стали настолько дешёвыми, что их можно использовать без оглядки на лимиты.
Шпаргалка: что для чего
- Короткие ответы, письма, переводы — GPT-6 Luna или DeepSeek V4.1 Flash.
- Длинные документы целиком — Claude Opus 5.5 или GPT-6 Sol.
- Программирование — Claude Opus 5.5, Grok 4.7 или GLM 5.3.
- Картинки и скриншоты на входе — Qwen 3.8 Max или DeepSeek V4.1 Flash.
- Аудио и видео на входе — Qwen 3.8 Omni Flash.
Как попробовать новые модели из России
Официально большинство новинок в России недоступны: в списках стран OpenAI и Anthropic России нет, сервисы Meta* запрещены, а API почти везде оплачивается зарубежной картой. Рабочий вариант — сервис-агрегатор с оплатой в рублях: в нём новые модели собраны в одном окне, а VPN не нужен.
Короткие ответы
Какую Qwen 3.8 выбрать?
Для текстов — Flash, для аудио и видео — Omni Flash, для кода и анализа — Max, для запуска у себя — 27B.
Можно ли скачать Qwen 3.8?
Да, открытые 27B и Open 2.4T. Облачные Max, Flash и Omni Flash — нет.
Чем Max отличается от Open 2.4T?
Открытая версия понимает только текст, у неё меньше родное окно и своя лицензия.
Какая нейросеть самая мощная в сентябре 2026?
Однозначного лидера нет. В разных тестах впереди GPT-6 Astra, Claude Fable 5.1 и Claude Opus 5.5; Grok 4.7 в ряде рейтингов второй. Для конкретной задачи надёжнее проверить две-три модели на своём примере.
GPT-6 Astra Pro — это отдельная модель?
Нет. Pro — режим углублённого рассуждения той же модели: ответ дольше и дороже, но лучше на сложных задачах.
Появятся ли новые модели в работе с Qwen?
Новые модели не заменяют сам Qwen, а дополняют его: помогают подготовить текст, разобрать исходники, составить точный запрос. Попробовать их можно по кнопке на этой странице — без VPN.
* Meta Platforms Inc. признана в России экстремистской организацией, её деятельность запрещена.