Alibaba развернула линейку Qwen 3.8 с августа по сентябрь 2026 года. Объясняем, чем отличаются Max, Flash, Omni Flash, 27B и Open 2.4T и на что смотреть пользователю Qwen AI.
Флагман и его открытая версия
Флагман Max анонсирован 3 августа: 2,4 трлн параметров, окно на 1 млн токенов, мультимодальность. На старте рейтингов Arena он был пятым по тексту и вторым по зрению.
Веса флагмана Alibaba выложила на Hugging Face как Qwen3.8-2.4T-A95B. Это не полная копия облачной Max: картинки не понимает, лицензия своя, родное окно меньше.
Qwen 3.8 27B
27B — плотная модель на 27 млрд параметров с визуальным энкодером, лицензия Apache 2.0. Понимает текст, картинки и видео, родное окно — 262 тысячи токенов. По карточке модели: SWE-bench Pro — 61,7, LiveCodeBench v6 — 90,3.
Быстрые модели
Omni Flash (18 сентября) — омни-модель: расшифровывает голос, разбирает видео, отвечает текстом. По заявлению Alibaba, час аудио она обрабатывает на 98% дешевле прежних моделей. Flash — быстрая и недорогая для текста.
Что ещё вышло в сентябре
- Anthropic 22 сентября выпустила Claude Opus 5.5. По заявлению компании, на большинстве задач она держит уровень самой мощной Fable 5.1, а стоит на 40% дешевле Opus 5. Окно — 1 млн токенов, ответ — до 128 тысяч токенов.
- Meta* 2 сентября выпустила Muse Spark 1.3 — модель рассуждений с окном на 1 млн токенов, которая понимает изображения, видео и документы. По заявлению компании, на те же задачи она тратит на четверть меньше токенов, чем версия 1.2.
- Главная новость месяца — поколение GPT-6. В нём три модели: Astra для самых сложных задач, Sol для повседневной работы и быстрая Luna. Astra открылась 4 сентября, Sol и Luna — 22 сентября; окно у всех — 1,05 млн токенов.
- Новая DeepSeek V4.1 Flash — быстрая модель с нативным пониманием картинок и окном на 1 млн токенов. Вышла 10 сентября, веса открыты под MIT, а в API она стоит от $0,15 за миллион входных токенов.
- GLM 5.3 от Zhipu — открытая модель, которую разработчик называет самой сильной среди открытых для программирования. Рядом — GLM 5.3 Flash, понимающая картинки и видео, и её скоростной режим FlashX.
- Grok 4.7 вышла 21 сентября. По данным xAI, это заметное улучшение Grok 4.6 при той же цене и скорости: сильнее в программировании и многошаговых задачах, понимает картинки, держит 500 тысяч токенов контекста.
Что объединяет новинки
Новинки объединяют две вещи. Во-первых, огромное окно контекста — около миллиона токенов у GPT-6, Claude Opus 5.5, Qwen 3.8, GLM 5.3, DeepSeek V4.1 Flash и Muse Spark 1.3. Во-вторых, понимание изображений почти у всех: скриншот или фото можно просто приложить к вопросу.
Где новые модели пригодятся для чат-ботов
В чат-ботах главное изменение — окно на миллион токенов стало нормой: в один разговор помещаются книги и пачки документов. А быстрые модели вроде GPT-6 Luna и DeepSeek V4.1 Flash стали настолько дешёвыми, что их можно использовать без оглядки на лимиты.
Что выбрать под задачу
- Бесплатно и на каждый день — DeepSeek V4.1 Flash, GLM 5.3 или Qwen 3.8 Flash.
- Расшифровать голосовое или видео — Qwen 3.8 Omni Flash.
- Документы и тексты для работы — GPT-6 Sol или Claude Opus 5.5.
- Сложный код и большие проекты — GPT-6 Astra, Claude Opus 5.5 или Grok 4.7.
- Запустить модель у себя — Qwen 3.8 27B.
Доступ из России
С доступом всё не так просто: OpenAI и Anthropic официально не работают в России, сервисы Meta* запрещены, а оплатить API российской картой нельзя. Проще всего пользоваться новинками через агрегатор с рублёвой оплатой — там не нужен VPN и зарубежная карта.
Попробовать новые модели без VPN →
Короткие ответы
Какую Qwen 3.8 выбрать?
Для текстов — Flash, для аудио и видео — Omni Flash, для кода и анализа — Max, для запуска у себя — 27B.
Можно ли скачать Qwen 3.8?
Да, открытые 27B и Open 2.4T. Облачные Max, Flash и Omni Flash — нет.
Чем Max отличается от Open 2.4T?
Открытая версия понимает только текст, у неё меньше родное окно и своя лицензия.
Нужен ли VPN, чтобы пользоваться новыми нейросетями?
Если работать через агрегатор с оплатой в рублях — нет. Напрямую сервисы OpenAI и Anthropic в России официально не работают.
Какие из новинок можно попробовать бесплатно?
Быстрые модели: DeepSeek V4.1 Flash, GLM 5.3, Qwen 3.8 Flash и Qwen 3.8 Omni Flash. Флагманы — GPT-6, Claude Opus 5.5, Grok 4.7 — платные.
Что новые нейросети меняют для пользователей Qwen AI?
Главное — больше выбора для подготовительной работы: тексты, разбор материалов, промпты. Попробовать новинки рядом с привычными инструментами можно по кнопке на этой странице.
* Meta Platforms Inc. признана в России экстремистской организацией, её деятельность запрещена.