Apsara 2026 · Модели · октябрь 2026
Qwen: что нового в нейросети Alibaba после Apsara 2026 и как её использовать бизнесу
Разбираю анонсы Alibaba с Apsara 2026: какие модели Qwen вышли и обещаны, какую брать под задачу и что с этим делать компании в России.
Артём Борисов - бизнес-консультант, внедрение AI-сотрудников ·
Коротко
Qwen - семейство нейросетей Alibaba: языковые модели для текста и кода, модели для картинок, голоса и перевода, часть из них с открытыми весами. На Apsara 2026 Alibaba объявила, что Qwen 4 уже обучается, а Qwen 4.5 и Qwen 5 будут масштаба 5-10 трлн параметров, и показала модель, которая месяц улучшала себя сама. Ниже - что нового в линейке, чем Flash отличается от Max в деньгах, что умеют голос, перевод и картинки и как российской компании использовать открытые модели Qwen.
Что такое нейросеть Qwen и из чего состоит линейка
Qwen - это линейка моделей, а не одна нейросеть. На Apsara 2026 команда Qwen описала две ветки. Qwen Max - максимум интеллекта, на ней Alibaba обкатывает самоулучшение. Qwen Flash и Qwen-27B - максимум экономии, по формулировке Alibaba «ИИ для всех».
У Qwen большая открытая часть. По данным компании, это 460+ официальных открытых моделей, почти 300 тыс. производных от них и 3 млрд+ скачиваний. Поддержка языков выросла с 2 у первой версии до 201 сейчас. Русскому повезло: в тесте агентов на неанглийских языках BabelArena модель Qwen3.8-Max набрала по русскому 68,1 балла, чуть больше, чем по китайскому (67,6).
Деньги тоже растут. Относительно поколения Qwen 3.7, по заявлению Alibaba, выручка выросла в 8,5 раза, число вызовов - в 12 раз. Все цифры в статье - заявления Alibaba и её партнёров, независимой проверки у них нет.
Qwen 4, Qwen 5 и самоулучшение: что анонсировали на Apsara 2026
| Поколение | Размер | Статус |
|---|---|---|
| Qwen2.5 | 72B | вышла |
| Qwen3 | 235B, 23B активных | вышла |
| Qwen3.5 | 397B, 17B активных | вышла |
| Qwen3.8 | 2,4T, 94B активных | текущий флагман |
| Qwen4 (Max, Flash, Plus, 27B) | не раскрыт | обучается, «скоро», дат нет |
| Qwen4.5 и Qwen5 | 5-10T параметров | в планах |
Модель, которая улучшает себя сама
Qwen3.8-Max за месяц полностью автоматически прошёл 33 цикла улучшения. Оценка Artificial Analysis выросла с 40 до 45.
ПодробнееСвернуть
Alibaba называет это RSI - рекурсивное самоулучшение: модель проходит циклы улучшения полностью автоматически, без участия людей. За 30 дней такой самоэволюции, по словам команды Qwen, флагман сделал заметный скачок.
Самая наглядная демонстрация - проектирование чипа. Модель 60+ часов улучшала решение, сделала 10 000+ вызовов промышленных программ проектирования микросхем и уменьшила площадь модуля на 42% без потери производительности. Это внутренний эксперимент Alibaba, не клиентский проект.
16 дней разработки без человека
Qwen3.8-Max автономно, за 16 дней, сделал агента для программирования oh-my-cli: 265 коммитов и 127 запросов на слияние кода.
Первое место в веб-разработке
Qwen3.8-Max-0902 на 2 сентября 2026 года занял первое место в рейтинге Code Arena WebDev с 1691 баллом.
Теперь про запрос «qwen code». Отдельного продукта с таким названием в материалах Apsara 2026 нет. Для программирования Alibaba продвигает Qoder - среду AI-разработки, внутри которой работает Qwen3.8-Max. Открытая Qwen3.8-27B в тесте SWE-bench Pro выросла с 53,5 до 61,7, а набор плагинов Qwen-MM-Plugins подключается к Claude Code и Codex. Как на этом строят разработку, я разобрал в статье про вайбкодинг.
Qwen Flash против Max: какую модель брать под задачу
Самая практичная цифра конференции пришла от TapTap, платформы, где игры собирают по текстовому описанию. Они прогнали обе модели в реальном игровом движке.
| Модель | Прохождение уровня L2 | Цена за кейс |
|---|---|---|
| Qwen3.8-Max | 83,3% | $1,17 |
| Qwen3.8-Flash | 82,5% | $0,10 |
Разница в качестве - 0,8 процентного пункта, в цене - примерно в 12 раз. Для справки, Qwen3.8-Max стоит 2 доллара за 1 млн входных токенов и 6 долларов за 1 млн выходных. Сама Alibaba формулирует правило выбора так: при одной цене бери самую сильную модель, при одинаковых способностях - самую дешёвую.
- NetEase Games поставила маршрутизатор, который сам выбирает модель под запрос. Результат на тесте SWE-Bench остался на уровне одного флагмана (64% решённых задач), а стоимость упала на 73%.
- Там же доля попаданий в кэш выросла с 50% до 80%+. Кэшированный вход стоит около 1/10 обычного, так что на длинных диалогах это главная экономия.
- Команда продукта Нами (360 Group) использует дешёвый Flash для поиска направления и регулярных циклов, а сильную модель - для итоговой работы и проверки.
Я бы начинал любой проект на Flash-версии и переходил на Max только там, где на своих примерах видно, что дешёвая модель ошибается. Этот вопрос напрямую влияет на стоимость ИИ-агента в эксплуатации.
Перевод, голос и картинки: LiveTranslate, Qwen Audio, Qwen Image
Qwen3.8-LiveTranslate
Синхронный перевод аудио и видео: понимает 60 языков, озвучивает на 29, задержка около 2,5 секунды. В пресс-релизе - сокращение задержки с 2,8 до 2,3 секунды.
ПодробнееСвернуть
Синхронный перевод - когда модель переводит речь, пока человек ещё говорит, как переводчик в наушниках на конференции. Alibaba заявляет, что в сравнении с GPT-Realtime-Translate её модель чаще признают лучшей (чистый перевес 69%), а против Gemini 3.5 Live Translate - 65%.
Qwen-Audio 3.1
Распознавание речи на 30 языках с разметкой «кто что сказал», синтез речи на 16 языках с клонированием голоса, живой голосовой диалог, который можно перебивать.
ПодробнееСвернуть
Есть ли русский среди 30 языков распознавания, в материалах не указано. Отдельно анонсирован TTS-Next: генерация целой звуковой сцены по сценарию, с несколькими голосами, фоном и музыкой, для аудиокниг, подкастов и игр. Запуск этой версии не подтверждён.
Qwen-Image 2.1 и 3.1
Открытая Qwen-Image 2.1 (7B) генерирует и редактирует картинки, делает прозрачный фон, сохраняет товар и лицо. Картинку в 2K делает за 1,59 секунды.
ПодробнееСвернуть
Qwen-Image 2.1 выложена на Hugging Face, ModelScope и GitHub. Она редактирует по маске, делает инфографику, раскадровки и текст на постерах.
Qwen-Image 3.1 обещана до конца года, под дизайн и маркетинг для e-commerce, с прозрачным фоном «из коробки». На самой секции у неё был только слайд «Coming Soon», без возможностей и дат.
Мой фильтр для этих анонсов простой: то, что выложено с открытыми весами или уже работает в API, можно пробовать. «Скоро» и «до конца года» пока лучше не закладывать в планы.
Qwen в России: облако под вопросом, открытые модели работают на своём сервере
Облачная платформа Alibaba Model Studio работает в шести регионах: Пекин, Гонконг, Сингапур, Токио, Франкфурт, Вирджиния. Доступ российских компаний к ней не подтверждён, поэтому строить на ней продукт я бы не стал.
Открытые модели - другое дело. Qwen3.8-27B выпущена под лицензией Apache 2.0, её можно использовать в коммерции. За месяц после выхода её скачали 56 млн+ раз. Эдди Ву назвал открытую Qwen-27B самой популярной у разработчиков моделью для запуска на своём компьютере. Модели Qwen подключаются к Ollama и LM Studio, то есть разворачиваются на собственном сервере.
- Данные не уходят за рубеж. Модель работает в вашем контуре, и требования 152-ФЗ к персональным данным выполнить проще.
- Модель можно дообучить под свою отрасль. Petkit дообучила Qwen3.8-27B на данных о здоровье животных и подняла точность по верхней категории на 52 процентных пункта.
- Гибридная схема: маленькая модель на своём сервере обезличивает данные и решает простое, большая в облаке берёт сложное. На секции ModelScope заявили экономию токенов 40-60% (внутренние тесты).
Минус своего сервера - железо и обслуживание. Для пилота я бы взял открытую Qwen среднего размера, прогнал её на 50-100 реальных задачах компании и сравнил с тем, что даёт облачная модель. Решение принимать по своим цифрам, а не по рейтингам: так советовал и Цинь Чжоукай из Manycore. Его команда начинала на Claude и GPT, потом добавила Qwen и выбирала модель на своих задачах.
Вывод
Линейка Qwen растёт в обе стороны: от флагмана Max, который сам прошёл 33 цикла улучшения, до открытой 27B под Apache 2.0. Для бизнеса главная цифра конференции - Flash в 12 раз дешевле Max при разнице в качестве 0,8 пункта на тесте TapTap. Облако Alibaba для России под вопросом, а открытые модели можно запускать на своём сервере. Начинать стоит с дешёвой модели и своих задач, а не с рейтингов.
Что сделать
- 1Соберите 50 реальных задач, которые хотите отдать нейросети, вместе с правильными ответами.
- 2Прогоните их на открытой модели Qwen через Ollama или LM Studio и посчитайте долю верных ответов.
- 3Проверьте, есть ли в этих задачах персональные данные, и если есть - запланируйте запуск модели на своём сервере.
- 4Сравните цену одного верного ответа на дешёвой и сильной модели и оставьте сильную только там, где разница заметна.
Частые вопросы
Что такое Qwen?+
Qwen - семейство нейросетей компании Alibaba. В него входят языковые модели для текста и кода, а также модели для картинок, голоса и перевода. Сотни моделей Qwen выложены с открытыми весами, их можно запускать на своём сервере.
Что нового в Qwen после Apsara 2026?+
Alibaba объявила, что Qwen 4 уже обучается, а Qwen 4.5 и Qwen 5 будут масштаба 5-10 трлн параметров. Флагман Qwen3.8-Max за месяц сам прошёл 33 цикла улучшения. Также показали синхронный перевод LiveTranslate, голосовые модели Qwen-Audio 3.1 и открытую модель картинок Qwen-Image 2.1.
Можно ли пользоваться Qwen в России?+
Доступ российских компаний к облаку Alibaba не подтверждён. Открытые модели Qwen, например Qwen3.8-27B под лицензией Apache 2.0, можно скачать и запустить на своём сервере. С персональными данными при этом нужно соблюдать 152-ФЗ.
Чем Qwen Flash отличается от Qwen Max?+
Max - самая сильная модель, Flash - быстрая и дешёвая. На тесте TapTap Max прошёл 83,3% задач по 1,17 доллара за кейс, а Flash - 82,5% по 10 центов. Для большинства рабочих задач хватает Flash.
Есть ли у Qwen модель для программирования?+
Отдельного продукта Qwen Code в материалах Apsara 2026 нет. Для разработки Alibaba продвигает среду Qoder, внутри которой работает Qwen3.8-Max. Открытая Qwen3.8-27B тоже пишет код: в тесте SWE-bench Pro она набрала 61,7.
Умеет ли Qwen делать картинки?+
Да, этим занимается Qwen-Image. Открытая версия 2.1 генерирует и редактирует изображения, делает прозрачный фон и сохраняет товар и лицо при правке. Версию 3.1 Alibaba обещает до конца года.
Источники
- Эдди Ву: речь на открытии Apsara 2026 (Alizila)
- Пресс-кит Apsara 2026 (Alizila)
- Apsara Conference 2026, Ханчжоу, 22-24 сентября 2026: секция «Advancing Qwen Toward the Agentic Era»
- Apsara Conference 2026: секции «From Capability to Value: Large Model Solutions in Practice» и «Alibaba Cloud Model Studio»
- Apsara Conference 2026: секция «ModelScope: From Open Models to Open Resources»
- Apsara Conference 2026: секции «Audiovisual Generation: Multimodal Creation and Entertainment» и «Alibaba Cloud AI Gaming Forum»
Об авторе. Артём Борисов - бизнес-консультант, внедряет AI-сотрудников в малом и среднем бизнесе: продажи, документы, учёт, мониторинг. Кейсы с цифрами - на главной странице.
Читайте также
Право · 152-ФЗ
152-ФЗ и нейросети: почему нельзя просто отправить данные клиентов в ChatGPT
Читать →
Apsara 2026 · Экономика
Сколько стоит ИИ-агент и как посчитать его эффект
Читать →
Apsara 2026 · Разработка
Вайбкодинг: что это такое и почему он вырос в вайб-работу
Читать →
Apsara 2026 · Главное
Apsara 2026: 10 выводов главной ИИ-конференции Китая для бизнеса
Читать →
Хотите применить это в своей компании?
Опишите процесс, который съедает больше всего ручного времени. Я покажу, как выглядело бы решение на ИИ-агенте и какие метрики оно изменит.