Apsara 2026 · Модели · октябрь 2026

Qwen: что нового в нейросети Alibaba после Apsara 2026 и как её использовать бизнесу

Разбираю анонсы Alibaba с Apsara 2026: какие модели Qwen вышли и обещаны, какую брать под задачу и что с этим делать компании в России.

Артём Борисов - бизнес-консультант, внедрение AI-сотрудников ·

Коротко

Qwen - семейство нейросетей Alibaba: языковые модели для текста и кода, модели для картинок, голоса и перевода, часть из них с открытыми весами. На Apsara 2026 Alibaba объявила, что Qwen 4 уже обучается, а Qwen 4.5 и Qwen 5 будут масштаба 5-10 трлн параметров, и показала модель, которая месяц улучшала себя сама. Ниже - что нового в линейке, чем Flash отличается от Max в деньгах, что умеют голос, перевод и картинки и как российской компании использовать открытые модели Qwen.

Что такое нейросеть Qwen и из чего состоит линейка

Qwen - это линейка моделей, а не одна нейросеть. На Apsara 2026 команда Qwen описала две ветки. Qwen Max - максимум интеллекта, на ней Alibaba обкатывает самоулучшение. Qwen Flash и Qwen-27B - максимум экономии, по формулировке Alibaba «ИИ для всех».

У Qwen большая открытая часть. По данным компании, это 460+ официальных открытых моделей, почти 300 тыс. производных от них и 3 млрд+ скачиваний. Поддержка языков выросла с 2 у первой версии до 201 сейчас. Русскому повезло: в тесте агентов на неанглийских языках BabelArena модель Qwen3.8-Max набрала по русскому 68,1 балла, чуть больше, чем по китайскому (67,6).

Деньги тоже растут. Относительно поколения Qwen 3.7, по заявлению Alibaba, выручка выросла в 8,5 раза, число вызовов - в 12 раз. Все цифры в статье - заявления Alibaba и её партнёров, независимой проверки у них нет.

Qwen 4, Qwen 5 и самоулучшение: что анонсировали на Apsara 2026

ПоколениеРазмерСтатус
Qwen2.572Bвышла
Qwen3235B, 23B активныхвышла
Qwen3.5397B, 17B активныхвышла
Qwen3.82,4T, 94B активныхтекущий флагман
Qwen4 (Max, Flash, Plus, 27B)не раскрытобучается, «скоро», дат нет
Qwen4.5 и Qwen55-10T параметровв планах

Модель, которая улучшает себя сама

Qwen3.8-Max за месяц полностью автоматически прошёл 33 цикла улучшения. Оценка Artificial Analysis выросла с 40 до 45.

Подробнее

Alibaba называет это RSI - рекурсивное самоулучшение: модель проходит циклы улучшения полностью автоматически, без участия людей. За 30 дней такой самоэволюции, по словам команды Qwen, флагман сделал заметный скачок.

Самая наглядная демонстрация - проектирование чипа. Модель 60+ часов улучшала решение, сделала 10 000+ вызовов промышленных программ проектирования микросхем и уменьшила площадь модуля на 42% без потери производительности. Это внутренний эксперимент Alibaba, не клиентский проект.

16 дней разработки без человека

Qwen3.8-Max автономно, за 16 дней, сделал агента для программирования oh-my-cli: 265 коммитов и 127 запросов на слияние кода.

Первое место в веб-разработке

Qwen3.8-Max-0902 на 2 сентября 2026 года занял первое место в рейтинге Code Arena WebDev с 1691 баллом.

Теперь про запрос «qwen code». Отдельного продукта с таким названием в материалах Apsara 2026 нет. Для программирования Alibaba продвигает Qoder - среду AI-разработки, внутри которой работает Qwen3.8-Max. Открытая Qwen3.8-27B в тесте SWE-bench Pro выросла с 53,5 до 61,7, а набор плагинов Qwen-MM-Plugins подключается к Claude Code и Codex. Как на этом строят разработку, я разобрал в статье про вайбкодинг.

Qwen Flash против Max: какую модель брать под задачу

Самая практичная цифра конференции пришла от TapTap, платформы, где игры собирают по текстовому описанию. Они прогнали обе модели в реальном игровом движке.

МодельПрохождение уровня L2Цена за кейс
Qwen3.8-Max83,3%$1,17
Qwen3.8-Flash82,5%$0,10

Разница в качестве - 0,8 процентного пункта, в цене - примерно в 12 раз. Для справки, Qwen3.8-Max стоит 2 доллара за 1 млн входных токенов и 6 долларов за 1 млн выходных. Сама Alibaba формулирует правило выбора так: при одной цене бери самую сильную модель, при одинаковых способностях - самую дешёвую.

  • NetEase Games поставила маршрутизатор, который сам выбирает модель под запрос. Результат на тесте SWE-Bench остался на уровне одного флагмана (64% решённых задач), а стоимость упала на 73%.
  • Там же доля попаданий в кэш выросла с 50% до 80%+. Кэшированный вход стоит около 1/10 обычного, так что на длинных диалогах это главная экономия.
  • Команда продукта Нами (360 Group) использует дешёвый Flash для поиска направления и регулярных циклов, а сильную модель - для итоговой работы и проверки.

Я бы начинал любой проект на Flash-версии и переходил на Max только там, где на своих примерах видно, что дешёвая модель ошибается. Этот вопрос напрямую влияет на стоимость ИИ-агента в эксплуатации.

Перевод, голос и картинки: LiveTranslate, Qwen Audio, Qwen Image

Qwen3.8-LiveTranslate

Синхронный перевод аудио и видео: понимает 60 языков, озвучивает на 29, задержка около 2,5 секунды. В пресс-релизе - сокращение задержки с 2,8 до 2,3 секунды.

Подробнее

Синхронный перевод - когда модель переводит речь, пока человек ещё говорит, как переводчик в наушниках на конференции. Alibaba заявляет, что в сравнении с GPT-Realtime-Translate её модель чаще признают лучшей (чистый перевес 69%), а против Gemini 3.5 Live Translate - 65%.

Qwen-Audio 3.1

Распознавание речи на 30 языках с разметкой «кто что сказал», синтез речи на 16 языках с клонированием голоса, живой голосовой диалог, который можно перебивать.

Подробнее

Есть ли русский среди 30 языков распознавания, в материалах не указано. Отдельно анонсирован TTS-Next: генерация целой звуковой сцены по сценарию, с несколькими голосами, фоном и музыкой, для аудиокниг, подкастов и игр. Запуск этой версии не подтверждён.

Qwen-Image 2.1 и 3.1

Открытая Qwen-Image 2.1 (7B) генерирует и редактирует картинки, делает прозрачный фон, сохраняет товар и лицо. Картинку в 2K делает за 1,59 секунды.

Подробнее

Qwen-Image 2.1 выложена на Hugging Face, ModelScope и GitHub. Она редактирует по маске, делает инфографику, раскадровки и текст на постерах.

Qwen-Image 3.1 обещана до конца года, под дизайн и маркетинг для e-commerce, с прозрачным фоном «из коробки». На самой секции у неё был только слайд «Coming Soon», без возможностей и дат.

Мой фильтр для этих анонсов простой: то, что выложено с открытыми весами или уже работает в API, можно пробовать. «Скоро» и «до конца года» пока лучше не закладывать в планы.

Qwen в России: облако под вопросом, открытые модели работают на своём сервере

Облачная платформа Alibaba Model Studio работает в шести регионах: Пекин, Гонконг, Сингапур, Токио, Франкфурт, Вирджиния. Доступ российских компаний к ней не подтверждён, поэтому строить на ней продукт я бы не стал.

Открытые модели - другое дело. Qwen3.8-27B выпущена под лицензией Apache 2.0, её можно использовать в коммерции. За месяц после выхода её скачали 56 млн+ раз. Эдди Ву назвал открытую Qwen-27B самой популярной у разработчиков моделью для запуска на своём компьютере. Модели Qwen подключаются к Ollama и LM Studio, то есть разворачиваются на собственном сервере.

  • Данные не уходят за рубеж. Модель работает в вашем контуре, и требования 152-ФЗ к персональным данным выполнить проще.
  • Модель можно дообучить под свою отрасль. Petkit дообучила Qwen3.8-27B на данных о здоровье животных и подняла точность по верхней категории на 52 процентных пункта.
  • Гибридная схема: маленькая модель на своём сервере обезличивает данные и решает простое, большая в облаке берёт сложное. На секции ModelScope заявили экономию токенов 40-60% (внутренние тесты).

Минус своего сервера - железо и обслуживание. Для пилота я бы взял открытую Qwen среднего размера, прогнал её на 50-100 реальных задачах компании и сравнил с тем, что даёт облачная модель. Решение принимать по своим цифрам, а не по рейтингам: так советовал и Цинь Чжоукай из Manycore. Его команда начинала на Claude и GPT, потом добавила Qwen и выбирала модель на своих задачах.

Вывод

Линейка Qwen растёт в обе стороны: от флагмана Max, который сам прошёл 33 цикла улучшения, до открытой 27B под Apache 2.0. Для бизнеса главная цифра конференции - Flash в 12 раз дешевле Max при разнице в качестве 0,8 пункта на тесте TapTap. Облако Alibaba для России под вопросом, а открытые модели можно запускать на своём сервере. Начинать стоит с дешёвой модели и своих задач, а не с рейтингов.

Что сделать

  1. 1Соберите 50 реальных задач, которые хотите отдать нейросети, вместе с правильными ответами.
  2. 2Прогоните их на открытой модели Qwen через Ollama или LM Studio и посчитайте долю верных ответов.
  3. 3Проверьте, есть ли в этих задачах персональные данные, и если есть - запланируйте запуск модели на своём сервере.
  4. 4Сравните цену одного верного ответа на дешёвой и сильной модели и оставьте сильную только там, где разница заметна.

Частые вопросы

Что такое Qwen?+

Qwen - семейство нейросетей компании Alibaba. В него входят языковые модели для текста и кода, а также модели для картинок, голоса и перевода. Сотни моделей Qwen выложены с открытыми весами, их можно запускать на своём сервере.

Что нового в Qwen после Apsara 2026?+

Alibaba объявила, что Qwen 4 уже обучается, а Qwen 4.5 и Qwen 5 будут масштаба 5-10 трлн параметров. Флагман Qwen3.8-Max за месяц сам прошёл 33 цикла улучшения. Также показали синхронный перевод LiveTranslate, голосовые модели Qwen-Audio 3.1 и открытую модель картинок Qwen-Image 2.1.

Можно ли пользоваться Qwen в России?+

Доступ российских компаний к облаку Alibaba не подтверждён. Открытые модели Qwen, например Qwen3.8-27B под лицензией Apache 2.0, можно скачать и запустить на своём сервере. С персональными данными при этом нужно соблюдать 152-ФЗ.

Чем Qwen Flash отличается от Qwen Max?+

Max - самая сильная модель, Flash - быстрая и дешёвая. На тесте TapTap Max прошёл 83,3% задач по 1,17 доллара за кейс, а Flash - 82,5% по 10 центов. Для большинства рабочих задач хватает Flash.

Есть ли у Qwen модель для программирования?+

Отдельного продукта Qwen Code в материалах Apsara 2026 нет. Для разработки Alibaba продвигает среду Qoder, внутри которой работает Qwen3.8-Max. Открытая Qwen3.8-27B тоже пишет код: в тесте SWE-bench Pro она набрала 61,7.

Умеет ли Qwen делать картинки?+

Да, этим занимается Qwen-Image. Открытая версия 2.1 генерирует и редактирует изображения, делает прозрачный фон и сохраняет товар и лицо при правке. Версию 3.1 Alibaba обещает до конца года.

Источники

  • Эдди Ву: речь на открытии Apsara 2026 (Alizila)
  • Пресс-кит Apsara 2026 (Alizila)
  • Apsara Conference 2026, Ханчжоу, 22-24 сентября 2026: секция «Advancing Qwen Toward the Agentic Era»
  • Apsara Conference 2026: секции «From Capability to Value: Large Model Solutions in Practice» и «Alibaba Cloud Model Studio»
  • Apsara Conference 2026: секция «ModelScope: From Open Models to Open Resources»
  • Apsara Conference 2026: секции «Audiovisual Generation: Multimodal Creation and Entertainment» и «Alibaba Cloud AI Gaming Forum»

Об авторе. Артём Борисов - бизнес-консультант, внедряет AI-сотрудников в малом и среднем бизнесе: продажи, документы, учёт, мониторинг. Кейсы с цифрами - на главной странице.

Хотите применить это в своей компании?

Опишите процесс, который съедает больше всего ручного времени. Я покажу, как выглядело бы решение на ИИ-агенте и какие метрики оно изменит.