Меню

Открытые модели · разбор · июль 2026

Qwen для бизнеса:
от ноутбука юриста до серверной

У Alibaba получилось то, чего нет ни у одной западной лаборатории: полная линейка сильных моделей под самой свободной лицензией. Разбираем, кому и когда Qwen выгоднее конкурентов, какое железо нужно на самом деле и где границы.

Qwen — семейство языковых моделей Alibaba; поколение Qwen 3.6 вышло в апреле 2026 года. Открытые веса опубликованы под Apache 2.0, самой свободной лицензией среди фронтир-моделей: встраивание в коммерческие продукты и перепродажа инференса разрешены без отчислений. Линейка из шести размеров закрывает всё от ноутбука до кластера: Qwen3.6-27B работает на одной RTX 4090, MoE-версия 35B-A3B с тремя млрд активных параметров даёт 73,4% на SWE-Bench, старшие веса доходят до 397B.

Apache 2.0

Лицензия открытых весов Qwen 3.6: встраивание в продукты и перепродажа инференса без ограничений · Alibaba, апрель 2026

6 размеров

Линейка от компактных моделей до 397B: один стек масштабируется от ноутбука до кластера · Qwen 3.6, 2026

1× RTX 4090

Qwen3.6-27B работает на одной видеокарте или Mac с 24 ГБ памяти: порог входа в локальный ИИ · обзоры Qwen 3.6, 2026

73,4%

SWE-Bench у Qwen3.6-35B-A3B: MoE с 3 млрд активных параметров решает инженерные задачи всерьёз · AI-Stat, 18.04.2026

Модельный ряд

Линейка Qwen 3.6: что под какое железо

Qwen3.6-27B (dense) Плотная модель на 27 млрд параметров. На агентных кодинг-бенчмарках обходит собственного 397B-предшественника. Работает на одной RTX 4090 или Mac с 24 ГБ unified memory.
Qwen3.6-35B-A3B (MoE) 35 млрд параметров всего, 3 млрд активных на токен: скорость маленькой модели, качество большой. Контекст 1 млн токенов, 73,4% SWE-Bench.
Старшие открытые Линейка тянется до 397B для тех, кому нужен максимум качества на своём железе. Все открытые веса под Apache 2.0.
Plus и Max-Preview Проприетарные флагманы только по API Alibaba Cloud: вариант, когда нужно самое сильное из экосистемы Qwen без своего железа.
Мультиязычность Сильнейшая сторона семейства: широкое покрытие языков, включая уверенный русский. Для мультиязычного саппорта и переводов часто выбор по умолчанию.

Показательный факт зрелости линейки: компактная 27B обходит на агентном кодинге собственного гиганта-предшественника на 397B. Плотная тренировка на правильных данных бьёт размер.

Практика

Где Qwen выигрывает у конкурентов

01

Локальный ИИ на рабочей станции

Qwen3.6-27B на одной RTX 4090: юрист, аналитик или конструктор получают ассистента, из которого ни один документ не уходит дальше системного блока. Порог входа: цена одной видеокарты.

02

ИИ внутри вашего продукта

Apache 2.0 разрешает встраивать модель в коммерческое ПО и перепродавать инференс. Для вендоров софта это юридически самый чистый путь добавить ИИ-функции без лицензионных отчислений.

03

Мультиязычный саппорт и переводы

Единая модель закрывает обращения на русском, английском, китайском и десятках других языков. Дешевле, чем связка «перевод + генерация», и без потери контекста между шагами.

04

Дообучение под домен

Открытые веса плюс свободная лицензия: модель дообучается на вашей терминологии и документах, а результат остаётся вашим активом, без обязательств перед вендором.

Российский контекст

Выводы для бизнеса в России

Что это даёт бизнесу в России

  • Apache 2.0 — самая свободная лицензия среди фронтир-моделей: юристы согласуют встраивание и коммерческое использование без спецусловий.
  • Масштабирование без смены стека: пилот на 27B на одной карте, прод на 35B-A3B на сервере, максимум на старших весах. Код и промпты переезжают без переписывания.
  • Русский язык у Qwen стабильнее большинства китайских конкурентов: для клиентских текстов правок меньше, хотя вычитку никто не отменял.

Что стоит понимать до внедрения

  • API Alibaba Cloud означает обработку данных в инфраструктуре КНР: для персональных и чувствительных данных используйте открытые веса в своём контуре.
  • Проприетарные Plus и Max-Preview недоступны для self-host: если задача требует именно их качества, вы снова в зависимости от чужого облака.
  • Сравнивайте на своих задачах: на коде Qwen 3.6 силён, но лидер открытых по общим бенчмаркам сейчас GLM-5.2, а по цене потока DeepSeek. Матрица выбора в нашем обзоре кластера.

Смежные разборы кластера: DeepSeek, GLM-5.2 и ZCode, агент Hermes.

Частые вопросы про Qwen

Что такое Qwen?
Семейство языковых моделей Alibaba. Поколение Qwen 3.6 вышло в апреле 2026 года: шесть размеров, открытые веса под Apache 2.0, мультимодальность и один из лучших среди открытых моделей русский язык. Старшие Plus и Max-Preview доступны только по API.
Можно ли использовать Qwen бесплатно в коммерческом продукте?
Да. Apache 2.0 разрешает коммерческое использование, встраивание в продукты, дообучение и перепродажу инференса без отчислений. Платите только за железо или за API, если выбираете облачный вариант.
Какое железо нужно для запуска Qwen локально?
Qwen3.6-27B работает на одной RTX 4090 или Mac с 24 ГБ unified memory. MoE-версия 35B-A3B с 3 млрд активных параметров ещё легче в инференсе при большем качестве. Старшие модели до 397B требуют серверные GPU.
Чем Qwen отличается от DeepSeek и GLM?
Коротко: Qwen выигрывает линейкой размеров, лицензией Apache 2.0 и мультиязычностью; DeepSeek — ценой инференса на потоке; GLM-5.2 — общими бенчмарками и связкой со средой ZCode. Зрелые команды не выбирают одну модель, а маршрутизируют задачи между ними.
Подходит ли Qwen под 152-ФЗ?
При развёртывании открытых весов в собственном контуре да: данные не покидают ваш периметр. Запросы через API Alibaba Cloud обрабатываются в КНР, для персональных данных этот путь не подходит.

Источники

На что опирается разбор

  • Alibaba / Qwen, апрель 2026: релиз линейки Qwen 3.6, открытые веса под Apache 2.0.
  • AI-Stat, 18.04.2026: Qwen3.6-35B-A3B — 3 млрд активных параметров, 73,4% SWE-Bench.
  • AI-Stat, 24.04.2026: Qwen3.6-27B обходит собственную 397B-модель на агентном кодинге.
  • tproger, 2026: открытые веса Qwen3.6-35B-A3B, контекст 1 млн токенов.
  • Обзоры локальных LLM, 2026: требования к железу для запуска 27B на RTX 4090 / Mac 24 ГБ.
  • Собственная практика BiometricLabs, 2026: выбор моделей под контур заказчика в проектах ИИ-агентов.

Примерить Qwen на ваш контур?

Бесплатная установочная встреча 60–90 минут: посчитаем железо, сравним с альтернативами на вашей задаче и честно скажем, нужен ли здесь вообще локальный ИИ.

Заявка на бесплатную встречу

Полминуты на заполнение. Ответим в течение рабочего дня и предложим слот.

Быстрее: @forensicsman

← На главную Все разборы