Alibaba представила новую флагманскую модель семейства Qwen. Она получила 2,4 трлн параметров, но благодаря архитектуре *Mixture-of-Experts* при одном запросе активирует только около 95 млрд.
На опубликованном сравнении Qwen3.8-Max показывает сильные результаты сразу в нескольких категориях:
— 93% в PaperBench — воспроизведение научных исследований;
— 86,6% в TerminalBench — работа с терминалом;
— 81,8% в LVBench — анализ длинных видео;
— 77,8% в MobileWorld — управление мобильными интерфейсами;
— 73,5% в FrontierSWE — сложные задачи программной инженерии;
— 69% в Vision2Web — создание сайтов по визуальному образцу;
— 53,4 балла в JobBench — выполнение рабочих задач за человека.
Особенно заметно Qwen3.8-Max выступает в задачах, где ИИ должен не просто ответить на вопрос, а самостоятельно выполнить последовательность действий: разобраться в документах, написать и проверить код, управлять интерфейсами или провести исследование.
Модель также работает с текстом, изображениями и видео, а её контекстное окно достигает 1 млн токенов. Это позволяет загружать большие документы, длинные записи и масштабные проекты целиком.
Alibaba обещает открыть веса Qwen3.8-Max. Правда, из-за размера модели запускать её локально смогут в основном крупные компании и исследовательские команды. Для большинства пользователей главным способом доступа останутся API и облачные сервисы.
Попробовать Qwen3.8-Max можно уже сейчас в Qwen Studio.
Похоже, Alibaba делает ставку уже не просто на «самую умную модель», а на ИИ, который умеет долго работать над задачей и доводить её до результата.