Новая нейросеть Qwen 3.
Компания Alibaba представила новую языковую модель Qwen 3.8-Max, которая насчитывает 2,4 триллиона параметров при 95 миллиардах активных. Это самая мощная модель в семействе Qwen и первая в классе Max. Доступ к ней для широкой публики будет открыт на следующей неделе.
Модель показала впечатляющие результаты в автономном программировании, работе с документами и длительных исследовательских задачах, превзойдя конкурентов вроде Claude Fable 5 и GPT-5.6 Sol по ряду бенчмарков, включая PaperBench и OSWorld. Qwen 3.8-Max доступна через QwenCloud по API с поддержкой трёх уровней глубины рассуждений — от быстрого до сверхглубокого.
В тестах на автономное программирование модель Qwen 3.8-Max работала без остановки 16 дней, создав проект oh-my-cli с 265 коммитами и 127 pull-запросами. За пять дней она воспроизвела научную статью по отбору данных для обучения ИИ, написав 7600 строк кода и проведя 33 цикла обучения на GPU, после чего улучшила исходный метод на 2,7 балла на сложном математическом бенчмарке AIME24. В соревновании по распознаванию намерений в диалогах (WWW2025) модель за 24 часа обошла 458 из 526 человеческих команд, достигнув точности 85,3%.