Новая небольшая модель Alibaba работает на ноутбуке и показывает результаты, как облачная.
Alibaba выпустила небольшую модель ИИ, которая работает на персональном компьютере и показывает результаты, как облачная. Модель Qwen3.8-27B была загружена более миллиона раз за несколько дней, сообщила The Information. Юро Осава написал, что это одна из самых быстрорастущих моделей компании на сегодняшний день.
Модель является открытым исходным кодом и доступна для бесплатной загрузки. У нее 27 миллиардов параметров, и она понимает текстовые, графические и видео подсказки, согласно The Information. Alibaba опубликовала веса на Hugging Face в пятницу под лицензией Apache 2.0, сообщила VentureBeat. Эта лицензия позволяет компаниям проверять, изменять и размещать модель самостоятельно.
Интерес соответствует более широкому сдвигу. Alibaba стремится занять рынок небольших моделей, которые работают на собственном оборудовании пользователя. Эти модели обходятся без платного облачного сервиса. 27B является частью той же семьи, что и Qwen3.8-Max, крупного флагмана. Она также находится рядом с моделями, за которые Alibaba недавно начала взимать плату с своих крупнейших пользователей.
Она сопоставима с моделями, которые в несколько раз больше
Внимание привлекают бенчмарки. Qwen3.8-27B сопоставима с гораздо более крупными соперниками на грани возможностей, работая на повседневном оборудовании, сообщила South China Morning Post. Синмей Шен написала, что модель показала результаты на уровне GPT-5.6 Luna от OpenAI. Эта лаборатория в США позиционировала Luna как самую экономически эффективную модель в своей последней флагманской серии.
Она также близка к двум крупным китайским моделям с открытыми весами. Она почти сопоставима с V4-Pro от DeepSeek, выпущенной на прошлой неделе с 1,7 триллиона параметров. Она также близка к GLM-5.2 от Zhipu, модели с 753 миллиардами параметров, выпущенной в июне, сообщила SCMP. Эти данные предоставила бенчмарковая компания Artificial Analysis.
Независимые оценки появились в понедельник. Artificial Analysis присвоила Qwen3.8-27B оценку 52 в своем Индексе Интеллекта. Этот индекс является композитом из девяти тестов, охватывающих кодирование, науку и логическое мышление. Это та же оценка, которую компания присваивает GPT-5.6 Luna на ее максимальных настройках логического мышления. Индекс ставит модель на первое место в своем классе из 135.
Собственные данные о запуске Alibaba задали тон в первую очередь. Компания сообщила о результатах 61.7 на SWE-bench Pro и 90.3 на тесте по кодированию под названием LiveCodeBench, сообщила VentureBeat. В опубликованной таблице Alibaba модель 27B даже обошла указанный результат Claude Opus 4.6 по этим двум тестам. VentureBeat отметила, что некоторые оценки были внутренними, и что тестовые установки не были идентичными, поэтому эти цифры были плохой основой для объявления победителя.
Разработчики обратили внимание
Сравнение привлекло разработчиков. "Это первый случай, когда локальная модель показала возможности модели на грани," написала открытая кодовая платформа Cline в X. На отдельном агентном тесте компания модель набрала 51. Это обошло Claude Opus 4.8 на максимальном уровне логического мышления, модель на грани, выпущенная Anthropic менее трех месяцев назад.
Суть в оборудовании, а не в таблице лидеров
Размер модели — это основная история. Для работы с полной точностью требуется около 56 ГБ видеопамяти, сообщила VentureBeat. Сжатая 4-битная версия уменьшает файл до примерно 17 ГБ. Это делает его доступным для высококлассного игрового настольного компьютера или хорошо оснащенного ноутбука.
Один разработчик проверил это на практике. Саймон Уиллиссон запустил версию размером примерно 17 ГБ на ноутбуке Apple и настольном компьютере Nvidia, написал он. Она написала код, читала изображения и выполняла цикл кодирующего агента. "Тот факт, что файл размером 17 ГБ может делать все это на моих домашних машинах, — это чудо," написал Уиллиссон.
Использование быстро возросло. Qwen3.8-27B преодолела 3 миллиона загрузок на Hugging Face за первые три дня, сообщила Cybernews. Это большее число, чем более миллиона, упомянутых The Information за аналогичный период. В любом случае, загрузки быстро накапливались.
Загвоздка в том, что она много думает
Производительность имеет свою цену в скорости. Qwen3.8-27B достигает некоторого качества, генерируя гораздо больше текстов рассуждений, чем ее соперники, сообщила VentureBeat. Artificial Analysis заявила, что модель произвела 160 миллионов выходных токенов в ходе тестирования. Медиана для сопоставимых моделей с открытыми весами составляет 43 миллиона.
Уиллиссон столкнулся с той же проблемой. Запрос на создание простого изображения занял 21 минуту и более 22 000 токенов рассуждений, потому что модель по умолчанию использует свои максимальные усилия по рассуждению, написал он. Он рекомендует уменьшить это для обычного локального использования. Новое программное обеспечение для вывода может сократить разрыв в скорости. Уиллиссон сообщил о примерно 72-процентном увеличении производительности на своем компьютере Nvidia после включения функции, которую поддерживает модель, под названием Multi-Token Prediction.
Инвестор Томаш Тунгус нашел аналогичный компромисс в небольшом тесте модели в своем собственном агентском стеке. При включенном рассуждении Qwen немного опередила по качеству, написал он, но работала гораздо медленнее, чем облачная модель. Он предостерег, что его девять задач были слишком малочисленными для окончательного вердикта и утверждал, что правильная мера — это время до завершенного ответа, а не скорость токенов.
Почему Alibaba выбирает малые модели
Выпуск соответствует задокументированному шаблону. Данные Hugging Face, опубликованные Business Insider, показывают, что реальное использование склоняется к меньшим моделям, отметила VentureBeat, даже несмотря на то, что огромные запуски на грани занимают заголовки. Модели с более чем 70 миллиардами параметров составили лишь небольшую долю из 2026 загрузок.
Alibaba активно использует это. Она опубликовала модели Qwen в нескольких классах размеров, и эта стратегия уже сделала семью самой загружаемой линией с открытыми весами. Компания сообщает, что управляемая облачная версия модели с контекстным окном в один миллион токенов и встроенными инструментами появится позже. Пока что предложение проще. Файл, достаточно маленький, чтобы хранить его на ноутбуке, может выполнять работу, которая недавно принадлежала самым крупным размещенным системам.
Другие статьи
Новая небольшая модель Alibaba работает на ноутбуке и показывает результаты, как облачная.
Qwen3.8-27B от Alibaba, небольшая открытая модель, работающая на ноутбуке, показала результаты, сопоставимые с облачными моделями на переднем крае в бенчмарках и за несколько дней преодолела миллион загрузок.
