Перейти к содержанию

Предварительная карточка модели Qwen3.8-27B уже доступна

7.0/10

На Hugging Face опубликована предварительная карточка модели Qwen3.8-27B, в которой есть разделы Highlights, Model Overview, Quickstart, Best Practices и Citation. Согласно карточке, модель поддерживает нативный контекст длиной 262 144 токена с расширением до 1 000 000 токенов и имеет возможность обработки изображений (vision). Бенчмарки пока не опубликованы, их ожидают примерно через 5,5 часов. Это важная новость для сообщества, поскольку позволяет заранее оценить характеристики модели, но окончательные выводы о производительности делать рано.

Контекст

Qwen — семейство больших языковых моделей, разрабатываемое Alibaba. Модель Qwen3.8-27B, судя по названию, имеет 27 миллиардов параметров и, вероятно, относится к линейке Qwen3, куда входят и более крупные модели, включая версию с 2,4 триллиона параметров. Предварительная карточка публикуется до финального релиза и до появления официальных бенчмарков.

Влияние

Разработчики и исследователи уже могут ознакомиться с архитектурными особенностями Qwen3.8-27B, включая большой контекст и поддержку vision, что позволяет планировать эксперименты, однако до публикации бенчмарков реальные возможности модели остаются непроверенными.

Обсуждение в сообществе

Комментаторы отмечают, что «reasoning effort» становится новой важной темой, и удивляются, что 27B-модель имеет vision, тогда как 2.4T-модель его лишена. Пользователи положительно оценили нативный контекст на 262 144 токена, а также выразили надежду на применение QAT, как в Gemma 4 31B; было и ироничное замечание, что «этот день тоже пройдёт».