Перейти к содержанию

Qwen3.8-27B: даже низкий режим мышления обходит прошлые модели

7.0/10

В Reddit-обсуждении сравнительных бенчмарков новой открытой модели Qwen3.8-27B утверждается, что даже её низкий пресет мышления превосходит Qwen3.7 plus и Qwen3.6-27B в режиме рассуждений. Пользователи отмечают, что при детальном разборе Low часто оказывается выше Medium, а среднее число выходных токенов лишь примерно вдвое меньше, поэтому подписи уровней мышления могут быть ненадёжными без учёта длины текста рассуждений. В комментариях также просят добавить замеры с полностью отключёнными рассуждениями (reasoning off) и называют Qwen3.8-27B первой моделью, которая справляется с задачами на потребительском железе. Для llama.cpp опубликован исправленный чат-шаблон Moore2877/Qwen-Fixed-Chat-Templates-llamacpp, который перерабатывает инъекции рассуждений для каждого уровня и выделяет High в отдельный уровень. Данные основаны на сообществе и не подкреплены официальными источниками.

Контекст

Qwen3.8-27B — это новая открытая плотная мультимодальная модель от Alibaba из семейства Qwen 3.8, которую можно запускать локально: при 4-битном квантовании она помещается на GPU с 24 ГБ памяти или на Mac с 32 ГБ. Как и другие модели Qwen с «мышлением», она поддерживает несколько уровней рассуждений (thinking levels) — от выключенного до максимального, которые влияют на длину внутренних рассуждений и качество ответов. В обсуждении сравниваются результаты бенчмарков разных уровней мышления этой модели с предыдущими версиями Qwen3.7 и Qwen3.6-27B.

Влияние

Для локальных пользователей llama.cpp практический эффект — исправленный чат-шаблон Moore2877, который корректирует режимы рассуждений Qwen3.8-27B, тогда как заявление о пригодности для потребительского железа остаётся мнением сообщества.

Обсуждение

Сообщество в целом согласно, что Qwen3.8-27B оправдал ожидания, но сомневается в надёжности меток уровней мышления: Low часто обходит Medium, а разница в токенах невелика. Отдельные пользователи просят бенчмарки без рассуждений и указывают на необходимость доработанного чат-шаблона.

Источники