Перейти к содержанию

Qwen 3.8 27B: отличная локальная модель, но по умолчанию переусердствует в рассуждениях

8.0/10

Обзор Саймона Уиллисона отмечает, что открытая модель Qwen 3.8 27B впечатляюще работает на потребительском железе — файл занимает около 17 ГБ, — но по умолчанию склонна к «передумыванию»: избыточным цепочкам рассуждений. Эта особенность связана с RL-стимулами современных моделей, которые поощряют проверку собственной работы и отказ от преждевременной остановки. Сообщество уже предлагает обходные пути: форки llama.cpp с инъекцией управляющего текста на порогах рассуждения, флаг reasoning effort и патчи шаблона для сохранения KV-кэша. Практический интерес высок, поскольку локальные модели приближаются к уровню проприетарных моделей годичной давности.

Контекст

Qwen 3.8 27B — это новая открытая модель с 27 миллиардами параметров из семейства Qwen, которую можно запускать локально на потребительском оборудовании; её обзор опубликовал Саймон Уиллисон 16 августа 2026 года. Современные модели-«рассуждатели» обучаются с подкреплением выполнять задачу, проверять свою работу и не останавливаться преждевременно, что отлично работает для бенчмарков, но порождает склонность к избыточным внутренним рассуждениям. В сообществе это уже привело к появлению экспериментальных форков llama.cpp, которые пытаются ограничивать или направлять процесс рассуждения модели.

Влияние

Для пользователей локальных LLM на обычных ПК Qwen 3.8 27B даёт рассуждения уровня недавних топовых моделей, но требует ручного контроля режима рассуждений, чтобы избежать лишних токенов и задержек.

Обсуждение в сообществе

В комментариях сходятся, что избыточные рассуждения — общий эффект RL-обучения современных моделей, а не уникальная проблема Qwen: модель поощряют проверять себя и не останавливаться преждевременно. Пользователи делятся практическими обходными путями: форки llama.cpp с инъекцией управляющего текста на порогах рассуждения, флаг reasoning effort (в том числе настройка на сообщение) и патчи для сохранения KV-кэша; при этом один комментатор не заметил эффекта от опции none.

Источники

Покрытие источниками

Проверяются выбранные ключевые утверждения, а не истинность всей статьи целиком.

  1. Частный опыт или мнение; проверено только авторство

    Qwen 3.8 27B: отличная локальная модель, но по умолчанию переусердствует в рассуждениях