Перейти к содержанию

Qwen 3.8 против 3.6: проблема овер-инжиниринга и смены стиля кода

5.0/10

Разработчик на Reddit поделился опытом применения модели Qwen 3.8 в ежедневной работе, отметив, что она склонна к избыточному усложнению кода и игнорированию стиля существующего проекта. Вместо точечного редактирования на две строки модель часто генерирует масштабные изменения до 100 строк с лишними проверками типов, обработкой ошибок и возвратом сложных структур метаданных вместо простых логических значений. В отличие от версии 3.8, модель Qwen 3.6 лучше справляется с небольшими задачами за один запрос, точно сохраняя исходные наименования и архитектуру кодовой базы. В результате автор рассматривает возможность возврата к 3.6, так как овер-инжиниринг в 3.8 усложняет проверку пулл-реквестов и совместную разработку.

Контекст

Серия открытых языковых моделей Qwen активно применяется разработчиками для локального развертывания и генерации кода. В версиях с поддержкой режимов рассуждения (reasoning), таких как Qwen 3.8, модель выстраивает расширенные цепочки мыслей перед формированием ответа. Такой подход улучшает показатели в бенчмарках, но может негативно влиять на точное следование лаконичным инструкциям при выполнении небольших правок.

Влияние на разработку

Разработчикам, использующим LLM для точечного рефакторинга, стоит учитывать, что усиленный режим рассуждений в новых версиях моделей может снижать точность следования стилю кодовой базы.

Обсуждение в сообществе

Участники сообщества подтвердили проблему, отметив, что высокий уровень рассуждений (thinking) в Qwen 3.8 может негативно влиять на точное выполнение инструкций ради оптимизации бенчмарков. Также пользователи подчеркнули необходимость корректной подборки параметров конфигурации и квантования, так как настройки для версий 3.6 и 3.8 не совпадают.

Источники

Покрытие источниками

Проверяются выбранные ключевые утверждения, а не истинность всей статьи целиком.

  1. Частный опыт или мнение; проверено только авторство

    Qwen 3.8 против 3.6: проблема овер-инжиниринга и смены стиля кода

  2. Недостаточное покрытие источниками

    Разработчик на Reddit поделился опытом применения модели Qwen 3.8 в ежедневной работе, отметив, что она склонна к избыточному усложнению кода и игнорированию стиля существующего проекта.

  3. Не подходит для фактологической проверки

    В отличие от версии 3.8, модель Qwen 3.6 лучше справляется с небольшими задачами за один запрос, точно сохраняя исходные наименования и архитектуру кодовой базы.