Перейти к содержанию

Тестирование уровней рассуждения Claude Fable 5.1 на задаче генерации и анимации SVG

5.0/10

Контекст

Саймон Уиллисон протестировал новую модель Claude Fable 5.1, генерируя SVG-рисунок пеликана на велосипеде при пяти разных уровнях рассуждений (reasoning effort). Эксперимент призван показать, как настройки глубины «мыслей» LLM влияют на визуальное качество кода, затраченное время и итоговую стоимость запроса.

Суть

На уровнях low и medium модель фактически пропустила этап рассуждений, выдав базовый SVG примерно за 10 центов и 23 секунды, а режим high добавил лишь короткий план композиции. Настройки xhigh и max кардинально изменили подход: режим max израсходовал 65 927 токенов ($3,30 и почти 14 минут работы), пошагово проектируя анатомию птицы, положение ног на педалях, элементы одежды и аксессуары вроде корзины с рыбой. Для последующей анимации автор перенаправил полученный векторный рисунок обратно в модель на уровне high, получив за $1,37 полноценный animated SVG с вращающимися колёсами.

Вывод

Увеличение лимита рассуждений в современных LLM напрямую трансформирует вычислительные затраты в высокую точность и пространственную проработку сгенерированного кода. Максимальные режимы мышления выходят за рамки простых текстовых ответов и превращают модель в инструмент для сложного генеративного дизайна, хотя и ценой заметного роста расходов.