Какие ИИ-модели реально стоит использовать: субъективный tier-лист¶
7.0/10
Тео (t3.gg) составляет субъективный tier-лист актуальных ИИ-моделей для разработчиков, оценивая их по качеству кода, скорости, цене и удобству в реальных рабочих процессах. В топ он ставит две модели — дорогую флагманскую (в расшифровке Fable 5) и более дешёвую 56 Soul, отмечая, что Soul даёт лучшую цену за деньги, а Fable пишет более аккуратный код, который легче мёржить. Среди остальных упоминаются Deep Seek V4 Flash как дешёвый и эффективный вариант, Composer 2.5 от Cursor (на базе Kimi K2.5), который он опускает в D-тир из-за отсутствия API, медленной базовой версии и дорогой быстрой, а также Grok 4.6, который кажется ему шагом назад по скорости относительно Grok 4.5. Автор признаёт, что tier-лист — не идеальный способ сравнения моделей, и обещает обновлять его раз в несколько месяцев. В конце он ждёт модель OpenAI Astra, надеясь, что она закроет разрыв с лидерами.
Контекст¶
Тео — разработчик и автор YouTube-канала, создатель T3 Chat и T3 Stack; в этом видео он даёт субъективный рейтинг (tier list) актуальных ИИ-моделей для разработчиков, актуальный, судя по аннотации, на конец августа 2026 года. Такой формат популярен в сообществе, но автор сразу оговаривает, что сравнение по уровням упрощает картину: у моделей много разных осей — скорость, стоимость за реальную задачу, доступность через API, поддержка vision и другие. Ключевой тезис видео, согласно аннотации, состоит в том, что сырая мощность модели перестала быть главным отличием; важнее эффективность использования токенов и реальная цена за выполненную задачу.
Влияние¶
Для разработчиков, выбирающих ИИ-ассистента, практический вывод: полная цена API за топовую модель не оправдана — выгоднее использовать подписку, а для большинства задач более дешёвая модель (56 Soul) даёт больше пользы за деньги.
Детали¶
В ролике Тео объясняет, что модели кажутся умнее в Claude Code и Codex именно потому, что эти инструменты дают доступ к интернету; при прямом обращении к API без веб-контекста модель ощущается заметно глупее. Он разбирает Composer 2.5: модель построена на Kimi K2.5, доступна только в Cursor и Grock, не отдаётся через API, базовая версия медленная, а быстрая стоит сравнимо с более дорогими конкурентами, поэтому он ставит её в конец D-тира. Grok 4.6 он считает даунгрейдом по сравнению с 4.5: модель тратит больше токенов, становится медленнее и теряет часть оркестрационных возможностей с субагентами. Главное сравнение — Fable и 56 Soul: Fable лучше понимает задачу и пишет код, который не страшно смотреть, но Soul заметно сильнее в iOS-разработке и даёт больше за подписку. Автор говорит, что тратит тысячи долларов в неделю на Fable, но только благодаря скидкам по подписке, и ждёт OpenAI Astra, надеясь, что она сможет писать хороший код и нормальные фронтенды.
Источники
- Which AI Models Are Worth Using - YouTube Theo - t3․gg - YouTube Which AI Models Are Worth Using|Theo - t3.gg — BigGo Finance Uploads from Theo - t3․gg - YouTube I ranked every relevant AI model. This is roughly where I'd ... 当前值得使用的AI模型大排名:我们逐个点评 | Theo - t3․gg_哔哩哔哩_... AI Model Tier List: Insights and Feelings from a Chat App ...
- Theo - t3․gg - YouTube