Перейти к содержанию

Кодинг решён, инженерия — нет: разбор спора об ИИ-агентах

6.0/10

В видео Тео (t3.gg) защищает утверждение Бориса «Coding is solved. Bugs are not yet solved» от критики Мэтта PCO. Он объясняет, что «кодинг» — это написание кода, которое ИИ-агенты уже во многом решили, а «инженерия» — проверка, тестирование, ревью и доставка изменений — остаётся нерешённой и в основном человеческой задачей. Ключевой тезис: эффективность агентов упирается в то, насколько легко кодовая база поддаётся верификации; если человеку трудно поднять проект и проверить изменение, агенту это практически невозможно. В качестве примера Тео приводит десктопное приложение Claude Code: из-за сложности настройки QA-цикла с графическими VM оно улучшается медленнее, чем веб-версия. Вывод: компании, которые заранее делают код удобным для проверки и отката, получат от агентов наибольшую отдачу.

Контекст

Борис — создатель Claude Code, ИИ-агента Anthropic для написания кода; его твит был ответом на пост Питера с демонстрацией бага в десктопном приложении Claude Code. Мэтт PCO раскритиковал этот твит, и Тео разбирает, что оба используют одни и те же термины («coding», «engineering», «strategic coding») в разных смыслах, поэтому их позиции не так противоречивы, как кажется.

Влияние

Практический вывод для команд, внедряющих ИИ-агентов: главный рычаг повышения их эффективности — упрощение локального запуска, тестов, ревью и отката изменений, иначе агенты останутся полезными только для написания кода, а не для инженерной работы.

Подробнее

В начале видео Тео показывает конкретный баг: текст обновления в десктопном Claude Code обрезается, потому что это поле написала модель, которая читала код, но не проверила, как оно отображается. Он утверждает, что для QA десктопного Claude Code нужна отдельная графическая VM с полноценной ОС на каждый поток, а модели Claude заметно хуже в computer use, чем модели других компаний, поэтому качественного цикла верификации не получается. Веб-версию тестировать проще: на одной машине можно открыть восемь вкладок с разными dev-сборками, тогда как восемь инстансов Electron-приложения на одном компьютере «не взлетят». Тео разбирает разделение на тактическое и стратегическое программирование: Мэтт согласен, что стратегические конвейеры (баг-репорт → воспроизведение → фикс, фича-реквест → прототип, RFC → рефакторинг) автоматизируются, но управление ими остаётся за человеком. В T3 Code пока не автоматизируют исправления по твитам, хотя Anthropic и часть клиентов уже переходят к автоматической поддержке приложений.