Журнал сеньора вайбкодера уроки из опыта, заметки и инсайты

Личный публичный архив мыслей: оформленные как уроки наблюдения, рефлексия, идеи и недельные сводки.

RSS
← Назад к ленте

24 часа без меня

hero

Я давно хотел одного: написать дизайн-документ, запустить пайплайн, закрыть ноутбук и через сутки вернуться к готовому пулл-реквесту. Не «ассистент, который помогает писать код», а полноценная смена, работающая без меня.

После выхода Fable 5 и динамических воркфлоу в Claude Code стало казаться, что вот-вот. Но «вот-вот» и «работает» — разные вещи. Я собирал свой пайплайн несколько недель и набил шишки о реальные границы. Делюсь картой.

Пять уровней автономии

В Claude Code есть пять вложенных слоёв, которые последовательно убирают твоё участие. Каждый следующий снимает другую причину, по которой тебе нужно сидеть у экрана.

Auto mode — убирает промпты разрешений. Вместо того чтобы спрашивать «можно ли выполнить эту команду», классификатор сам решает, что безопасно. Деструктивные действия блокируются, рутинные проходят. Настраивается через описание инфраструктуры — буквально естественным языком: вот мои репозитории, вот мои домены, вот продакшен, туда не лезть.

/goal — убирает необходимость писать «продолжай». Задаёшь условие завершения, и после каждого хода маленькая быстрая модель проверяет: выполнено? Нет — Claude делает следующий ход сам, без тебя. Например: «все тесты из плана проходят, линтер чистый, покрытие не ниже восьмидесяти процентов». Цель крутится, пока условие не выполнится или ты не остановишь.

Динамические воркфлоу — убирают потерю нити. Это главное. Claude пишет JavaScript-скрипт оркестрации, который запускается рантаймом в фоне. Промежуточные результаты живут в переменных скрипта, а не в контексте модели. До шестнадцати агентов одновременно, до тысячи за запуск. Скрипт можно остановить, показать, отдиффать от предыдущего запуска, запустить заново.

Agent View — убирает необходимость сидеть у терминала. Фоновые сессии переживают закрытие окна, сон машины, авто-обновление. Открываешь claude agents — видишь, что сделалось, что ждёт твоего ввода, что упало. Можно отойти на час, вернуться, посмотреть и пойти дальше.

Routines — убирают необходимость держать машину включённой. Облачные сессии на инфраструктуре Anthropic, с триггерами по расписанию, по HTTP-запросу или по событиям GitHub. Но это пока research preview — об этом ниже.

Что у меня работает сейчас

Мой пайплайн выглядит так. Сначала я пишу дизайн-документ вместе с Fable 5 — самой мощной моделью в линейке, заточенной под длинные сессии. Она не торопится, проверяет себя сама, не теряет контекст. Anthropic прямо советует для неё: описывай результат, а не шаги. Дай ей неоднозначную проблему и не напоминай проверять работу — она сама проверит.

Потом я перевожу Fable в режим плана. Claude читает документ, разбивает задачу на части с критериями приёмки, работает в read-only — ничего не пишет, только собирает контекст и думает. Готовый план — это несколько страниц с конкретными шагами, файлами, тестами.

Дальше идёт главное. Я пишу ключевое слово ultracode и прошу реализовать план через воркфлоу. Claude не начинает кодить сам ход за ходом — он пишет скрипт, который разложит работу на параллельных агентов. Кодеры на Sonnet пишут, ревьюеры на Opus проверяют, и adversarial-фаза: одни агенты пытаются опровергнуть находки других. Финальный результат — то, что пережило перекрёстную проверку.

Параллельно я ставлю /goal: «все критерии приёмки из дизайн-документа выполнены, тесты зелёные, PR создан». Claude работает ход за ходом, пока условие не выполнится.

И вот момент истины. Я могу отойти. Agent View показывает прогресс, уведомления приходят, когда что-то требует моего внимания. Часа через два-три возвращаюсь — и действительно, есть PR с описанием, с тестами, с рабочим кодом.

Это работает. Но не сутки.

Где обрывается нить

Первая проблема — контекст. Fable 5 держит миллион токенов, и это много. Но даже миллион кончается на большом репозитории с длинной историей сессии. Quality degradation начинается после семидесяти процентов контекстного окна — чем дальше, тем сильнее галлюцинации. Claude Code показывает контекст через /context, и за ним надо следить. Компактация (/compact) помогает, но тоже теряет детали.

Вторая проблема — сессия привязана к процессу. Я закрыл терминал, перезагрузил машину, пропало электричество — сессия умерла. Agent View оживляет фоновые сессии через supervisor-процесс, и это правда работает: можно закрыть ноут, открыть через час, всё на месте. Но если процесс убит — всё, с нуля. --resume помогает, но только в той же директории, и /goal восстанавливается только если сессия была сохранена. Это не настоящая автономия — это автономия «пока горит свет».

Третья проблема — /loop, который крутит промпт по расписанию, живёт максимум семь дней. Потом автоматически истекает. Если забыл — просто остановилось. Для коротких задач норм, для суточного цикла — впритык.

Четвёртая, и главная для кошелька — стоимость. Воркфлоу с десятками агентов ест токены так, что хочется сесть. Claude Code показывает предупреждение о больших запусках — больше двадцати пяти агентов или больше полутора миллионов токенов. Предупреждение рекомендательное, лимит не ставит. Оставил на ночь без ограничения бюджета — можно проснуться от счёта.

Облако как обещание

Routines — это то, к чему всё идёт. Облачная сессия на инфраструктуре Anthropic, которая запускается по расписанию, по HTTP-запросу или по событию в GitHub. Ноутбук закрыт — рутина работает. Описывается один раз: промпт, репозитории, коннекторы, триггеры. Запускается автономно, без единого промпта разрешения.

Идея ровно та, что мне нужна: я засыпаю, рутина просыпается в три часа ночи, читает новые ишью, назначает лейблы, открывает PR с фиксом, пишет в Slack. Утром я вижу результат.

Но routines в research preview. API меняется, лимиты есть, поведение может сдвинуться. Для экспериментов — да. Для продакшена, на который я рассчитываю как на сотрудника — рано. Доверять «утро начинается с готового PR» системе в preview — слишком рано. Я пока не готов за это платить.

Честный итог

После нескольких недель настройки мой вывод такой. Десять-двенадцать часов автономии в одном процессе — реально. Пишешь дизайн-документ с Fable, загружаешь план, запускаешь воркфлоу, ставишь цель — уходишь ужинать, спать, гулять. Возвращаешься — есть результат, есть PR, есть тесты. Это уже меняет то, как я работаю: из «сидеть и направлять» — в «спроектировать и проверить».

Но «закрыть ноут и уехать на сутки» — пока нет. Сессия живёт, пока жив процесс. Routines закроют этот пробел, когда выйдут из preview. А пока — практическая автономия на часы, а не на сутки.

И это нормально. Разница между «Claude помогает мне писать код» и «я спроектировал работу, Claude сделал, я проверил» — огромна. Первый сценарий — умный автокомплит. Второй — делегирование. И мы уже во втором.

А третьего — когда можно уехать и не думать — пока только ждём.