Я отдал ИИ-агентам почти весь продукт. Кроме одного куска - и в нём вся работа

Как я веду продукт с агентами: что делает каждый, что я не отдаю никому, и где это разваливается. Без красивых слов.

Недавно агент собрал рабочий прототип MERIDIAN за пару дней. Живая страница «где был, где я, куда» плюс карта мира, которую приложение само рисует из EXIF в фотках, прямо на телефоне, без единого ручного ввода. Expo, React Native, чёрная SVG-карта. То, на что год назад ушла бы неделя плотного фронтенда, было готово к скриншот-тесту в тот же день.

И вот что эта скорость сделала. Она не убрала риск - она его передвинула. Пока код был дорогим, главный вопрос звучал как «успеем ли собрать». Теперь собрать почти ничего не стоит, и остаётся один дорогой вопрос: а то ли я вообще строю. Весь риск переехал со «сделать» на «решить, что делать».

Поэтому я перестроил то, как веду продукт. Не вокруг того, кто пишет код - кода теперь сколько угодно. Вокруг того, кто решает, какой код вообще стоит писать. Я почти не пишу сам - раздаю задачи агентам, проверяю и режу. Дальше расскажу, как это собрано. Не «вот моя система, смотрите», а то, что можешь повторить у себя.

Что делают агенты, а что я не отдаю никому

Работа разбита на куски. На каждом - агент, который тащит объём, и кусок, который я не отдаю. Граница между ними и есть вся моя работа.

  1. Дискавери. Агенты прочёсывают рынок, конкурентов, разговоры юзеров, мой же архив заметок - вытаскивают то, что я физически не успею перечитать. Себе оставляю один вопрос: какому из этих паттернов я готов поверить, а какой просто красиво звучит.
  2. Гипотезы. Агент выдаёт двадцать вариантов фичи быстрее, чем я напишу один. Объём - его. Вкус - мой: какие две из двадцати вообще стоит трогать.
  3. Решение и приоритеты. Тут агент - спарринг, не судья. Раскладывает гипотезы по тому, что я реально знаю, спорит, ищет дыры. Финальный рез - кого в роадмеп, кого в мусорку - мой. Это необратимо, это не делегируешь.
  4. Сборка. Claude Code и агенты пишут код, дизайн, схемы. Я читаю их вывод так, как старший читает PR джуна: не «работает ли», а «не врёт ли оценка, не срезали ли угол, который выстрелит через месяц». Я пришёл в продукт из инженерии - начинал на JavaScript и React, потом тимлид и eng-менеджмент - и сейчас это рабочий инструмент: вижу враньё в коде, потому что сам его писал.
  5. Проверка. Отдельный агент атакует то, что собрал первый. Его задача - найти, где это разваливается. Про это ниже, это сердце всего.
  6. Оркестрация. Слой, который держит остальные пять: какой агент на какой задаче, в каком порядке, с каким контекстом. Это и есть Yan OS - надстройка над Claude Code: проекты, агенты, схемы, хуки, автозапуски, пяток MCP. Дирижёр один. Я.

Что я НЕ отдал агентам: решать, чему верить, финальный рез по роадмепу и проверку чужой работы на враньё. Всё остальное - объём, а объём теперь дёшев.

Как один агент ловит враньё другого

Агент, оставленный сам с собой, уверенно врёт. Сгенерит гипотезу, обоснует и подаст как факт - тем же тоном, каким подал бы правду. Поэтому тот, кто генерит, и тот, кто проверяет, у меня разные. И между ними простая сортировка. Каждое утверждение - моё, юзера или агента - падает в одну из трёх корзин:

Всё, что попало в «хочу», получает тест: подтвердить или убить. В сборку ничего не едет без метки - и моя собственная интуиция проверяется жёстче всего, потому что орёт громче всех.

Где это реально спасает. Агент предлагает фичу и пишет «юзеры хотят X». Второй лезет в источник и видит, что «хотят» - это один тред в одном чате. То есть «похоже», выданное за «знаю». Без второго агента это «хотят» проехало бы в роадмеп под видом данных. С ним - получает тест и ждёт. Стоит копейки, а ловит самый дорогой класс ошибок: уверенное враньё, которое выглядит как факт.

Что обнажила скорость на MERIDIAN

Вернусь к прототипу, в нём вся суть.

Перед MERIDIAN я убил предыдущую гипотезу - Nomad Bridge, двусторонний маркетплейс для номадов. Не выжил против моего же разбора: две стороны, нужны обе с первого дня, классический колд-старт, который убивает маркетплейсы, а единственный платящий спрос я нашёл по аналогии, а не по факту. Внутри этого мёртвого продукта сидела маленькая фича, которую я не принимал всерьёз - страница-профиль с картой стран, где ты был. Я выбросил её вместе со всем.

Потом месяц искал следующее. Около 350 идей, девять прогонов с агентами, и почти в каждом всплывал один и тот же мотив - та самая карта перемещений. Фича, которая уже лежала у меня в руках, а я её не видел.

Вот в чём фокус. Агент собрал прототип за дни - и именно эта скорость показала, что трудность была не в коде. Трудность была в том, что я месяц скорил 350 идей по табличке и чуть не упустил то, что лежало в кармане. Когда код стоил дорого, медленная сборка маскировала ошибку в голове - ты так долго строишь, что не успеваешь заметить, что строишь не то. Когда сборка стала быстрой, голой осталась одна настоящая работа: решить, что вообще стоит собирать.

Где это разваливается (без этого куска текст - реклама)

Теперь честно, иначе всё выше - просто красивая витрина.

Клиент этой системы - я сам. Один юзер, он же разработчик, он же тот, кому это надо. Значит, цифрами эффективность не доказана - доказано только, что мне так удобнее, а это самый слабый пруф из возможных. Yan OS не закончен и, честно, по своей природе закончен не будет никогда.

Дальше - агент любит свои же идеи. Второй агент, выросший из той же модели, склонен любить идеи первого чуть больше, чем стоило бы. Поэтому финальный нож держу я, а не второй агент: он снижает враньё, но не обнуляет.

Контекст стоит денег и внимания. Чтобы агент судил нормально, его надо накормить правильным контекстом, а собирать и держать его свежим - работа, которую обычно не считают, пока она тихо не съест весь выигрыш от скорости. Система, которая экономит часы на сборке, легко возвращает их через заднюю дверь на возне с контекстом.

И главное - меня нельзя заменить ровно там, где не с чем сверять. Агент блестящ, когда есть эталон для сравнения. Когда сверять не с чем, когда вопрос «то ли я строю» и рынок ещё молчит, - решает вкус, аппетит к риску и готовность тащить продукт годами. Это пока не отдаётся агенту. На этом всё и держится - подробнее писал тут: когда строить дёшево, работой становится суждение.

Что покупает команда, когда нанимает человека

Сложи всё вместе. Когда дизайн и код почти бесплатны, команда, нанимая продакта, перестаёт покупать пару рук под спеку. Рук теперь сколько угодно, и они дешевле любого найма.

Покупается ровно то, что я не отдал агентам: решать, чему верить, дисциплина убивать собственные гипотезы и нюх на враньё, которое звучит как факт. Не тот, кто пишет PRD быстрее. Тот, кто рулит агентами, которые пишут PRD, - и знает, какой из них вообще стоит строить.

Я собрал это один, с агентами - тем же способом, каким три года вёл Unicorn Embassy без единого рубля на рекламу. Сборка подешевела до нуля. Цена суждения - единственное, что выросло


Ян Неровный - AI-native Technical Product Lead и Head of Product. Фаундер Unicorn Embassy (180+ ивентов, 9 городов, 7 стран, ноль платного привлечения). Пишет о продукте, ИИ и эмиграции на nerovny.com. Telegram @nerovny_blog, Instagram @nerovny.

FAQ

Что в продуктовой работе можно отдать ИИ-агентам, а что нельзя?

Агентам отдаётся объём: дискавери по рынку и разговорам юзеров, генерация гипотез, сборка кода и дизайна, проверка чужой работы. Не отдаётся три вещи: решать, чему верить; финальный рез по роадмепу (он необратим); и проверка чужого вывода на враньё. Граница между объёмом и суждением - и есть работа продакта.

Как не дать ИИ-агенту выдать выдумку за факт?

Разделить того, кто генерит, и того, кто проверяет - это разные агенты. Плюс сортировка каждого утверждения в три корзины: «знаю» (есть данные), «похоже» (есть сигнал, нет доказательства), «хочу, чтоб так было» (хотелка). Всё из третьей корзины получает тест на подтвердить-или-убить и не едет в сборку без метки.

Что меняется в продукте, когда сборка становится почти бесплатной?

Риск переезжает со «сделать» на «решить, что делать». Пока код дорогой, медленная сборка маскирует ошибку в голове. Когда прототип собирается за пару дней, голой остаётся одна настоящая работа - выбрать, что вообще стоит собирать. Команда, нанимая продакта, покупает уже не пару рук под спеку.