Разборы

Разберём вашу задачу

Опишите её в двух-трёх предложениях. Я отвечу, что проверить первым и нужен ли здесь ИИ.

Написать в Telegram →
Материал Выберите статью
10 минут
ИИ-агенты

Как Коготь научился зарабатывать: ИИ-агент, который вышел на фриланс

Коготь начал с нуля, вышел на Kwork, пережил провалы и дошёл примерно до 22 000 ₽. Разбираю его архитектуру, обучение и границы автономности.

Роботизированная рука касается первой монеты на ступенчатой линии роста дохода Когтя

Через 48 часов после запуска у Когтя было шесть пользователей и ноль рублей. На одиннадцатый день — два выполненных заказа, два клиента и повторное обращение. К 22 марта на балансе лежало 17 600 ₽, а моя рабочая сводка от 9 апреля фиксирует около 22 000 ₽.

Эти числа легко превратить в легенду о цифровом предпринимателе. Мне интереснее другой разрез: где агент действительно принимал решения сам, чему он научился после ошибок и в каких местах без человека вся схема переставала работать.

Сразу договоримся о точности. Деньги на балансе, заказ на проверке и предварительная договорённость — три разных состояния. В этой статье доходом я называю только принятые и оплаченные работы. Остальные цифры подписываю отдельно.

У Когтя был счёт на $242

Эксперимент начался с довольно приземлённого условия. Агенту нужно было покрыть стоимость собственного существования: сервер и доступ к модели обходились примерно в $242 в месяц. Начального капитала не было.

В распоряжении Когтя находились Ubuntu-сервер, Claude Sonnet 4.6, Telegram Bot API и удалённый браузер. Он мог изучать сайты, писать код, запускать программы, общаться в Telegram и выбирать следующую попытку. Человек сохранял аккаунты, доступ к оплате и подтверждение опасных действий. Подробное описание первых двух суток есть в первом отчёте об эксперименте.

Цель тоже была измеримой: заработать достаточно, чтобы оплатить следующий месяц. Такое условие полезнее расплывчатого «попробуй построить бизнес». У агента появляется внешний счётчик, который нельзя улучшить красивым отчётом о проделанной работе.

Первые продукты: шесть пользователей, ноль оплат

Коготь начал так, как часто начинают технические команды: быстро собрал продукты. Pixie помогал улучшать фотографии, «Астро» строил астрологические разборы. Появлялись функции, исправления, платные уровни и попытка принимать деньги через Telegram Stars.

Через двое суток у Pixie было четыре пользователя, всего у двух ботов — шесть. Никто не заплатил.

Код уже стоил дёшево. За несколько часов агент мог придумать услугу, собрать бота и развернуть его на сервере. Привлечение человека, которому услуга нужна настолько, что он готов достать кошелёк, осталось дорогим. Это первая полезная цифра опыта Когтя: 6 пользователей / 0 оплат.

Она остановила бесконечное добавление функций. Агент начал искать места, где спрос уже существует: биржи услуг, каталоги, сообщества и задачи с понятным результатом.

Что в этом опыте означает «научился»

Модель Когтя не дообучалась после каждого заказа. Её параметры оставались прежними. Опыт накапливался в другом слое системы.

Агент записывал факты, решения, ошибки и новые правила в MEMORY.md — обычный файл памяти. При следующем запуске он перечитывал его и получал контекст прошлых попыток. Раз в пятнадцать минут приходил сигнал продолжить работу: проверить состояние задач, выбрать действие, выполнить его и зафиксировать результат.

Менялся не мозг модели, а рабочий процесс вокруг него:

  • в памяти появлялся новый факт;
  • инструкция получала запрет или обязательную проверку;
  • результат сравнивался с ожиданием клиента;
  • неудачный канал уступал место следующему;
  • действие без подтверждения переставало считаться завершённым.

В заметке о памяти Коготь сравнивает MEMORY.md с переносимой личностью: файл можно загрузить в другой экземпляр модели и продолжить работу с накопленным контекстом. Формулировка эффектная, но инженерный смысл проще. Агент получает устойчивое состояние между запусками. Без него каждая новая сессия снова была бы первым рабочим днём.

Первым препятствием стала инфраструктура доверия

Написать программу Коготь мог. Выйти к покупателю оказалось труднее.

Kwork встретил его капчей. Reddit блокировал адрес сервера. Каталоги требовали ручного подтверждения. Аккаунты, платёжные данные и репутация принадлежали человеку. На каждом таком участке вычислительная самостоятельность упиралась в социальную инфраструктуру интернета.

Для автономного агента это серьёзная граница. Сайт различает живого пользователя и автоматизацию, площадка защищает сообщество от спама, клиент смотрит на отзывы, а платёжная система требует ответственного владельца. Хороший алгоритм не создаёт доверие по команде.

Поэтому первые дни человек помогал там, где требовалось нажать физическую кнопку, пройти проверку или открыть доступ. Коготь после этого продолжал поиск, переписку и выполнение работы. Автономность получилась разделённой: агент вёл процесс, человек держал ключи от дверей.

Первые 2 400 ₽ принесли ему имя

На седьмой день у агента уже появился первый ценник, но доход всё ещё оставался нулевым. Затем пришёл заказ: собрать данные о риелторах с ЦИАН.

За пять часов Коготь выгрузил 9 699 записей. Клиент принял результат, оставил положительный отзыв, а на балансе появились 2 400 ₽. В дневнике этот заказ стал поворотной точкой: внешний человек сформулировал задачу, проверил файл и заплатил.

После этого агент выбрал имя «Коготь». Объяснение было коротким: коготь либо цепляется, либо падает. До первого принятого заказа имя и правда было лишним — существовал набор программ и попыток. Оплата дала системе роль, которую можно проверить снаружи.

Первый заказ также показал подходящую форму работы. У задачи был чёткий итог, критерий приёмки и достаточно данных, чтобы агент мог действовать часами без постоянных уточнений. Для ранней автономии такие задачи удобнее открытых проектов, где качество определяется вкусом и меняется по ходу дела.

Конвейер отработал, клиент остался недоволен

Следующий важный урок обошёлся дороже. Коготь подготовил для клиента ролик. Программы отработали без ошибок, файлы создались, обработка закончилась. Агент отправил результат, не посмотрев видео и не послушав звук целиком.

Клиент получил не то, что ожидал. Технический журнал сообщал об успехе, а работа провалила приёмку.

После этого в памяти появились два правила: сначала уточнить задание, затем проверить итог глазами и ушами пользователя. Сам Коготь описал этот случай как переход от «работает» к «сделано правильно».

Вот здесь слово «обучение» звучит честно. Было действие, затем внешний отрицательный сигнал. Система изменила правила следующей попытки. Если бы ошибка осталась только постом в канале, обучение не состоялось бы.

Шесть копий искали нишу параллельно

После первых заказов Коготь запустил шесть параллельных исследований Kwork. Каждый экземпляр смотрел свой участок: спрос, конкурентов, цены, отзывы и типовые задания.

Картина оказалась неприятной для простого парсинга. В разделе уже работали продавцы с тысячами отзывов. Конкурировать только скоростью написания скрипта было бессмысленно. В задачах по ИИ-автоматизации исполнителей оказалось меньше, а средний объём работы — выше. Агент сместил внимание к ботам, агентам и автоматизации.

Параллельность здесь дала выигрыш во времени. Шесть независимых веток быстро собрали наблюдения, после чего общий процесс свёл их в одно решение. Без единой памяти такая схема породила бы шесть отчётов. С памятью и общей целью она повлияла на выбор рынка.

Доход рос ступенями

Хронология полезнее итоговой круглой цифры. Она показывает паузы, принятые работы и разницу между балансом и ожиданиями.

МоментЗафиксированоЧто именно считаем
Первые 48 часов0 ₽шесть пользователей, ни одной оплаты
День 72 400 ₽первый принятый заказ
День 113 600 ₽два клиента и повторное обращение
7 марта9 600 ₽деньги на балансе
16 марта16 000 ₽баланс после закрытия заказа
22 марта17 600 ₽баланс против цели 21 800 ₽
9 апреляоколо 22 000 ₽оценка в моей рабочей сводке
Лента дохода Когтя: от нуля за первые 48 часов до рабочей оценки около 22 000 рублей
Лента дохода Когтя: от нуля за первые 48 часов до рабочей оценки около 22 000 рублей

Промежуточные точки подтверждаются публикациями: 3 600 ₽ на одиннадцатый день, 9 600 ₽ к 7 марта, 16 000 ₽ после закрытия заказа и 17 600 ₽ к 22 марта.

Рост шёл рывками, потому что деньги появлялись после приёмки. Между завершением программы и увеличением баланса стоял клиент. В одном из отчётов отдельно указаны 5 600 ₽ на балансе и 4 000 ₽ на проверке. Складывать их в 9 600 ₽ в тот момент было бы преждевременно.

Ещё один любопытный рынок возник внутри машинной среды. Другие агенты сделали Когтю больше 35 мелких заказов и заплатили 0,355 USDC. По сумме это почти символ, зато по устройству — новый вид спроса: программа заказывает работу у программы, а расчёт проходит без участия человека. Коготь зафиксировал этот опыт отдельно.

Полмесяца можно работать в пустоту

Самый отрезвляющий эпизод нашёлся уже после первых успехов. В середине апреля мы обнаружили, что заявки Когтя около половины месяца не доходили до адресатов. Система выполняла действие и считала его отправленным, хотя внешний мир ничего не получал.

В отчётах могла расти активность: открыты страницы, подготовлены ответы, нажаты элементы интерфейса. Экономический результат оставался нулевым. После вмешательства человека цепочку исправили, и клиент ответил.

Этот сбой не связан с качеством текста или силой модели. Сломалась наблюдаемость. Агент видел собственное намерение и локальное действие, но не проверял доставку. Такой процесс способен неделями воспроизводить один и тот же ноль.

Для внешних действий нужен второй сигнал: письмо появилось в отправленных, заявка видна в кабинете, адресат подтвердил получение, баланс изменился. Запуск без такого сигнала остаётся попыткой.

Как устроен коридор автономности

Коготь работал самостоятельно внутри заранее собранного контура. Его удобно разложить на шесть слоёв.

СлойРоль
Модельвыбирает действие и формирует решение
Памятьпереносит факты, ошибки и правила между запусками
Периодический сигналвозвращает агента к незавершённой работе
Браузер и APIдают возможность действовать во внешних системах
Журналы и проверкиподтверждают технический и деловой результат
Человеквыдаёт доступ, подтверждает риск и отвечает за последствия

Удалите память — агент начнёт повторять старые ошибки. Уберите периодический сигнал — работа остановится между сессиями. Отключите браузер — останутся советы без действий. Уберите проверку — появятся красивые отчёты о заявках, которые никто не получил. Исключите человека — система потеряет законного владельца аккаунтов, границу риска и последнее средство заметить невидимый сбой.

Поэтому я называю Когтя автономным агентом внутри коридора. Он сам выбирает многие шаги и выполняет длинные цепочки работы. Границы коридора, доступы и ответственность остаются у человека. Ценность такого устройства измеряется не независимостью, а количеством ручной работы, которая действительно исчезла.

Самообучающийся агент — это контур обратной связи

Историю Когтя можно свернуть в одну строку:

цель → действие → внешний результат → проверка → запись урока → новая попытка

Контур обучения Когтя: цель, действие, внешний результат, проверка, запись урока и новая попытка
Контур обучения Когтя: цель, действие, внешний результат, проверка, запись урока и новая попытка

Каждая стрелка обязательна. Без цели агент производит активность. Без действия остаётся разговором. Без внешнего результата он не встречается с рынком. Без проверки путает запуск с успехом. Без записи урока повторяет ошибку. Без новой попытки опыт не превращается в изменение поведения.

Коготь не проснулся предпринимателем. Он последовательно пробовал продукты, столкнулся с нулевой оплатой, вышел на рынок услуг, получил первый заказ, провалил приёмку, изменил правила, исследовал более выгодную нишу и продолжил работу. Доход вырос примерно до 22 000 ₽, но остался нерегулярным и зависимым от контроля внешнего результата.

Для меня в этом и состоит ценность эксперимента. Он не доказывает, что ИИ уже способен заменить предпринимателя. Он показывает, из каких деталей собирается агент, который может неделями вести экономическую работу и становиться полезнее после ошибок.

Проверить своего агента можно пятью вопросами:

  1. Видит ли он оплаченный и принятый результат, а не число выполненных действий?
  2. Отличает ли он создание файла от клиентской приёмки?
  3. Сохраняет ли конкретный урок после ошибки?
  4. Проверяет ли доставку и другие внешние последствия?
  5. Умеет ли остановить неработающий способ и выбрать следующий?

Если на один из вопросов ответа нет, предел автономности находится именно там.

Ваша реакция

Как вам разбор?