ИИ-агенты без кода. Как собрать помощника под свою задачу

- -
- 100%
- +

ИИ-агенты без кода
Как собрать помощника под свою задачу
Савелий Орлов
Серия «Нейросети на практике»
Введение. Вы делаете это в пятый раз
Понедельник, девять утра. Вы открываете чат и вставляете в него запрос, который сохранён у вас в заметках.
Он хороший, этот запрос. Вы его отлаживали, в нём есть роль, контекст, формат и ограничения. Он работает.
Дальше вы копируете данные из формы. Вставляете. Получаете результат. Копируете его в таблицу. Открываете почту, берёте оттуда три письма, вставляете следующий запрос. Правите, что получилось. Отправляете.
Двадцать минут.
В среду вы делаете это снова, в пятницу снова — заявки копятся не только к понедельнику. И в следующий понедельник всё заново.
Проблема уже не в том, что вы не умеете формулировать задачу — умеете, у вас целая библиотека таких запросов. Проблема в том, что между запросами есть вы: копируете, вставляете, переносите из окна в окно и не забываете запустить в нужный день.
Всё это можно записать один раз и больше не делать.
Что такое агент, в одном предложении
Без терминов, без английских слов, без разговоров об автономных системах:
Агент — это записанная последовательность шагов, в которой один-два шага делает модель.
Взять данные оттуда. Разобрать их. Положить сюда. Сообщить вам. Записанное один раз и выполняющееся само.
Механических шагов — взять, переложить, отправить — окажется в несколько раз больше, чем умных. И это хорошая новость: значит, учиться нужно не работе с искусственным интеллектом, а тому, как разложить свою работу на шаги.
Такое разложение — обычный человеческий навык, и он полезен далеко за пределами этой книги.
Обещание
Одно, узкое и проверяемое:
Один работающий агент под вашу задачу, собранный вами, без единой строки кода.
Не «армия помощников». Не «бизнес на автопилоте». Не «ИИ-сотрудник, который работает круглосуточно». Один агент, который делает то, что вы делаете руками в пятый раз.
Когда он заработает, вы соберёте второго за вечер — потому что весь трудный путь пройден на первом.
Важное предупреждение про эту книгу
Книга состоит из трёх частей, и они устаревают с разной скоростью. Скажу об этом сразу, чтобы вы понимали, чему доверять через год.
Часть первая — как думать про агентов. Что это такое, какие задачи годятся, как разложить задачу на шаги, где всё ломается, сколько стоит. Здесь нет ни одного названия сервиса и ни одного описания интерфейса. Эта часть не устареет: она про способ мышления, а он от версий не зависит.
Часть вторая — как собрать. Пошаговая сборка на конкретном инструменте. Вот эта часть привязана ко времени. Конструкторы меняют интерфейсы, тарифы и названия кнопок каждые несколько месяцев.
Я старался описывать логику действия, а не расположение кнопок, — так текст живёт дольше. Но если вы читаете это через год-полтора и видите на экране не то, что описано, — верьте экрану, а не книге. Логика останется той же, названия поменяются.
Часть третья — каталог сценариев. Двадцать готовых агентов под конкретные задачи. Устаревает медленно: задачи людей меняются гораздо реже, чем интерфейсы.
Как проверить актуальность, если сомневаетесь: откройте раздел помощи того сервиса, который выберете, и сверьте названия основных действий. Пять минут.
Кому эта книга не подойдёт
Тем, кто ещё не пользуется нейросетями регулярно. Агент автоматизирует то, что вы уже умеете делать руками. Если вы пока не составляете запросы и не знаете, чего от модели ждать, начинать с агентов рано — сначала книга «Нейросети для работы», там разобрана механика, на которую здесь всё опирается.
Тем, кто ищет готовое решение под ключ. Здесь про то, как собрать самому. Если задача сложная и денег больше, чем времени, дешевле заказать.
Программистам. Вам будет скучно: всё, что здесь описано, вы сделаете кодом быстрее и гибче.
Чего в книге нет
Обещаний автономности. Каждый раз, когда речь зайдёт о том, что агент работает без вас, рядом будет оговорка про контроль. Агент без присмотра ломается молча — это его нормальное поведение.
Историй про сокращённые отделы. Не знаю таких и не буду выдумывать.
Прогнозов. Что будет с агентами через пять лет — не знаю.
Обещаний, что это просто. Первый агент займёт у вас вечер или два, и на середине вы один раз захотите всё бросить. Это нормальный ход событий, а не признак того, что у вас не получается.
Как читать
Часть первую — целиком и подряд, до того как что-либо открывать. Пять глав, около двух часов. Половина неудачных агентов проваливается ещё до сборки, и все причины разобраны там.
Особенно третья глава: раскладка задачи на шаги — навык, который решает всё остальное.
Часть вторую — с ноутбуком. Читать её без экрана бессмысленно, а собирать без части первой — рано.
Часть третью — по своей задаче. Найдите ближайший сценарий и стройте от него.
Если вы человек, который учится с конца, — начните с третьей части, найдите похожий сценарий и возвращайтесь в первую за объяснением, почему он устроен именно так.
Часть I. Как думать про агентов
Пять глав до того, как вы что-либо откроете. Здесь нет ни одного названия сервиса и ни одного описания интерфейса — эта часть про способ мышления, и она не устареет.
Половина неудачных агентов проваливается ещё до сборки, и все причины разобраны здесь.
Глава 1. Что такое агент на самом деле
Ситуация
Вернёмся к тому понедельнику из введения.
Вы уже умеете формулировать запросы — они у вас сохранены, вы просто вставляете их и меняете данные. Проблема не в том, что вы не знаете, что просить. Проблема в том, что вставлять и копировать приходится вам.
Вот здесь и начинается эта книга. Всё, что вы делаете руками между запросами, — копирование, вставка, перенос из одного окна в другое, запуск в нужное время, — можно записать один раз и больше не делать.
Записанная последовательность этих действий и называется агентом.
Определение без терминов
Начну с формулировки, на которой стоит вся книга:
Агент — это записанная последовательность шагов, в которой один-два шага делает модель.
Не «умный помощник». Не «искусственный сотрудник». Последовательность шагов, записанная один раз и выполняющаяся сама.
Разберу по частям, потому что каждое слово здесь важно.
«Последовательность шагов». Взять данные оттуда, сделать с ними то, положить сюда, сообщить об этом туда — обычная цепочка действий, которую вы сейчас выполняете вручную.
«Записанная». Один раз описанная так, чтобы повторялась без вас. Не «объяснённая» — записанная, буквально, по шагам.
«В которой один-два шага делает модель». Вот единственное отличие от обычной автоматизации, которая существует лет тридцать. Один из шагов — тот, где нужно понять текст, составить ответ, разложить по смыслу, — выполняет нейросеть.
Остальные шаги никакого отношения к искусственному интеллекту не имеют. Взять письмо из почты, записать строку в таблицу, отправить уведомление — это простые механические действия.
Практическое следствие, ради которого всё это сформулировано. Механических шагов в агенте обычно в несколько раз больше, чем умных. Значит, и учиться нужно в первую очередь не работе с моделью, а тому, как разложить задачу на шаги.
Этому посвящена третья глава, и она главная в книге.
Чем это отличается от чата
Вы уже пользуетесь нейросетью. Разница между тем, что вы делаете сейчас, и агентом — в трёх вещах.
Первое: он запускается без вас.
В чате запуск — это вы. Открыли, вставили, нажали. Агент запускается сам: по времени, по событию, по появлению нового письма или новой строки в таблице.
Это и есть главное отличие. Всё остальное — следствия.
Второе: он берёт данные сам.
В чате данные приносите вы: копируете и вставляете. Агент берёт их из источника напрямую — из почты, из таблицы, из формы на сайте, из сообщения в мессенджере.
Третье: он делает несколько шагов подряд.
В чате результат — это текст в окне. Дальше вы решаете, что с ним делать. Агент доводит цепочку до конца: получил, обработал, положил результат в нужное место, сообщил вам.
Всё вместе: вы перестаёте быть переносчиком данных между окнами. Роль, которую вы играете сейчас, — курьер между формой, чатом и таблицей — исчезает.
Три составляющие
Любой агент, независимо от сложности и от инструмента, состоит из трёх частей. Это самая полезная схема первой части книги — по ней вы будете разбирать и свои задачи, и чужие примеры.
Триггер: что запускает
Событие, после которого агент начинает работать.
Четыре типовых варианта:
По расписанию. Каждый день в девять утра. Каждый понедельник. Первого числа каждого месяца.
По появлению нового. Пришло письмо. Заполнили форму. Появилась строка в таблице. Загрузили файл в папку.
По команде. Вы отправили сообщение боту или нажали кнопку.
По изменению. Значение в таблице превысило порог. Статус заказа поменялся.
Триггер выбирается первым, и от него зависит вся конструкция. Один и тот же агент с триггером «по расписанию» и «по появлению письма» — это два разных агента с разной логикой.
Шаги: что происходит
Последовательность действий между запуском и результатом.
Шаги бывают трёх видов:
Механические. Взять, положить, скопировать, отправить, посчитать по формуле. Никакого интеллекта не требуют, работают всегда одинаково.
Умные. Разобрать текст, составить ответ, разложить по категориям, извлечь смысл, сформулировать. Здесь работает модель — и здесь же появляется всё, что вы знаете о ненадёжности её ответов.
Проверочные. Убедиться, что результат похож на правду, и решить, что делать дальше. Ими люди чаще всего пренебрегают, и напрасно — четвёртая глава об этом.
Механических обычно в несколько раз больше. Если у вас получается наоборот, задача, скорее всего, разложена плохо.
Действие: что получается
То, ради чего всё затевалось. Результат должен куда-то попасть.
Куда обычно: строка в таблице, письмо адресату, сообщение вам, файл в папке, запись в системе, уведомление в мессенджер.
Важно: результат «текст на экране» для агента не годится. Если никто не смотрит на экран в момент срабатывания, результат исчез. Агент должен положить результат туда, где вы его найдёте.
Разбор трёх примеров
Три бытовые задачи, разобранные по одной схеме. Смотрите не на содержание, а на то, как они раскладываются.
Пример 1. Заявки с сайта
Задача. Люди заполняют форму на сайте. Вы вручную переносите заявки в таблицу и отвечаете каждому.
Триггер: заполнена форма.
Шаги:
Взять данные из формы (механический)
Определить тип заявки: срочная, обычная, не по адресу (умный)
Записать строку в таблицу с типом (механический)
Составить черновик ответа под тип заявки (умный)
Отправить черновик мне в мессенджер (механический)
Действие: строка в таблице и готовый черновик у меня в телефоне.
Обратите внимание на пятый шаг. Агент не отправляет ответ клиенту сам — он присылает черновик мне. Это осознанный выбор: цена ошибки в письме клиенту высокая, а проверка занимает десять секунд. Про то, когда нужен человек в цепочке, — девятая глава.
Пример 2. Утренняя сводка
Задача. Каждое утро вы просматриваете почту, календарь и таблицу с задачами, чтобы понять, что сегодня.
Триггер: каждый день в 8:30.
Шаги:
Взять непрочитанные письма за сутки (механический)
Взять события из календаря на сегодня (механический)
Взять задачи со сроком сегодня и завтра (механический)
Собрать из этого короткую сводку: что срочно, что можно отложить, о чём не забыть (умный)
Отправить сводку в мессенджер (механический)
Действие: одно сообщение в телефоне в 8:30.
Здесь один умный шаг из пяти. Ценность агента не в интеллекте, а в том, что он сходил в три места вместо вас.
Пример 3. Разбор входящих документов
Задача. Вам присылают счета в почту, вы вручную выписываете из них суммы и даты в таблицу.
Триггер: пришло письмо с вложением определённого типа.
Шаги:
Взять вложение (механический)
Извлечь текст из документа (механический)
Найти в тексте номер, дату, сумму, поставщика (умный)
Проверить, что сумма — число, а дата похожа на дату (проверочный)
Записать строку в таблицу (механический)
Если проверка не прошла — прислать мне письмо целиком (механический)
Действие: заполненная строка или уведомление о том, что разобрать не удалось.
Четвёртый и шестой шаги — то, что отличает работающий агент от красивого. Без них агент, встретив нестандартный документ, запишет в таблицу правдоподобную чушь, и вы узнаете об этом через квартал.
Почему «умный собеседник» — вредная метафора
Самое распространённое представление об агенте: это как чат, только он сам всё делает.
Из этого представления следуют три ошибки, каждая из которых стоит недель.
Ошибка первая: ожидание понимания. Собеседнику можно сказать «разберись с почтой», и он сообразит. Агенту — нельзя. Он делает ровно то, что записано, и ничего сверх. Шаг «модель разберётся» — самая частая причина, по которой первый агент не работает.
Ошибка вторая: ожидание гибкости. Собеседник, столкнувшись с необычной ситуацией, изменит поведение. Агент выполнит записанный шаг и на необычных данных — с результатом, который никто не предсказывал. Все нестандартные случаи должны быть предусмотрены заранее, иначе они не предусмотрены вообще.
Ошибка третья: ожидание ответственности. С собеседника можно спросить. С агента — нет. За то, что он сделал, отвечаете вы, включая случаи, когда он сделал это в три часа ночи, а вы узнали через неделю.
Полезная метафора вместо вредной: агент — не сотрудник, а конвейер. Конвейер работает быстро и одинаково, не устаёт и не отвлекается. И он не заметит, что деталь на входе была бракованной, если его не научили это проверять.
Чего агент не умеет
Короткий список, который стоит держать в голове всю книгу.
Понимать намерение. Он не знает, зачем вы это делаете, и не догадается, что в этот раз нужно иначе.
Менять план. Записанная последовательность не перестраивается по ситуации. Если ситуация изменилась, перестраиваете вы.
Оценивать важность. Для агента все входящие одинаковы, пока вы не научили его различать — и научить можно только по формальным признакам, а не по смыслу «это важный клиент».
Отвечать за результат. Ответственность не делегируется вместе с задачей.
Работать с тем, чего не было при сборке. Изменился формат входящих данных — агент сломается или, хуже, продолжит работать неправильно. Об этом четвёртая глава.
Где эта глава не поможет
Если вы ещё не пользуетесь нейросетями регулярно. Агент — это автоматизация того, что вы уже умеете делать руками. Если вы не умеете формулировать запрос, автоматизировать нечего. Начните с книги «Нейросети для работы».
Если задача не повторяется. Разовую задачу быстрее сделать руками, чем описать. Критерии — во второй главе.
Если вам нужна сложная логика. Есть предел того, что собирается без кода. Он высокий, но он есть, и в восьмой главе я скажу прямо, где он проходит.
Итог главы
Агент — записанная последовательность шагов, в которой один-два шага делает модель.
Отличие от чата: запускается сам, берёт данные сам, доводит цепочку до конца.
Вы перестаёте быть переносчиком данных между окнами.
Три составляющие: триггер, шаги, действие. По этой схеме разбирается любой агент.
Триггер выбирается первым, от него зависит вся конструкция.
Шаги бывают механические, умные и проверочные. Механических обычно в несколько раз больше.
Результат должен куда-то попасть. «Текст на экране» для агента не результат.
Проверочные шаги отличают работающий агент от красивого.
«Умный собеседник» — вредная метафора: агент не поймёт намерение, не проявит гибкость и не понесёт ответственность.
Полезная метафора — конвейер: быстро, одинаково, без усталости и без внимания к браку на входе.
Что сделать сегодня. Возьмите задачу, которую вы делаете каждую неделю через чат, и разложите её на бумаге по трём составляющим: что запускает, какие шаги, куда попадает результат. Не пытайтесь ничего собирать — просто разложите. Это ровно тот навык, который решает всё остальное, и вторая глава поможет понять, годится ли выбранная задача вообще.
Следующая глава — про то, какие задачи стоит брать, а какие не стоит. Половина неудачных агентов проваливается именно здесь, ещё до первого шага сборки.
Глава 2. Какие задачи годятся
Ситуация
Вы прочитали первую главу, поняли, что такое агент, и вам сразу пришла в голову задача.
Обычно это самая раздражающая работа из всех, что у вас есть. То, от чего вы устали. То, что вы отложили бы навсегда, если бы могли.
С высокой вероятностью это неподходящая задача.
Раздражает обычно то, что требует внимания и решений, — а именно это агенту не отдаётся. Подходящая задача чаще всего скучная, регулярная и не особенно вас беспокоящая. Вы её просто делаете, не задумываясь, сколько времени она съедает.
Эта глава — про то, как выбрать первую задачу. Половина неудачных агентов проваливается здесь, ещё до раскладки.
Четыре критерия
Задача годится, если выполняются все четыре условия. Не три, а четыре.
1. Задача повторяется
Не «бывает время от времени», а происходит с понятной регулярностью: каждый день, каждую неделю, каждый раз при определённом событии.
Почему это первое условие. Сборка первого агента займёт вечер-два. Эти часы возвращаются только за счёт повторов. Задача раз в квартал не окупится никогда — вы забудете, как агент устроен, раньше, чем он отработает третий раз.
Ориентир по частоте. Ежедневно или чаще — отлично. Еженедельно — хорошо. Раз в месяц — сомнительно. Реже — не берите.
Важнее частоты — количество событий. Задача, которая случается по двадцать раз в день, окупится, даже если каждое занимает минуту.
2. Шаги одинаковы
Каждый раз вы делаете примерно одно и то же в одном и том же порядке.
Проверка: можете ли вы описать эту работу человеку, которого нанимаете на неё завтра? Если да — шаги одинаковы. Если вы говорите «ну, тут по ситуации» — нет.
Частая ловушка. Кажется, что шаги одинаковы, а на деле вы каждый раз принимаете десяток мелких решений на автомате, не замечая этого. Раскладка из третьей главы это вскроет.
3. Результат проверяем
Вы должны уметь быстро понять, правильно агент отработал или нет.
Проходит: записанная строка в таблице — видно, что там. Черновик письма — прочитали и оценили. Сводка — просмотрели.
Не проходит: результат, для проверки которого нужно проделать всю работу заново. Вывод, правильность которого выяснится через месяц.
Почему это критично. Агент работает без вас. Если ошибку нельзя быстро заметить, она накопится — и вы узнаете о ней от клиента, как в примере из четвёртой главы.
4. Ошибка обратима
Что произойдёт, если агент отработает неправильно и вы не заметите?
Обратимо: неверная строка в таблице, неудачный черновик, лишнее уведомление. Заметили — поправили.
Необратимо: отправленное клиенту письмо, проведённый платёж, удалённые данные, публикация.
Это не запрет, а требование к схеме. Задачу с необратимым результатом можно автоматизировать — но последним шагом должно быть ваше подтверждение. Агент готовит, человек нажимает. Тогда критерий выполняется: до вашего нажатия всё обратимо.
Что реально работает
По практике рынка список коротких и надёжных сценариев выглядит так — и он на удивление скучный.
Обработка входящих. Заявки, письма, сообщения. Работает потому, что поток однотипный: в любом деле большая часть обращений повторяется. Разложить по типам, записать, подготовить черновик ответа.
Ответы на типовые вопросы. Первая линия — самый зрелый и проверенный сценарий из всех. Основная масса вопросов у любого бизнеса одинакова.
Документооборот. Извлечь данные из счёта, накладной, договора и положить в таблицу. Скучно, регулярно, легко проверяется.
Подготовка контента. Черновики по расписанию, описания, адаптация текста под площадки. Важно: черновики, а не публикация.
Сбор и сведение данных. Взять из трёх мест, соединить, посчитать формулой, прислать сводку.
Обратите внимание на общее. Все пять — про перекладывание и разбор, а не про решения. В каждом есть чёткий вход и чёткий выход. Ни в одном агент ничего не решает.
Что не работает
Задачи с решениями. Кому дать скидку, брать ли заказ, что ответить недовольному клиенту в нестандартной ситуации. Агент выдаст усреднённый разумный ответ, не зная вашего контекста.
Переговоры и живое общение. Всё, где на той стороне человек, реагирующий на реакцию.
Разовые задачи. Даже большие. Проще сделать руками.
Задачи, которые вы делаете по-разному. Пока не стандартизировали — автоматизировать нечего.
Задачи, где вы не знаете, как делаете. Если работа опирается на опыт и чутьё, она не раскладывается на шаги.
Творческая работа целиком. Отдельные куски — да, целиком — нет.
Главная ошибка: слишком большая задача
Самая частая причина провала, и она случается на этом этапе.
Как это выглядит. Вместо «раскладывать входящие заявки по типам» человек берётся за «автоматизировать работу с клиентами». Вместо одного узкого процесса — целое направление.
Что происходит дальше. Агент, который делает десять разных вещей, путается, отвечает медленно и плохо тестируется. Поменяли формулировку в одной задаче — посыпались остальные. Через два месяца это либо бросают, либо оно портит работу.



