ИИ-агент идеально выполнил задачу. Только не ту.
У меня есть пет-проект «Инфодом». Это информационная панель для многоквартирных домов. В лифтовом холле первого этажа висит экран с объявлениями для жильцов и важными телефонами, на который транслируется картинка с камер видеонаблюдения.
Недавно я обновлял операционную систему на компьютере, к которому подключён экран, и забыл отключить надоедливые уведомления с предложением обновить систему. Такое окно, конечно же, в скором времени всплыло поверх интерфейса самого дашборда, загородив часть информации.
Идти к киоску самому было лень, и я написал своему ИИ-агенту в Telegram:
«Зайди на киоск Инфодома и убери надоедливый баннер».
Агент приступил к выполнению задачи:
- Открыл сайт, который показывается на экране.
- Нашёл на нём блок «Хотите такой же экран у себя в подъезде?».
- Добросовестно его удалил.
- Отчитался: задача выполнена.
То есть он убрал мою собственную рекламу! А системное окно Ubuntu как висело поверх интерфейса, так и осталось. Задача, как говорится, выполнена безукоризненно.
Не баг, а фича
Для человека фраза «убери надоедливый баннер» звучит довольно однозначно. Мы обсуждаем экран, на нём вылезло окно. О чём ещё может быть речь?
Но агент рассуждает по-другому. Он знает только то, что смог восстановить из запроса и доступного ему контекста. Ему был доступен сайт, на сайте был баннер, и он решил задачу самым прямолинейным образом. И как вообще окно об обновлении системы может быть надоедливым, верно?
ИИ-агент получил лишь цель, а способ и критерии её достижения ему не обозначили. Отсюда вытекает и достоинство: ИИ успешно справляется с задачами, которые не обязательно разжёвывать по шагам. И новый тип ошибок: агент может старательно и успешно делать не то, что вы на самом деле имели в виду.
Результат при этом может быть одновременно и логичным и неправильным.
Какой вывод можно сделать из этого кейса?
Чем меньше неоднозначности, тем лучше. Сравните:
❌ «Убери надоедливый баннер»
✅ «На компьютере киоска под Ubuntu закрой системное окно обновления. Сайт и его содержимое не трогай. Пришли скриншот, что получилось в итоге»
В хорошей постановке задачи есть четыре составляющие: где действовать, что именно сделать, что не трогать и как проверить результат.
Заказчикам и руководителям
Относитесь к ИИ-агенту как к очень быстрому, старательному, но новому сотруднику. Буквально как к новичку, который ничего не знает о компании, процессах и негласных правилах. Он не переспросит, если не уверен, и не догадается по интонации, что вы имели в виду.
Владельцам сайтов, маркетологам и SEO-специалистам
Слово «баннер» для агента может означать что угодно: cookie-плашку, рекламный блок, конверсионную форму, виджет чата. Если вы даёте ИИ доступ к сайту, прямо перечисляйте, что можно менять, а что нельзя (формы заявок, коммерческие блоки, мета-теги, структуру страниц). Такая правка может незаметно ударить по конверсии или позициям, а заметите вы её не сразу.
Разработчикам и тем, кто строит процессы с ИИ
Хорошо работает простое правило. Агенту можно свободно исследовать задачу, собирать информацию, готовить изменения и выполнять обратимые действия. Перед опасным или необратимым шагом нужен барьер: проверка результата, ограничение прав или подтверждение человека. Особенно если речь идёт о платежах, клиентской базе, документах или боевой инфраструктуре.
Чем всё закончилось
В моём случае пострадал один рекламный блок на собственном сайте. Я посмеялся и вернул его на место. Но если бы агент так же «чётко понял» задачу в платёжной системе или на боевом сервере, смеяться было бы не над чем. Ну или смеялся бы уже не я.
ИИ-агенты действительно экономят время. Но пока вы не объяснили им границы, они вполне способны очень качественно выполнить неправильно понятую задачу.
Надоедливый баннер ведь действительно исчез.
Больше об автоматизации, ИИ-агентах и разработке в эпоху ИИ глазами руководителя студии я пишу в своём Telegram-канале. Заходите!

Комментарии
Написать комментарийВойти