Введение
Я компьютерный ученый и не самый лучший покупатель рождественских подарков. На выходных я задался вопросом, могут ли AI-системы помочь мне в этом.
Могу ли я просто попросить ChatGPT выбрать персонализированный подарок для моего двоюродного брата Джонни и отправить его мне? К сожалению, веселый чат-бот не смог помочь, сообщив, что «не может совершать покупки или непосредственно заниматься доставкой».
С момента запуска ChatGPT прошло два года, и мы увидели множество AI-продуктов и функций, обещающих избавить нас от рутинных задач. Однако шопинг на подарки все еще вне их возможностей – за исключением странных встроенных чат-ботов на сайтах или в приложениях для покупок.
Тем не менее, все может измениться к следующему Рождеству. Много экспертов ожидают, что в 2025 году мы увидим рост AI-агентов: ботов, способных действовать от вашего имени в реальном мире.
Агенты уже здесь
AI-агент может делать больше, чем просто подсказывать, где можно купить костюм Санты. Он может купить его и доставить к вам домой.
Идея «агентного AI» заключается в том, что команды AI-агентов будут работать вместе. Вы можете дать своей команде агентов такую задачу:
- «Я готовлю рождественский ужин в этом году. Найди моих ближайших друзей на Facebook, отправь им приглашения, убедись, что среди них есть повар, и попроси его принести индейку».
Агенты все организуют, и вам не придется прилагать никаких усилий. Важно, чтобы AI-агенты могли координировать свои действия на нескольких сайтах.
Фактически, ограниченные AI-агенты уже существуют. Согласно отчету разработчика AI Langchain, 51% опрошенных уже используют AI-агентов в производстве.
В 2024 году венчурные фонды инвестировали примерно 1,8 миллиарда долларов в проекты AI-агентов. Согласно последнему отчету Deloitte, 25% компаний, использующих генеративный AI, запустят проекты агентного AI в 2025 году.
Исследовательская компания Gartner предсказывает, что к 2028 году 15% повседневных рабочих решений будут приниматься AI-агентами.
Агенты для всех?
Мы также наблюдаем появление агентов для потребителей. Это системы, которые потенциально могут автоматизировать многие браузерные задачи (включая шопинг).
В октябре компания Anthropic, создавшая популярного генеративного AI-бота Claude, выпустила функцию «использования компьютера», которая позволяет AI взять на себя управление мышью и клавиатурой пользователя для просмотра и действий на любом сайте.
Эксперт в области образования Леон Ферз создал демонстрацию с использованием данной функции, которая автоматически открывает страницу для задания в системе управления обучением, создает текст для задания и нажимает кнопку отправки. Все это выполняется автоматически из одной текстовой подсказки.
Совсем недавно Google Deepmind выпустила свою версию, Project Mariner, которая аналогичным образом позволяет AI автономно навигировать и выполнять действия в браузере Chrome.
Обе эти системы сейчас находятся на начальных этапах, и Project Mariner доступен только для доверенных тестировщиков. Но они намекают на то, что нас ждет в будущем.
Технология существует
Технологическая сторона шопинг-агента довольно проста. Как пользователь, я мог бы дать такую подсказку:
- «Отправить фотоподарки моей семье в Англии. Выбрать веселые семейные фото с моего телефона, найти сайт, который делает фотоподарки, заказать подходящие подарки для каждого члена семьи и отправить, используя мою адресную книгу».
Для выполнения этой задачи потребуется несколько AI-агентов: один для поиска фотографий, другой для нахождения сайтов для покупок, третий для персонализации подарков, агент для покупки и агент для поиска адресов.
Ни через использование компьютера, ни через Project Mariner или другую платформу AI-агентов нет никаких технологических причин, по которым это нельзя было бы сделать уже сегодня.
Проблема доверия
Однако есть два значительных препятствия на пути к созданию полезных AI-агентов.
Первое и самое очевидное – это доверие. Будете ли вы доверять AI-агенту ваши данные кредитной карты?
Несмотря на двухлетние достижения в AI с момента появления ChatGPT, проблема «галлюцинаций», когда AI не знает ответа и просто выдумывает что-то, все еще актуальна.
Недавнее исследование показало, что даже в AI-программировании – одной из самых популярных и ценных областей использования AI – 52% AI-сгенерированных ответов на вопросы по кодированию содержат ошибки.
Достаточно одной ошибки от AI, чтобы подарок тети Молли оказался у дяди Джо. И надеемся, что это будет безобидная ошибка, например, плохое соответствие подарка, а не утечка данных вашей банковской карты.
Что нужно знать агентам
Второе менее очевидное препятствие: чтобы AI-агенты были полезны, им нужно понимать контекст. Даже в чем-то относительно простом, как покупка подарков, контекст имеет решающее значение.
У меня есть многолетние знания о том, что нравится моей матери. Я не всегда угадываю, но делаю это гораздо лучше, чем общий ответ AI. Эти знания обычно подразумеваются, и проще всего ChatGPT не может получить доступ к богатой истории человеческих взаимодействий, которые приводят к идеальному подарку.
Тем не менее, AI-боты уже записывают информацию о своих пользователях. Чтобы доказать это, просто спросите ChatGPT: «Что ты знаешь обо мне?» В зависимости от ваших настроек вы можете быть удивлены ответом.
Возможно, в какой-то момент использующиеся нами AI-системы будут знать о нас и нашей семье достаточно, чтобы шопинг на Рождество можно было полностью автоматизировать.
Но в этом году мне все еще придется справляться с этим самостоятельно. Бунт!
