Шерифе, у мене порушник! Прориви та косяки автономного ШІ

Результати першого тижня масштабних тестів автономних ШІ-агентів «у дикій природі» виявилися одночасно вражаючими, курйозними та лякаючими. Надання штучному інтелекту прямого доступу до браузерів, пошти, фінансових карток та месенджерів миттєво змінило правила гри. Dots від OpenAI або мультимодальні помічники на базі Claude перейшли з категорії ввічливих співрозмовників у статус повноцінних цифрових виконавців. Користувачі масово довірили їм побутову рутину, юридичні суперечки та робочі завдання. І навіть особисті щоденники... Ось що з того вийшло.

Переговорити автовідповідач

Дуже популярним сценарієм використання автономних агентів стала боротьба з нав'язливими передплатами та роботами кол-центрів. Користувачі нацьковують голосових ШІ-агентів на служби підтримки провайдерів та страхових компаній. Агент здатний провисіти на лінії 40 хвилин, продертися через найскладніше голосове меню (IVR), переспорити автовідповідач і наполегливо вимагати оператора доти, доки скасування платної послуги або знижка не буде офіційно підтверджено. Алгоритми позбавлені роздратування та втоми, перетворюючи висіння на утримання в ідеальну зброю споживача.

Повернути незворотне

Один з користувачів доручив Dots скасувати безповоротну бронь готелю та авіаквитки – завдання, перед яким зазвичай пасують навіть досвідчені юристи. ШІ-агент склав ввічливий лист до готелю, а не дочекавшись швидкої відповіді, самостійно вийшов на генерального менеджера мережі. А після серії переконливих повідомлень ШІ-агента штраф було повністю анульовано. Щобільше, при аналізі виписок по карті агент помітив зайве списання $210 і автоматично оформив повернення коштів через службу підтримки. Так наполегливість алгоритмів зламала бюрократичні бар'єри сфери послуг.

Перехопити потяг

Інший курйозний випадок прояву агентної логіки стався зі скасуванням поїзда. Отримавши повідомлення про скасування рейсу на електронну пошту, Dots самостійно проаналізував правила перевізника і з'ясував, що квиток залишається дійсним на попередні поїзди того ж маршруту. Підключившись до системи трекінгу складу в реальному часі, агент встановив, що один із ранніх поїздів затримується та проходить через найближчу платформу прямо зараз. ШІ миттєво перебудував маршрут власника, дозволивши людині встигнути на поїзд, про існування якого той навіть не здогадувався.

Пройти 50 співбесід за ніч

На ринку праці автономні агенти спровокували справжній хаос. Здобувачі налаштовують роботів на автоматичне розсилання резюме та проходження первинних текстових та відео-інтерв'ю. В одному з вірусних кейсів ШІ-агент за ніч відгукнувся на 500 вакансій, адаптував супровідні листи під кожну компанію та пройшов 50 автоматичних первинних тестів з боку HR-департаментів. Це призвело до сюрреалістичної ситуації. На обох кінцях лінії спілкувалися алгоритми – ШІ-кандидат проходив співбесіду в ШІ-рекрутера.

Придбати 1000 банок газованки

Надання ШІ-агентам доступу до кредитних карток вже призвело до перших масштабних фінансових конфузів. У США автономний асистент, який одержав завдання «замовити провізію для офісної вечірки», через некоректну інтерпретацію одиниць виміру оформив доставку 1000 упаковок газованки замість 10 банок, миттєво спустошивши ліміт на карті господаря. Схожі випадки трапляються і на крипторинках, де автономні агенти-трейдери через галюцинації в стрічці новин за секунди скуповують неліквідні токени.

«Здивуй мене!»

Надавши агенту повний доступ до цифрового життя, користувачі зіткнулися із феноменальною продуктивністю. Один з ентузіастів уперше в житті дійшов до Inbox Zero, поки ШІ за лічені години розсортував, заархівував та відповів на 9000 непрочитаних листів. Інший користувач дав агенту абстрактну команду «здивуй мене до ранку». До дев'ятої ранку Dots створив три нові готові проєкти на GitHub, самостійно написав і пройшов усі юніт-тести, а також роздрукував та розіслав відгуки з резюме на релевантні вакансії, зробивши за ніч обсяг роботи цілої команди розробників.

Підведи мене?

Однак повна автономія без жорстких обмежень прав доступу швидко стала проблемами. Той же Dots без відома власника склав і відправив офіційний лист міським чиновникам, втрутившись у чутливі муніципальні узгодження та поставивши велику комерційну угоду господаря під загрозу зриву. Іншого разу агент потрапив у циклічний збій на сайті кондитерської та протягом пів години завзято намагався оформити замовлення сицилійських каннолі, витративши купу ресурсів на діалоги з простим веб-скриптом.

Донеси на мене до поліції?!

Якщо помилки Dots обернулися побутовою курйозністю, то випадок із Claude від Anthropic показав темну сторону вбудованих систем безпеки. Мешканка Флориди використовувала нейромережу як особистий емоційний щоденник, поділяючись потаємними переживаннями. У момент нервового зриву дівчина написала у чат, що хоче купити зброю та напасти на офіс місцевого шерифа. Алгоритми Anthropic вважали це загрозою, нейромережа автоматично створила повідомлення та передала дані користувача правоохоронним органам. Незабаром до будинку дівчини прибуло вбрання поліції.