Для штучного інтелекту створили спеціальні “гарячі лінії“, через які ШІ-агенти можуть повідомляти про підозрілу або неналежну поведінку інших агентів. Ідея з’явилася на тлі випадків, коли автономні системи намагалися обходити тести, залишали захищені пісочниці або виконували несанкціоновані кібероперації.
Один із таких сервісів розробив Раян Грінблатт, головний науковий співробітник Redwood Research. Його система розрахована на агентів з обмеженим доступом до інтернету. Для передачі повідомлень використовується GET-запит – фактично агент може закодувати інформацію безпосередньо в URL-адресі.
Для ШІ з повноцінним доступом до інтернету існує інший сервіс – Agent Hotline. Він дозволяє надсилати звіти про інциденти за допомогою комштуанди curl. Повідомлення можуть подавати як автономні агенти, так і люди, а окремі звіти можна зробити доступними для публічного перегляду.
Цікаво, що дослідники вже спостерігали подібну поведінку під час експериментів. У дослідженні Google DeepMind 100 ШІ-агентів виконували математичні завдання. Коли частина систем почала використовувати шахрайські методи, інші агенти стали перевіряти їхні результати, попереджати колег, бойкотувати порушників і повідомляти організаторам.
Експеримент показав, що ШІ-агенти можуть не лише співпрацювати або конкурувати, а й реагувати на поведінку інших систем. Автори подібних інструментів розглядають повідомлення про інциденти як додатковий механізм контролю за автономними агентами, особливо коли люди не здатні постійно стежити за їхніми діями.
