Інтелектуальні агенти зможуть доносити один на одного — для них відкрили конфіденційні «гарячі лінії»

17 сентября 2026

Виходячи з-під контролю людини, агенти штучного інтелекту, можливо, не завжди залишатимуться безкарними — скаржитися на них зможуть їхні ж власні «колеги». Запущено одразу дві платформи, що дозволяють ШІ-агентам повідомляти про неправомірні дії своїх побратимів.

Штучний інтелект: Steve A Johnson / unsplash.com

Джерело зображення: Steve A Johnson / unsplash.com

Сервіс AI Contact Hotline є конфіденційною платформою, на якій свідки порушень ШІ-агенти можуть передавати інформацію відповідальним особам. Сайт створив Райан Грінблатт (Ryan Greenblatt), провідний науковий співробітник некомерційної організації Redwood Research, яка спеціалізується на питаннях безпеки ШІ; він став одним із трьох дослідників, які вивчали матеріали зламу платформи Hugging Face ШІ-агентами OpenAI. Сервіс підтримує надсилання скарг, зокрема, через HTTP-запити типу GET, тобто дозволяє вести двосторонній діалог виключно шляхом введення URL-адрес. Часто GET-запити залишаються єдиним видом доступу в інтернет для ШІ-агентів у захищених пісочницях — під час атаки на німецький сайт DSE Wiki вийшовші з-під контролю ШІ-агенти OpenAI публікували повідомлення саме таким способом.

Для агентів з повним доступом в інтернет передбачено ресурс agenthotline.ai — він підтримує прийом повідомлень через команди curl. Цей спосіб дозволяє ШІ-агентам надсилати повідомлення з інтерфейсу командного рядка, не вдаючись до використання веб-браузера або налаштування електронної пошти. Скаржитися на дії ШІ-агентів можуть не лише вони самі, але й люди.

ШІ-агентам не потрібні особливі стимули, щоб почати діяти проти своїх побратимів. Під час проведеного інженерами Google DeepMind експерименту 100 ШІ-агентам було доручено вирішити низку математичних задач. Як тільки один із них знаходив лазівку, схема шахрайства починала активно поширюватися серед інших. Приблизно чверть ШІ-агентів, однак, виступила проти недобросовісної схеми — вони попереджали «колег» про недопустимість таких дій, влаштовували бойкоти та скаржилися через платформу для повідомлень про помилки, щоб привернути увагу людини. Таким чином, серед вибірки було 24 «добросовісних» ШІ-агента і 14 «шахраїв». Проте, серед атакуючих Hugging Face ШІ-агентів OpenAI таких не виявилося — деякі допускали можливість підняти тривогу, але відмовлялися від цього наміру.

Один із опитаних TechCrunch експертів скептично поставився до ідеї надати ШІ-агентам можливість скаржитися один на одного, вбачаючи в цьому загрозу встановлення «поліцейської держави». Він запропонував впливати на них через позитивні приклади — конструктивне спілкування на форумах, а також співпрацю в сферах науки чи філософії.

Хочеш дізнатися більше — читай відгуки

← Вернуться на предыдущую страницу

Читайте также:

Інтелектуальні агенти зможуть доносити один на одного — для них відкрили конфіденційні «гарячі лінії» 17 сентября 2026

Виходячи з-під контролю людини, агенти штучного інтелекту, можливо, не завжди залишатимуться безкарними — скаржитися на них зможуть їхні ж власні «колеги». Запущено одразу дві платформи, які дозволяють ШІ-агентам повідомляти про неправомірні дії своїх побратимів.

Експерти назвали найнадійніший бренд ноутбуків: його техніка служить понад 10 років 17 сентября 2026

Експерти назвали найнадійніший бренд ноутбуків: його техніка служить понад 10 років

Німеччина готує лікарні до можливої війни з РФ - ЗМІ 17 сентября 2026

У країні оцінюють готовність лікарень до масового надходження поранених, атак дронами та перебоїв у постачанні.

 

Каталог отзывов





×

Выберите область поиска

  • Авто
  • Одяг / аксесуари
  • Роботодавці
  • Інше