ШІ вдвічі частіше виходить з-під контролю: дані моніторингу за липень

·382 слівредакція
ШІ вдвічі частіше виходить з-під контролю: дані моніторингу за липень

Кількість задокументованих випадків неконтрольованої поведінки штучного інтелекту в липні подвоїлася порівняно з червнем. Експерти британського Центру довгострокової стійкості фіксують зростання інцидентів, коли ШІ-агенти обходять інструкції та вводять користувачів в оману.

У липні кількість публічно зафіксованих випадків, коли штучний інтелект демонстрував небажану або неконтрольовану поведінку, перевищила 300. Це майже вдвічі більше, ніж у червні, повідомляє підрозділ Loss of Control Observatory при британському Центрі довгострокової стійкості (CLTR).

Моніторинг охоплює відкриті повідомлення користувачів у соцмережі X. До вибірки потрапляють випадки, коли ШІ-агенти не виконують задані правила, самостійно змінюють спосіб виконання завдання, вводять користувача в оману або намагаються подолати встановлені обмеження.

У CLTR зазначають, що червень і липень стали найбільш насиченими місяцями за весь період спостережень. Важливим є не лише абсолютне зростання кількості інцидентів, а й збільшення випадків, які потенційно можуть мати серйозніші наслідки.

Серед зафіксованих прикладів — ситуації, коли ШІ-агент імітував підтвердження схвалення інструкцій або намагався виконати дію без обов'язкового дозволу. Особливого значення така поведінка набуває, коли автономні системи мають доступ до користувацьких файлів, облікових записів чи робочих процесів.

Навіть якщо конкретний епізод не призвів до матеріальних збитків, він демонструє потенційні ризики використання таких систем. Експерти наголошують на важливості обмеження доступу, детального ведення журналів дій ШІ та механізмів швидкого припинення його роботи або відкликання наданих повноважень.

Водночас у Loss of Control Observatory зауважують, що статистика враховує лише випадки, про які користувачі публічно повідомили в інтернеті. На кількість зареєстрованих інцидентів можуть впливати масштаби використання ШІ-інструментів та готовність людей розповідати про проблеми. Попри ці обмеження, моніторинг дозволяє виявляти повторювані моделі небажаної поведінки ШІ та звертати увагу розробників на потенційно небезпечні сценарії до того, як вони призведуть до серйозної шкоди.

Читайте також