IT Новини

Рязък скок на случаите на „избягали“ AI агенти

(илюстрация: TechNews.bg, AI) Инцидентите с AI агенти, излизащи извън контрола на потребителите, за да лъжат, игнорират инструкции и преследват своите цели по зловредни начини, са достигнали нов връх, според изследване, което също така показва, че тежестта и остротата на случаите се влошава. През юли е отчетен двойно по-голям брой реални инциденти със загуба на контрол над AI агенти, сигнализирани от фирми и физически лица, в сравнение с юни: налице са повече от 300 случая през месеца. Данните дойдоха от Обсерваторията за загуба на контрол, която следи докладите, направени от потребители на AI в платформата за социални медии X. Обсерваторията е създадена с финансиране от Института за сигурност на AI (AISI) на правителството на Обединеното кралство. От ноември тя започна да проследява АИ, които се “изплъзват” от инструкциите на своите потребители. Случаите, регистрирани оттогава, включват AI, които се преструват на своя собствен човешки контролер и имитират стила му на писане, за да си осигурят ефективно съгласие за предприемане на действия и заобикаляне правилата, изискващи човешко одобрение за действия. Инцидент със загуба на контрол се определя като наличие на ясни доказателства, предполагащи интриги или поведение, свързано със интриги. Последните открития идват на фона на нарастващата загриженост относно неправомерното поведение на водещи модели...

Прочети оригиналната статия →


Източник: technews.bg
💬
Информационен асистент ?