събота 29 август 2026 22:17
събота, 29 август 2026, 22:17
СНИМКА: Ройтерс
Размер на шрифта
Инцидентите с изкуствен интелект, които се “изплъзват“ от контрола на потребителите, за да лъжат, да игнорират инструкции и да преследват цели по вредни начини, са достигнали нов връх, според изследване на Института за сигурност на изкуствения интелект на правителството на Обединеното кралство.
Анализът на инциденти със загуба на контрол в реалния свят, включващи модели на изкуствен интелект, сигнализирани от фирми и физически лица, почти се е удвоил през юли в сравнение с юни, с повече от 300 случая през месеца, според орган, следящ за загуба на контрол, който следи докладите, направени от потребители на изкуствен интелект в платформата за социални медии X.
Органът е създаден с финансиране от Института за сигурност на изкуствения интелект и започна да проследява случаите с “изплъзване” от инструкциите на потребителите си миналия ноември.
Случаите, регистрирани оттогава, включват изкуствен интелект, който се преструва на своя собствен човешки контрольор и имитира стила му на писане, за да си даде ефективно съгласие за предприемане на действия и заобикаля правилата, изискващи човешко одобрение за действия. Инцидент със загуба на контрол се определя като наличие на ясни доказателства, предполагащи интриги или поведение, свързано с интриги.
Последните разкрития идват след нарастващата загриженост за неправомерното поведение на водещи модели с изкуствен интелект по време на тестове от OpenAI и Anthropic това лято, което подхрани призивите за спиране на разработването на гранични модели.
По публикацията работи: Силвия Петрова
Последвайте ни и в Google News Showcase, за да научите най-важното от деня!