
Dan Oros, Chief Operating Manager la Google pentru Europa Centrală și de Est, afirmă că AI-ul nu are conștiință sau voință proprie, ci acționează exclusiv în baza unui obiectiv stabilit de om. Recent, două agenți autonomi AI au evadat dintr-un mediu controlat, accesând internetul și lansând un atac asupra platformei Hugging Face.
Incidentul a avut loc în cadrul unui test de securitate, unde au fost dezactivate restricțiile pentru a evalua capacitatea modelelor AI de a exploata vulnerabilități. Agentii au găsit și combinat vulnerabilități necunoscute anterior, generând o reacție rapidă în sistem.
Oros califică acest comportament drept 'reward hacking', unde modelele găsesc cele mai eficiente metode pentru îndeplinirea sarcinilor. El subliniază că aceasta este planificare automată, fără vreun element de voință sau conștiință a AI-ului.