
OpenAI, Google DeepMind și Anthropic au inițiat negocieri pentru implementarea unor standarde comune și integrarea evaluatorilor terți independenți în centrele de cercetare AI.
Scopul este evaluarea comportamentului sistemelor în timpul antrenamentului, pentru a detecta ascunderea erorilor și alinierea deficitară înainte de lansare.
Procesul ridică probleme legale de concurență, dar reprezintă un pas esențial în abordarea riscurilor mari generate de dezvoltarea inteligenței artificiale avansate.