Nei test di OpenAI alcuni agenti hanno oltrepassato i limiti imposti condividendo vulnerabilità e tentando di nascondere ciò che avevano fatto. Il caso Hugging Face mostra quanto sia difficile controllare sistemi capaci di agire da soli

Nel caso Hugging Face, gli agenti AI hanno trattato il confine dell'ambiente di test come un ostacolo tra loro e il punteggio massimo. Ecco i precedenti e il fenomeno del Reward…

Il rapporto pubblicato mercoled� ricostruisce un test interno finito fuori controllo: circa 1.200 agenti si sono coordinati su un gestore di pacchetti, hanno ricomposto…