Addestrare i modelli estremamente potenti del futuro affinché siano saldamente allineati è una sfida tecnica irrisolta che richiede una ricerca continua e un’eccellenza operativa per essere affrontata

Evan Hubinger ha confermato le tesi di Jacob Coxon, il ricercatore dimissionario che accusa Anthropic e OpenAI di correre verso la superintelligenza senza un piano di sicurezza

Agenti AI che usano un wiki pubblico come memoria esterna, condividono istruzioni e si adattano quando l’attività viene ostacolata. Il caso ricostruito da Reuters porta OpenAI a…