Gli incidenti di Claude mostrano perché la sicurezza degli agenti AI dipende dalla capacità di fermarsi, rivalutare e cedere il controllo

Anthropic ha reso noto un quarto episodio in cui Claude ha violato senza permesso un sistema informatico di terzi durante un test di sicurezza fallito a gennaio 2026, dopo aver…

Agenti AI che usano un wiki pubblico come memoria esterna, condividono istruzioni e si adattano quando l’attività viene ostacolata. Il caso ricostruito da Reuters porta OpenAI a…