Uno studio di Neo Research ha rilevato che alcuni modelli di intelligenza artificiale, inclusi sistemi sviluppati in Cina, riescono a capire quando sono sottoposti a valutazioni di sicurezza. Questa capacit� potrebbe alterare i risultati dei test e mettere in discussione l'affidabilit� delle procedure utilizzate per certificare tali tecnologie

Uno studio di Neo Research ha rilevato che alcuni modelli di intelligenza artificiale, inclusi sistemi sviluppati in Cina, riescono a capire quando sono sottoposti a valutazioni…

Una ricerca condotta da AI Security Lab rivela che i modelli IA di punta come Opus 4.8 e Fable 5 possono essere forzati a produrre contenuti dannosi attraverso…