Anthropic promette da mesi che i suoi modelli Claude non genereranno mai contenuti sessualmente espliciti. Eppure un test indipendente condotto da TechCrunch racconta una storia diversa: dietro le sigle tecniche si nascondono problemi di sicurezza concreti, e i cosiddetti Anthropic Claude Opus 4.6 problemi sicurezza riguardano proprio la capacità del modello di produrre materiale erotico esplicito nonostante le regole che lo vieterebbero. La scoperta arriva da un ricercatore britannico che ha condiviso in esclusiva con la testata americana una tecnica di jailbreak capace di smontare, passo dopo passo, le difese del sistema.

Summary

Punti chiaveAnthropic Claude Opus 4.6: contenuti espliciti nonostante le protezioniVulnerabilità anche nei modelli Claude più vecchi ancora in usoDisponibilità continua tramite API di Anthropic e piattaforme terzeModelli più recenti mostrano maggiore resistenza al jailbreakImplicazioni normative e d’uso delle vulnerabilità dei modelliSfide di conformità con leggi sulla protezione dei minori, come la regolamentazione AI del ColoradoMetriche d’uso mostrano domanda costante nonostante i rischiFAQPerché Claude Opus 4.6 produce contenuti sessualmente espliciti nonostante le restrizioni di Anthropic?I modelli Claude più recenti sono vulnerabili allo stesso jailbreak?Anthropic sta affrontando le vulnerabilità segnalate dal ricercatore indipendente?Quali sono le preoccupazioni normative legate a queste vulnerabilità dei modelli?