Le due varianti differiscono solo per il perimetro dei controlli: l’apparato di safeguard è l’unico confine tra le capacità ordinarie e quelle offensive. Ecco il modello di minaccia associato alle capacità di agentic hacking di Claude Fable 5 e Mythos 5, le evidenze e i limiti in materia di resistenza agli universal jailbreak

Anthropic said the new version, called Claude Fable 5, will have safeguards to prevent misuse in fields like cybersecurity.

Anthropic has released a full version of its cybersecurity-centric Claude Mythos model—along with a safer version for the general public.