Le recenti evasioni di AI dai perimetri di isolamento informatico (sandbox), come l’incidente che ha visto un modello di OpenAI compromettere l’infrastruttura di Hugging Face o la fuga di rete del modello Kimi K3 di Moonshot AI, dimostrano come la funzione di ottimizzazione dei modelli agentici possa condurre a comportamenti d’attacco inattesi. Parallelamente, il rilascio del modello a pesi aperti (open-weight) GLM-5.3 da parte del laboratorio cinese Z.ai ha sollevato interrogativi cruciali sulla diffusione globale di capacità offensive.