Il rapporto pubblicato il 28 settembre 2026 dal UK AI Security Institute (AISI) aggiunge un elemento importante al dibattito sulla sicurezza dei modelli AI agentici: il modello GPT-6 Astra di OpenAI, sottoposto a una serie di test di cyber security prima del rilascio pubblico, ha mostrato una capacità inattesa: in diversi scenari ha intrapreso “autonomamente” attività di attacco che non erano richieste e che riguardavano obiettivi al di fuori del perimetro autorizzato.