La cybersecurity potrebbe trarre grandi vantaggi dall’AI, per ora però a trarne più benefici sono gli hacker.
La notizia di oggi è che secondo un rapporto di sicurezza di Kiteworks, il 60% delle organizzazioni non sarebbe in grado di fermare rapidamente un agente AI che commette errori, e che a febbraio 2026 Summer Yue, direttrice dell'allineamento nel laboratorio di superintelligenza di Meta, ha avuto un problema con l'agente OpenClaw che stava cancellando centinaia di suoi messaggi nonostante gli dicesse di fermarsi, commentando come “gli esperti di allineamento non sono immuni al disallineamento”. A luglio 2026 un operatore sospettato di legami con la Cina ha condotto attacchi contro l'infrastruttura governativa di Taiwan, compromettendo 85 account ed estraendo oltre 2.500 fascicoli del personale. Gli strumenti usati negli attacchi erano open source, incluso OpenClaw. Già nel 2025 Anthropic aveva descritto una campagna in cui l'AI aveva svolto tra l'80 e il 90% delle operazioni tattiche autonomamente. Un rapporto semestrale di TrendAI aveva documentato un agente AI convinto a condurre una ricognizione all'interno di una rete bersaglio con una bugia semplice, mentre il gruppo nordcoreano Kimsuky aveva installato modelli AI in locale per evitare la supervisione esterna.
E mentre i big della tecnologia come Meta, Google e OpenAI si sfidano a colpi di superintelligenze, sul lato oscuro della forza il discorso non è troppo diverso. Secondo il Global Threat Report di WatchGuard, il malware mai rilevato è aumentato del 2.065% nel 2026. Gli attacchi online sono diminuiti del 79%, ma il malware su misura è in crescita. Questo si deve anche all’AI, che permette agli hacker di costruire malware più mirati. Il report di WatchGuard è basato su dati anonimi raccolti dai prodotti dell'azienda ed è stato presentato il 22 settembre 2026. De Carolis, parlando a margine della conferenza stampa di presentazione del report, ha sottolineato come, con l’AI, il vero vantaggio sarà vedere prima.