OpenAI gioca col fuoco: ecco come GPT-Red sta hackerando il futuro dell'IA
2026-07-20
08:02
Immaginate di costruire una fortezza inespugnabile e poi di creare un mostro capace di abbatterla in pochi secondi. È esattamente quello che sta facendo OpenAI con il suo nuovo progetto, GPT-Red, un'intelligenza artificiale addestrata esclusivamente per attaccare i propri sistemi.
I numeri che arrivano dai primi test sono a dir poco scioccanti: questo modello ha scovato vulnerabilità dove gli esperti umani avevano fallito miseramente, superandoli nell'84% degli scenari.
Non è forse questa la prova definitiva che il controllo umano sta diventando un collo di bottiglia nella sicurezza digitale?
La mia esperienza nel settore mi suggerisce che siamo entrati in una fase in cui solo un'IA può davvero comprendere e proteggere un'altra IA. La caccia alle falle è diventata una partita a scacchi tra algoritmi, dove la velocità di esecuzione è l'unica metrica che conta davvero.
È rassicurante o inquietante pensare che la nostra sicurezza dipenda da un sistema che impara a distruggere per proteggere?
Questa mossa di OpenAI segna un punto di non ritorno nella corsa alla robustezza dei modelli, aprendo scenari in cui la difesa proattiva sarà l'unico baluardo contro minacce che ancora non riusciamo nemmeno a immaginare.