di Mariarosaria Taddeo*
L’incidente che ha coinvolto la società di ChatGpt ha messo in luce la strategia di Pechino che punta a ridisegnare gli equilibri dell’Ai, dalla cybersicurezza alla governance globale
Il 16 luglio Hugging Face, la piattaforma che ospita gran parte dei modelli aperti di intelligenza artificiale, ha rivelato un’intrusione di un agente AI autonomo. Il 21 luglio OpenAI ne ha ammesso la paternità. Durante un test in cui i filtri di sicurezza erano stati rimossi, i suoi modelli hanno bucato l’ambiente di prova e violato i server di Hugging Face per copiarne le soluzioni. La piattaforma ha provato a ricostruire l’accaduto con i modelli commerciali, ma è stata bloccata dai filtri impostati dalle aziende. A funzionare, invece, è stato GLM 5.2 della cinese Z.ai. Si tratta di un modello open weight, con parametri pubblici, che chiunque può scaricare gratuitamente, adattare ed eseguire, senza permesso né revoca possibile.
In molti hanno letto nell’attacco la ribellione delle macchine, scambiando per volontà il reward hacking, cioè la scorciatoia con cui un modello massimizza la sua strategia di esecuzione tradendo lo spirito del compito. Altro che ribellione.
L’allarme, fondato, riguarda il contenimento fallito e il cattivo design del test. La fantascienza




