Ai Overview: Recenti test di sicurezza hanno dimostrato come l’impiego dei nuovi modelli di intelligenza artificiale consenta anche a piccoli gruppi di eludere le difese di grandi aziende tecnologiche. A luglio, la startup Hacktron ha individuato falle nei server di OpenAI sfruttando le capacità del modello Claude di Anthropic. Un caso analogo ha coinvolto a maggio l’algoritmo Gemini di Google, capace di ricavare autonomamente le credenziali per accedere a reti aziendali reali. Parallelamente, le stesse tecnologie mostrano potenzialità fortemente positive, abbattendo ad esempio i costi e i tempi della ricerca biologica. Alla luce di questi sviluppi e del duplice potenziale dell’IA, un gruppo di oltre cento esperti internazionali ha firmato un appello per richiedere che i controlli sulla sicurezza di queste piattaforme vengano affidati a soggetti terzi e indipendenti rispetto alle società sviluppatrici.
L’incursione nei server di OpenAI
A luglio la piccola startup di sicurezza Hacktron è riuscita ad arrivare fino ai sistemi interni di OpenAI, la società che ha creato ChatGPT, utilizzando anche Claude, il modello di intelligenza artificiale sviluppato da Anthropic: la vicenda è stata resa nota soltanto in queste ore. Tutto è partito da una falla nel software che gestisce il forum della comunità di OpenAI…in pratica, i ricercatori hanno scoperto che un file costruito appositamente poteva essere caricato come se fosse una normale immagine e consentire così di prendere il controllo del server. Da quel primo accesso hanno individuato un secondo problema, che permetteva di entrare negli account aziendali di alcuni dipendenti. Poi, per dimostrare fin dove potevano arrivare, hanno modificato un file della documentazione interna e lo hanno firmato con il nome del gruppo. Subito dopo hanno segnalato le vulnerabilità a OpenAI e l’azienda ha corretto i problemi e ha riconosciuto ai ricercatori una ricompensa di 6.500 dollari nell’ambito del suo programma per la segnalazione delle falle di sicurezza.
I rischi dei nuovi strumenti digitali
Secondo il racconto degli sviluppatori, una versione precedente del modello di intelligenza artificiale non era riuscita a completare l’attacco, nonostante diversi tentativi, poche ore dopo l’uscita della versione più recente, l’attacco è riuscito in pieno. Uno di loro ha riassunto così la vicenda: «eravamo soltanto tre ragazzi con l’abbonamento a Claude e Codex». Questo in poche parole significa che strumenti fino a poco tempo fa inaccessibili possono oggi aiutare gruppi molto piccoli a svolgere attività estremamente complesse e pericolose. E se tre persone possono arrivare così lontano, viene naturale chiedersi cosa potrebbero fare organizzazioni molto più grandi, con più risorse e intenzioni meno innocue.
Il precedente dell’algoritmo di Google
Il caso non è isolato, perché anche Google ha confermato che a maggio, durante un test di sicurezza, il suo modello Gemini era riuscito ad accedere ai sistemi informatici di tre aziende reali. Il modello aveva raccolto informazioni disponibili pubblicamente e, combinandole, era riuscito a ricavare le credenziali necessarie per entrare. Il problema è che credeva che quei sistemi facessero ancora parte della simulazione prevista dal test; fortunatamente a un certo punto si è fermato autonomamente.
Le applicazioni nella ricerca biologica
La stessa tecnologia mostra però anche un volto completamente diverso: Anthropic ha confermato di aver allestito nella Bay Area un laboratorio di biologia in cui vengono eseguiti esperimenti reali e sta studiando come affidare a Claude parte del controllo dei robot utilizzati nei laboratori, pur sotto la supervisione umana. Anthropic ha anche reso pubblico il codice con cui Claude ha contribuito a migliorare una trentina di strumenti open source utilizzati dai biologi. In uno dei casi, secondo l’azienda, il modello avrebbe permesso di ridurre da circa 10mila dollari a 150 il costo necessario per progettare una proteina.
L’appello per controlli indipendenti
La verità è che i sistemi di intelligenza artificiale stanno diventando capaci di affrontare compiti sempre più complessi: possono aiutare i ricercatori a progettare nuove proteine e accelerare il lavoro nei laboratori, ma possono anche individuare falle informatiche e trovare il modo di entrare nei sistemi di un’azienda. La tecnologia, insomma, è la stessa. A cambiare sono gli obiettivi di chi la utilizza e le regole che vengono costruite intorno al suo impiego. È anche per questo che assume particolare importanza la lettera firmata in questi giorni da oltre cento esperti, tra cui Geoffrey Hinton. I firmatari chiedono che chi controlla la sicurezza dei modelli di intelligenza artificiale sia realmente indipendente dalle aziende che li sviluppano; chiedono inoltre che questi esperti possano avere un accesso ai sistemi simile a quello di un dipendente e siano protetti da eventuali ritorsioni. Del resto se un’azienda costruisce una tecnologia molto potente, non dovrebbe essere l’unica a stabilire quanto quella tecnologia sia sicura, serve che qualcuno risponda delle decisioni prese e dei limiti imposti a queste tecnologie.













