Ai Overview: Anthropic e OpenAI hanno lanciato in contemporanea i rispettivi nuovi modelli di intelligenza artificiale, Opus 5.5 e la serie GPT-6, in contrasto con gli appelli a un rallentamento dello sviluppo recentemente formulati dai vertici di entrambe le aziende. Le novità presentate sul mercato registrano una tendenza generale alla riduzione dei costi di utilizzo e un innalzamento dei parametri nei benchmark di settore. Sul fronte accademico, l’annuncio relativo alla potenziale risoluzione di equazioni matematiche complesse da parte dei sistemi di OpenAI ha generato un confronto aperto all’interno della comunità scientifica riguardo al reale significato della comprensione teorica rispetto al calcolo algoritmico. Nel frattempo, il tema della supervisione umana della tecnologia ha raggiunto il tavolo delle Nazioni Unite, evidenziando repentine divergenze geopolitiche tra i vari Stati.
I nuovi modelli presentati e i risultati nei benchmark
Martedì Anthropic e OpenAI, due delle principali aziende protagoniste della corsa all’intelligenza artificiale, hanno presentato i loro nuovi modelli a pochi minuti di distanza l’uno dall’altro, si tratta di Opus 5.5 e di GPT-6 Sol e GPT-6 Luna. Dieci giorni prima, però, i loro amministratori delegati, Dario Amodei e Sam Altman, avevano chiesto di rallentare lo sviluppo delle intelligenze artificiali più avanzate: evidentemente hanno cambiato idea. Claude Opus 5.5 sembra aver superato tutti, infatti, secondo Artificial Analysis, una società indipendente che mette alla prova i diversi sistemi di intelligenza artificiale con una serie di test, è al momento il modello più capace: ha ottenuto 58 punti, contro i 53 dei modelli top di gamma. Anthropic ha anche ridotto del 20 per cento il prezzo dei token rispetto alla versione precedente, un’ottima notizia, soprattutto per chi fa un uso intensivo tramite Api delle intelligenze artificiali di casa Anthropic. Secondo l’azienda, Claude Opus 5.5 scrive in modo più naturale e segue con più accuratezza le indicazioni di stile fornite dall’utente in fase di richiesta, ha ottenuto anche il miglior risultato mai registrato da Anthropic nei test di allineamento, cioè nelle prove che cercano di capire quanto il comportamento dell’intelligenza artificiale rispetti le intenzioni e le regole stabilite dagli esseri umani.
Il calo dei costi e le scoperte in ambito matematico
OpenAI, come già anticipato, ha risposto con GPT-6 Sol e GPT-6 Luna, due nuovi modelli che migliorano solo in parte le prestazioni delle versioni precedenti, però costano circa la metà. Insomma, pare proprio che i prezzi delle intelligenze artificiali siano destinati a scendere. Una degli aspetti più interessanti riguarda la matematica, perché OpenAI sostiene che un proprio modello interno, in addestramento dal 28 agosto, abbia trovato la soluzione a più di cento problemi matematici ancora aperti, tra i quali anche le equazioni di Navier-Stokes, che descrivono il movimento dei fluidi e sono al centro di uno dei sette Problemi del Millennio, tra le sfide matematiche più importanti ancora irrisolte. Per valutare risultati di questo tipo, OpenAI ha coinvolto nove matematici riuniti presso l’Institute for Advanced Study di Princeton, tra questi anche l’italiano Camillo De Lellis, legato al Gran Sasso Science Institute dell’Aquila. Questi scienziati avranno un ruolo consultivo: non saranno pagati da OpenAI e daranno indicazioni su come verificare i risultati prodotti dai sistemi e su come comunicarli all’esterno, non avranno alcun potere decisionale sul ritmo con cui l’azienda proverà a ottenere nuove soluzioni attraverso l’intelligenza artificiale.
Le reazioni della comunità scientifica
Il mondo della matematica non è unanime rispetto a questa novità, pochi giorni prima, infatti, più di venti vincitori della medaglia Fields, uno dei riconoscimenti più prestigiosi della disciplina, avevano firmato una dichiarazione critica nei confronti dei laboratori di intelligenza artificiale, dove si legge: «risolvere problemi è soltanto uno strumento e un indicatore per raggiungere l’obiettivo principale: la comprensione concettuale e l’intuizione». Il punto, in altre parole, è che trovare una risposta non significa necessariamente aver capito davvero il problema, ed è proprio questa distinzione a rendere più complicata la valutazione dei risultati matematici ottenuti dalle intelligenze artificiali.
Il dibattito sulla regolamentazione alle Nazioni Unite
La discussione sul controllo dell’intelligenza artificiale è arrivata intanto anche alle Nazioni Unite: a margine dell’Assemblea generale, venti Paesi e l’Unione europea hanno proposto la creazione di un organismo internazionale incaricato di fissare regole comuni e di mantenere l’intelligenza artificiale sotto «direzione, supervisione e controllo umani», però Stati Uniti e Cina non hanno aderito all’iniziativa. Questa iniziativa è già morta prima di iniziare?













