-
L'Italia migliora l'osservazione della Terra con il nuovo satellite Prisma
-
La svizzera Gut-Behrami annuncia il ritiro
-
Masters 1000 di Montreal, Musetti vola al terzo turno
-
Tornano gli incontri della Fondazione Rossini sulle opere in programma al Rof 2026
-
Axios, 'colloqui Israele-Libano a Roma interrotti per gli eventi sul terreno'
-
Lo spread tra Btp e Bund chiude a 77,1 punti
-
Gas in netto calo, future scendono a 53,32 euro
-
Europeo tuffi: Pellacani, carica per la quinta gara
-
Parto 'assistito' già nel Neolitico, lo rivela uno studio di Unitrento
-
Sogin, 'il Parlamento amplia il perimetro delle nostre attività'
-
Pizzaballa, 'le elezioni in Israele diano nuove leadership'
-
Flavio Bolsonaro annuncia il suo vice alle presidenziali di ottobre
-
Iran, 'raggiunto l'accordo con l'Oman sullo Stretto di Hormuz'
-
Abdul El-Sayed ai dem, 'in casa si discute ma fuori serve unità'
-
Calcio: Chivu, 'i risultati ora non contano ma vedo una crescita nell'Inter'
-
Torna il canto delle balene al largo della Sicilia
-
Roberto Cacciapaglia, prossime date a Bari, Ostuni e Grezzana
-
Montenegro, 'nessun hub Ue per i rimpatri sul nostro territorio'
-
Atletica: Mei 'per i Mondiali preferenza al 2029, ma ci siamo anche per il 2031'
-
Cna, Confartigianato e Conpait chiedono una Dop per il "gelato di tradizione italiana"
-
Attacco a Londra fatto a colpi di forbici, per polizia è raptus di follia
-
Cnn, Abdul El-Sayed ha vinto la candidatura dem in Michigan
-
Kiev ordina l'evacuazione di Kramatorsk per i raid russi
-
Trump attacca le primarie dem in Michigan, 'elezioni truccate'
-
Volantinaggio dei lavoratori Superjet senza stipendio davanti a Leonardo
-
4 persone accoltellate nel centro di Londra, arrestata una donna
-
Calcio: Amorim, derby buon test ma Milan deve migliorare nel possesso
-
Spider-Man vola oltre il miliardo di dollari globali
-
Calcio: Fiorentina, arriva Franco Mastantuono in prestito dal Real Madrid
-
SpaceX crolla di oltre il 12% al Nasdaq sul boom della spesa per l'IA
-
Trovate in Amazzonia oltre 400 antiche strutture precolombiane
-
Calcio: finisce in parità il primo derby milanese, a Perth 1-1 tra Milan e Inter
-
Wall Street apre positiva su nuovi record, Dj a +0,79% e Nasdaq a +0,44%
-
Calcio: la Juve batte il Chelsea 1-0, super gol di Zhegrova
-
Inps, trattenuta su pensione agosto collegata ai redditi per 50mila pensionati
-
Europei nuoto: Taddeucci oro nella 5 km donne, Pozzobon bronzo
-
Poligrafico e Poste perfezionano l'acquisizione di PagoPa per massimo 500 milioni
-
Fibercoop e Invitalia, sottoscritte convenzioni, fibra ottica per 477mila civici
-
In Sudafrica si dibatte sul destino degli ultimi tre elefanti ospitati in uno zoo
-
Conto alla rovescia per Timeless, l'album di inediti di Prince
-
Il petrolio apre in rialzo a New York ma sotto 80 dollari (a 76,21 dollari)
-
In Marocco 25 incriminati per il traffico di migranti verso Ceuta
-
Lucca film festival, premio alla carriera a Liliana Cavani
-
Weekend Cinema, in sala un tris tra thriller, favola ed horror
-
In Veneto via all'iter per sospendere i blocco dei diesel Euro 5
-
Regione Puglia sosterrà le produzioni cinematografiche con 5,75 milioni
-
Media, a Taiwan esercitazioni per testare capacità di reazione dei comandanti
-
Il Mestiere, 'Lo Cascio antieroe nel lavoro più strano del mondo'
-
Il cervello femminile è più plastico, i test al risveglio dall'anestesia
-
Il gas scivola (-3%) a 54 euro al Megawattora, piatto il petrolio
L'IA battuta dagli umani in un difficile test di matematica
Messi alla prova 4 modelli tra cui ChatGpt, il risultato migliore è stato 6 quesiti su 10
L'Intelligenza Artificiale è stata battuta dagli esseri umani nel più difficile e rigoroso test di matematica al quale è stata sottoposta finora: sono stati messi alla prova quattro diversi modelli, tra cui ChatGpt 5.5 Pro, e nessuno di loro è riuscito a rispondere correttamente a tutti e 10 i quesiti. Il risultato migliore, come riporta la rivista Nature sul suo sito, lo ha ottenuto il modello del Politecnico Federale di Zurigo (Eth), che ha risolto 6 problemi su 10. ChatGpt di OpenAI è arrivato terzo dietro il modello dell'Università della California a Los Angeles, mentre si è classificato ultimo quello dell'Università di Princeton, che a differenza degli altri si basava su Gemini di Google. Il test fa parte di First Proof, il progetto indipendente promosso per seguire l'evoluzione delle capacità dell'intelligenza artificiale nella ricerca matematica, che pubblica i risultati sul suo sito. Le domande poste nell'esame non erano mai state pubblicate prima né nella letteratura scientifica né su Internet, per ridurre il rischio che i modelli si limitassero a ripetere informazioni apprese durante l'addestramento. Un gruppo di 30 matematici ha poi verificato le risposte. Un'altra regola prevedeva che i modelli partecipanti dovessero essere disponibili al grande pubblico e questo ha fatto sì che OpenAI sia stata l'unica grande azienda a prendere parte al test. Due degli altri tre modelli partecipanti si basavano comunque su ChatGpt, grazie a sistemi automatici nei quali le risposte date da questo modello linguistico vengono controllate e migliorate da altri chatbot, spesso con ripetuti scambi di messaggi. Il gruppo dell'Eth ha anche condotto un'indagine preliminare per capire perché alcuni problemi non sono stati risolti da nessuno dei concorrenti. In alcuni casi sembra che ai modelli mancasse un'intuizione cruciale che avrebbe permesso di arrivare alla soluzione finale, mentre in altri l'approccio di base era corretto, ma i sistemi non sono riusciti cogliere tutti i dettagli.
B.Torres--AT