-
Netanyahu, 'da Macron sbalorditiva dichiarazione grottesca'
-
Araghchi a Witkoff, 'Usa revochino blocco navale Usa e scongelino beni Iran'
-
Il cileno Kast critica l'Onu nel suo primo discorso al dibattito dell'Assemblea
-
Trump, 'Witkoff e Kushner hanno incontrato i mediatori iraniani'
-
Macron, 'a Gaza uno spettacolo che ci fa vergognare tutti'
-
Il petrolio chiude in calo a New York, a 94,97 dollari
-
Pirulli (Cisl), al tavolo con le imprese "complessità ma le stiamo affrontando"
-
Landini, al tavolo con le imprese 'la questione salariale è un punto fondamentale'
-
Trump rivela, 'colloqui tra responsabili iraniani e americani all'Onu'
-
Trump, favorevole ad un bando sull'export di diesel Usa
-
Bombardieri, a tavolo con le imprese nodo salari, confronto complesso ma si va avanti
-
In Liguria il terzo osservatorio italiano per il meteo spaziale
-
Anche Jennifer Lopez in Galleria a Milano per Vogue
-
Davide "Boosta" Dileo annuncia il nuovo album strumentalePianorama
-
Il Venezia conferma Stroppa nonostante le cinque sconfitte
-
Red Bull Cliff Diving, la finale 2026 a Polignano a Mare, tre in corsa per il titolo
-
Trump, 'l'Iran sta parlando con noi, anche oggi'
-
Napoli: lesione all'adduttore per Anguissa, fermo per 15 giorni
-
I matematici accusano OpenAI di 'comportamento predatorio'
-
Il prezzo del gas gira in rialzo a 74,04 euro al megawattora
-
Baci ed effusioni spinte allo show di Diesel
-
Mef, la domanda per il nuovo Btp Green ha superato i 110 miliardi
-
Dal visore alla tuta che monitora gli astronauti, progetti Politecnica Marche al Bex
-
Kiev, 'decisione Ue su Usmanov e Fridman vergognosa, Mosca festeggia'
-
Lo spread tra Btp e Bund chiude in lieve rialzo a 89 punti
-
Pirelli approva piano di investimenti negli Stati Uniti per circa 1 miliardo
-
Borsa: Milano chiude in calo, pesano banche e assicurazioni
-
Mondiali ciclismo: Longo Borghini, la mia prima maglia iridata è da brividi
-
Francesca Michielin torna con il nuovo singolo La mia ragazza
-
Codacons, anche con taglio accise gasolio +43% rispetto a un anno fa
-
Borsa: l'Europa chiude contrastata, si guarda sviluppi Usa-Iran
-
Colapesce Dimartino di nuovo insieme sul palco
-
Cop31, obiettivo elettrificazione del 35% dei consumi energetici al 2035
-
Marchesini (Confindustria): 'il confronto con i sindacati va avanti, sono temi complessi'
-
L'Avana, 'Cuba un Paese sovrano, da Trump solo calunnie'
-
Trump firma l'accordo di sicurezza con la Groelandia e la Danimarca
-
Eurovolley: c'è la Finlandia, l'Italia va a caccia della semifinale
-
Video di Sfera Ebbasta girato al Cenacolo di Leonardo, per Cgil 'un errore'
-
Trenitalia e Alstom presentano a InnoTrans nuovo Intercity 200
-
Ricostruiti gli antichi suoni emessi dagli insetti del Giurassico
-
Intesa in Ue sulle sanzioni, rinnovo per 3 anni e fuori Usmanov e Fridman
-
Mondiali ciclismo: Italia d'oro nel Team Relay a Montreal
-
Pasdaran, 'rifiutiamo qualsiasi contatto con gli Usa'
-
Trump, invierò subito massiccia presenza militare in Groenlandia, costruiremo 2 basi
-
Confidustria, 'il 2026 sorprende al rialzo ma frenata in vista'
-
Trump, 'Cuba è fallita, cadrà'. E la delegazione de L'Avana lascia l'aula dell'Onu
-
Mef, emessi 8 miliardi di euro del nuovo Btp green
-
Eurovolley: 3-0 alla Romania, Francia in semifinale
-
Trump, 'sono convinto che l'Iran farà l'accordo dopo le midterm'
-
Wsj, 'Trump ha valutato di allontanare tutta la stampa dalla Casa Bianca'
L'IA battuta dagli umani in un difficile test di matematica
Messi alla prova 4 modelli tra cui ChatGpt, il risultato migliore è stato 6 quesiti su 10
L'Intelligenza Artificiale è stata battuta dagli esseri umani nel più difficile e rigoroso test di matematica al quale è stata sottoposta finora: sono stati messi alla prova quattro diversi modelli, tra cui ChatGpt 5.5 Pro, e nessuno di loro è riuscito a rispondere correttamente a tutti e 10 i quesiti. Il risultato migliore, come riporta la rivista Nature sul suo sito, lo ha ottenuto il modello del Politecnico Federale di Zurigo (Eth), che ha risolto 6 problemi su 10. ChatGpt di OpenAI è arrivato terzo dietro il modello dell'Università della California a Los Angeles, mentre si è classificato ultimo quello dell'Università di Princeton, che a differenza degli altri si basava su Gemini di Google. Il test fa parte di First Proof, il progetto indipendente promosso per seguire l'evoluzione delle capacità dell'intelligenza artificiale nella ricerca matematica, che pubblica i risultati sul suo sito. Le domande poste nell'esame non erano mai state pubblicate prima né nella letteratura scientifica né su Internet, per ridurre il rischio che i modelli si limitassero a ripetere informazioni apprese durante l'addestramento. Un gruppo di 30 matematici ha poi verificato le risposte. Un'altra regola prevedeva che i modelli partecipanti dovessero essere disponibili al grande pubblico e questo ha fatto sì che OpenAI sia stata l'unica grande azienda a prendere parte al test. Due degli altri tre modelli partecipanti si basavano comunque su ChatGpt, grazie a sistemi automatici nei quali le risposte date da questo modello linguistico vengono controllate e migliorate da altri chatbot, spesso con ripetuti scambi di messaggi. Il gruppo dell'Eth ha anche condotto un'indagine preliminare per capire perché alcuni problemi non sono stati risolti da nessuno dei concorrenti. In alcuni casi sembra che ai modelli mancasse un'intuizione cruciale che avrebbe permesso di arrivare alla soluzione finale, mentre in altri l'approccio di base era corretto, ma i sistemi non sono riusciti cogliere tutti i dettagli.
B.Torres--AT