-
TikTok patteggia in Alabama le accuse di creare dipendenza nei giovani
-
Eurolega: Partizan-Armani Milano 92-76
-
Nations League: Turchia-Francia 0-1, buona la prima per Zidane
-
Mancini "fischi ci stanno ma nel secondo tempo meglio noi"
-
Nations League: l'Italia parte male, il Belgio vince 2-0
-
Eleventy festeggia 20 anni alla Milano Fashion Week
-
L'ingenue di Blumarine tra la spiaggia e il boudoir
-
Simon Cracker, una collezione-inno al 'do it yourself'
-
Figc: Buonfiglio 'sostegno componenti a Malagò? Il mondo sportivo si basa su regole'
-
Nations League: Italia-Belgio, azzurri con Kean, Esposito e Cambiaghi
-
L'estate di Luisa Spagnoli sboccia in un giardino all'italiana
-
Putin, 'eravamo pronti a riprendere i negoziati ma dopo raid ucraini ci rifletteremo'
-
Trump conferma i due incontri con Xi, in Cina per l'Apec e negli Usa per il G20
-
Eurovolley: 3-0 alla Slovenia, Polonia prima finalista
-
La collezione Sportmax ispirata alle ondate di caldo
-
Malanga, le donne registe ci sono ma dovrebbero essere di più
-
Serie A: definiti anticipi e posticipi dalla 13/a alla 19/a giornata
-
Cinema di montagna, in Abruzzo un laboratorio per giovani talenti
-
Gli U2 festeggiano il 50/o anniversario con un live alla Mount Temple di Dublino
-
Danieli, ricavi (-9%) ma utili (+5%) e Posizione finanziaria (+48%)
-
Media, tolto il divieto di ingresso per Machado in Venezuela
-
Castagna, 'offerta di Mps purtroppo è a sconto e non a premio'
-
Torna la Festa del cinema di Roma, da Jenna Ortega a Jovanotti
-
Hit parade, 22simba debutta al primo posto con l'album Miria
-
I futures su gas in frenata, Ttf -4,2%
-
Figc: Calcagno 'sostegno a Malagò, è situazione paradossale'
-
Natalie Harp si confessa col Washingtonian, 'l'età è solo un numero'
-
Ft, gli Houthi promettono di non prendere di mira le navi europee
-
Xi a Trump, 'presto altre due occasioni per vederci, all'Apec e al G20'
-
Borsa: Milano chiude in rialzo (+0,63%), Tim inciampa sul finale
-
Media Gb, 'City colpevole di quasi tutte le 115 infrazioni finanziarie'
-
Figc: Ulivieri 'nostro sostegno totale a Malagò'
-
Goggia 'sono in miglioramento, ma molto debilitata e serve tanta pazienza'
-
Usa, 'nostra posizione su Taiwan non è cambiata, vogliamo la pace nello Stretto'
-
Lugansky e i Concerti per pianoforte di Rachmaninoff, gran finale a Santa Cecilia
-
Premier Libano, 'nostro futuro non sarà deciso da altri, Israele si ritiri'
-
Filorussi, 2 morti e 5 feriti in raid ucraini su 2 mercati di Horlivka nel Donetsk
-
Araghchi vede Lavrov, 'discussi sviluppi sul negoziato e accordo Hormuz con Oman'
-
Ex alleata di Trump, 'ci ha tradito, il movimento Maga è morto'
-
Allerta maltempo per 40 milioni di americani, venti e piogge da New York a Boston
-
Von der Leyen, 'con l'intesa sui 6,6 miliardi dell'Epf aumenta il sostegno a Kiev'
-
Eni, tetto di 2,19 euro al prezzo del gasolio, 1,99 per la benzina
-
Federalimentare, nell'industria alimentare dal 2016 occupazione +22%
-
Non oggi, un corto con regia e partecipazione di Sergio Castellitto a Festa di Roma
-
Usa, 'Trump ha detto a Xi che l'aiuto della Cina all'Iran è inaccettabile'
-
Da stop al fumo a meno sale, le 5 regole per la salute del cuore
-
Ue fissa a 2 euro la commissione di gestione sui pacchi extra-Ue
-
Cremlino, 'licenza missili Patriot a Kiev? Zelensky dice molte cose, monitoriamo'
-
Accordo per l'integrativo Ferrero, welfare, investimenti e premio fino a 3.100 euro
-
Ortega, Huller, Moore, Watts, Kardashian, Eisenberg alla Festa del Cinema di Roma
L'IA battuta dagli umani in un difficile test di matematica
Messi alla prova 4 modelli tra cui ChatGpt, il risultato migliore è stato 6 quesiti su 10
L'Intelligenza Artificiale è stata battuta dagli esseri umani nel più difficile e rigoroso test di matematica al quale è stata sottoposta finora: sono stati messi alla prova quattro diversi modelli, tra cui ChatGpt 5.5 Pro, e nessuno di loro è riuscito a rispondere correttamente a tutti e 10 i quesiti. Il risultato migliore, come riporta la rivista Nature sul suo sito, lo ha ottenuto il modello del Politecnico Federale di Zurigo (Eth), che ha risolto 6 problemi su 10. ChatGpt di OpenAI è arrivato terzo dietro il modello dell'Università della California a Los Angeles, mentre si è classificato ultimo quello dell'Università di Princeton, che a differenza degli altri si basava su Gemini di Google. Il test fa parte di First Proof, il progetto indipendente promosso per seguire l'evoluzione delle capacità dell'intelligenza artificiale nella ricerca matematica, che pubblica i risultati sul suo sito. Le domande poste nell'esame non erano mai state pubblicate prima né nella letteratura scientifica né su Internet, per ridurre il rischio che i modelli si limitassero a ripetere informazioni apprese durante l'addestramento. Un gruppo di 30 matematici ha poi verificato le risposte. Un'altra regola prevedeva che i modelli partecipanti dovessero essere disponibili al grande pubblico e questo ha fatto sì che OpenAI sia stata l'unica grande azienda a prendere parte al test. Due degli altri tre modelli partecipanti si basavano comunque su ChatGpt, grazie a sistemi automatici nei quali le risposte date da questo modello linguistico vengono controllate e migliorate da altri chatbot, spesso con ripetuti scambi di messaggi. Il gruppo dell'Eth ha anche condotto un'indagine preliminare per capire perché alcuni problemi non sono stati risolti da nessuno dei concorrenti. In alcuni casi sembra che ai modelli mancasse un'intuizione cruciale che avrebbe permesso di arrivare alla soluzione finale, mentre in altri l'approccio di base era corretto, ma i sistemi non sono riusciti cogliere tutti i dettagli.
T.Sanchez--AT