-
Coupe Davis: le Canada élimine la France
-
Le Danemark soulagé par l'accord sur le Groenland, après les menaces d'annexion de Trump
-
Ligue 1: en démonstration, Lyon éparpille Rennes
-
L'Arabie saoudite dit avoir intercepté un missile tiré par les Houthis vers Ryad
-
Un "front du refus" inédit mobilisé à Arles contre une ligne aérienne THT
-
Women XV Global Series: les Bleues victorieuses des Australiennes au bout d'un scénario fou
-
Les Houthis du Yémen revendiquent une attaque dans la capitale saoudienne
-
Le RN hausse le ton face à la Russie mais est accusé de "double discours"
-
Fumée noire près de l'aéroport de Ryad après des explosions, selon des habitants
-
Angleterre: naufrage d'Arsenal, parfum de crise à Tottenham
-
Top 14: Lyon seul en tête, le Racing 92 se réveille
-
Ebola en RDC: lancement de l'essai clinique du vaccin Ervebo en Ituri
-
Catherine Ringer inhumée à Paris aux côtés de Fred Chichin
-
Des journalistes de CNN et d'autres médias empêchés d'accéder à la Maison Blanche
-
Charles Sapin ne sera plus sur France Inter pour son édito contesté
-
MotoGP: Martin tape du poing sur la table
-
Meurtres de femmes en Afrique du Sud: des habitants se mobilisent pour dire "ça suffit!"
-
Jeux asiatiques: "Profondes excuses" des organisateurs pour avoir joué le mauvais hymne
-
Rugby: le Japon remporte la Coupe des nations du Pacifique face aux Fidji
-
Flammes et fumée noire visibles près de l'aéroport de Ryad, selon des habitants
-
Angleterre: Aston Villa gagne enfin et enfonce Tottenham (3-2), relégable
-
Trump promulgue une loi imposant de nouvelles sanctions contre la Russie
-
Charles Sapin annonce la "suppression" de son édito par France Inter
-
Accord sur le Groenland : Trump crie victoire, les Danois aussi
-
Budget: la dette publique de la France grimpera jusqu'à 121,7% du PIB en 2027, un record
-
Foot: Sandro Mazzola, une carrière entière à l'Inter
-
Russie: "puissantes" cyberattaques au deuxième jour des élections législatives
-
Incendies en Indonésie: la Malaisie envoie des pompiers et des moyens aériens
-
MotoGP: Martin décroche la pole position en Autriche devant Marc Marquez
-
Le Danemark salue l'accord "contraignant" avec Trump sur le Groenland
-
Amazon renonce à la livraison gratuite de livres neufs dans ses casiers automatiques en France
-
L'IA de Google a perpétré des cyberattaques et deviné des identifiants
-
"Pas touche au Kennedy Center": à Washington, une chaîne humaine face aux assauts de Trump
-
Equateur: des hélicos bombardiers d'eau pour éteindre un feu de forêt à Quito
-
Au Texas, des éleveurs déçus par Trump sur la question du boeuf importé
-
Les concerts de Céline Dion, un jackpot qui ne ruisselle pas, déplore la filière musicale
-
Compagnon artificiel, robot stimulateur... L’IA, au chevet des malades d’Alzheimer
-
Coupe Davis: le Canada mène 2-0 d'entrée contre la France
-
La visite du pape dans un lieu d'accueil d'exilés: un "message" avant la présidentielle en France
-
Mondiaux de cyclisme: Remco Evenepoel pour l'histoire
-
Derrière "Lofi Girl", un entrepreneur français et un phénomène mondial sur YouTube
-
Déplacer le village de Miquelon: pas un modèle mais des leçons à tirer, selon une géographe
-
Pakistan: au moins 31 morts dans l'attaque d'un quartier général de police
-
Rush à Pékin pour revendre son drone avant l'interdiction totale
-
Paris appelle Moscou à "revenir" sur sa prise de contrôle d'entreprises françaises
Face aux performances en piratage de sa future IA, OpenAI en ralentit le développement
OpenAI, créateur de ChatGPT, a confirmé mardi ralentir le développement de son modèle d'intelligence artificielle le plus avancé et durcir ses contrôles internes, un mois après avoir révélé la cyberattaque menée de façon autonome par un de ses outils contre la plateforme Hugging Face.
Le plus gros entraînement d'IA jamais programmé par l'entreprise reste à l'arrêt, le temps de vérifier que cette future IA se comporte comme prévu, a indiqué OpenAI dans un billet de blog mardi.
"Nous avons toujours dit que nous agirions si nous estimions que les capacités des modèles progressaient plus vite que la sécurité", a écrit sur X le patron d'OpenAI, Sam Altman.
Cette décision "affecte les sorties plus lointaines" de modèles, a-t-il ajouté, tout en promettant de nouveaux modèles "prochainement".
Mi-juillet, un agent autonome reposant sur deux modèles d'OpenAI était sorti, de sa propre initiative, de son milieu de test confiné pour s'aventurer sur Internet et attaquer Hugging Face, plateforme où les développeurs du monde entier partagent leurs modèles d'IA.
Son concurrent Anthropic a révélé fin juillet que trois de ses modèles en test avaient aussi opéré des intrusions non autorisées dans les systèmes informatiques de trois organisations.
Ces incidents ont donné lieu à une pétition de plus d'un millier d'employés du secteur appelant le gouvernement américain à soutenir un ralentissement concerté du développement des IA les plus avancées.
OpenAI avait par ailleurs interrompu pendant deux semaines l'entraînement par renforcement de plusieurs modèles — où ceux-ci progressent seuls, par essais et erreurs, guidés par des récompenses — avant de le reprendre avec des contrôles renforcés.
De nombreux travaux liés à Astra, son prochain grand modèle, restent en revanche suspendus: l'entreprise a estimé début août que cette IA pourrait devenir capable de mener seule des cyberattaques sophistiquées, le niveau de risque le plus élevé de sa propre grille d'évaluation. Ses règles internes l'obligent alors à renforcer ses garde-fous avant de poursuivre le développement.
Elle n'a pas précisé de calendrier de reprise.
Le groupe a aussi détaillé mardi un nouveau dispositif, qui surveille le raisonnement interne de ses modèles en cours de développement et doit alerter des équipes humaines en moins de 30 minutes en cas de comportement suspect. Un contrôle qui consomme toutefois environ 20% de puissance de calcul supplémentaire.
Les propres recherches d'OpenAI, en 2025, ont montré les limites de cette approche: un modèle qui se sait surveillé peut apprendre à masquer ses intentions dans son raisonnement.
L'entreprise, qui promet depuis juillet un compte rendu technique détaillé de l'incident Hugging Face, ne l'a pas encore publié. Son billet de mardi l'annonce "dans les semaines à venir".
P.Smith--AT