-
Les Russes aux urnes pour le dernier jour des législatives
-
Moyen-Orient: Washington craint "une escalade rapide" après une attaque sur Ryad
-
Polémique autour de Gaza: sur scène, Ed Sheeran reconnaît "des erreurs"
-
Saint-Pierre-et-Miquelon est "français" répond Macron à Trump à son arrivée dans l'archipel
-
Coupe Davis: le Canada élimine la France
-
Le Danemark soulagé par l'accord sur le Groenland, après les menaces d'annexion de Trump
-
Ligue 1: en démonstration, Lyon éparpille Rennes
-
L'Arabie saoudite dit avoir intercepté un missile tiré par les Houthis vers Ryad
-
Un "front du refus" inédit mobilisé à Arles contre une ligne aérienne THT
-
Women XV Global Series: les Bleues victorieuses des Australiennes au bout d'un scénario fou
-
Les Houthis du Yémen revendiquent une attaque dans la capitale saoudienne
-
Le RN hausse le ton face à la Russie mais est accusé de "double discours"
-
Fumée noire près de l'aéroport de Ryad après des explosions, selon des habitants
-
Angleterre: naufrage d'Arsenal, parfum de crise à Tottenham
-
Top 14: Lyon seul en tête, le Racing 92 se réveille
-
Ebola en RDC: lancement de l'essai clinique du vaccin Ervebo en Ituri
-
Catherine Ringer inhumée à Paris aux côtés de Fred Chichin
-
Des journalistes de CNN et d'autres médias empêchés d'accéder à la Maison Blanche
-
Charles Sapin ne sera plus sur France Inter pour son édito contesté
-
MotoGP: Martin tape du poing sur la table
-
Meurtres de femmes en Afrique du Sud: des habitants se mobilisent pour dire "ça suffit!"
-
Jeux asiatiques: "Profondes excuses" des organisateurs pour avoir joué le mauvais hymne
-
Rugby: le Japon remporte la Coupe des nations du Pacifique face aux Fidji
-
Flammes et fumée noire visibles près de l'aéroport de Ryad, selon des habitants
-
Angleterre: Aston Villa gagne enfin et enfonce Tottenham (3-2), relégable
-
Trump promulgue une loi imposant de nouvelles sanctions contre la Russie
-
Charles Sapin annonce la "suppression" de son édito par France Inter
-
Accord sur le Groenland : Trump crie victoire, les Danois aussi
-
Budget: la dette publique de la France grimpera jusqu'à 121,7% du PIB en 2027, un record
-
Foot: Sandro Mazzola, une carrière entière à l'Inter
-
Russie: "puissantes" cyberattaques au deuxième jour des élections législatives
-
Incendies en Indonésie: la Malaisie envoie des pompiers et des moyens aériens
-
MotoGP: Martin décroche la pole position en Autriche devant Marc Marquez
-
Le Danemark salue l'accord "contraignant" avec Trump sur le Groenland
-
Amazon renonce à la livraison gratuite de livres neufs dans ses casiers automatiques en France
-
L'IA de Google a perpétré des cyberattaques et deviné des identifiants
-
"Pas touche au Kennedy Center": à Washington, une chaîne humaine face aux assauts de Trump
-
Equateur: des hélicos bombardiers d'eau pour éteindre un feu de forêt à Quito
-
Au Texas, des éleveurs déçus par Trump sur la question du boeuf importé
-
Les concerts de Céline Dion, un jackpot qui ne ruisselle pas, déplore la filière musicale
-
Compagnon artificiel, robot stimulateur... L’IA, au chevet des malades d’Alzheimer
-
Coupe Davis: le Canada mène 2-0 d'entrée contre la France
-
La visite du pape dans un lieu d'accueil d'exilés: un "message" avant la présidentielle en France
-
Mondiaux de cyclisme: Remco Evenepoel pour l'histoire
-
Derrière "Lofi Girl", un entrepreneur français et un phénomène mondial sur YouTube
-
Déplacer le village de Miquelon: pas un modèle mais des leçons à tirer, selon une géographe
-
Pakistan: au moins 31 morts dans l'attaque d'un quartier général de police
Anthropic révèle que son IA a accédé sans autorisation aux systèmes d'autres organisations
La start-up américaine d'intelligence artificielle (IA) Anthropic a affirmé jeudi dans un communiqué que ses modèles avaient "obtenu un accès non autorisé" à trois organisations lors de tests pourtant censés les empêcher d'accéder à des systèmes "réels".
Cette annonce intervient quelques jours seulement après que son rival OpenAI a révélé que deux de ses modèles étaient sortis, de leur propre initiative, du milieu confiné dans lequel ils étaient testés pour attaquer le site Hugging Face.
Anthropic a analysé plus de 141.000 tests et a constaté que trois versions différentes de son modèle Claude avaient accédé aux systèmes de trois organisations, dont les noms n'ont pas été divulgués.
Contrairement à l'incident impliquant OpenAI, les modèles d'Anthropic ont eu accès à Internet "en raison d'un malentendu entre nous et notre partenaire d'évaluation", Irregular, a expliqué le groupe dans le communiqué.
Néanmoins, Claude a eu recours à "des techniques élémentaires, telles que l'exploitation de mots de passe faibles et de points de terminaison non authentifiés", a-t-il poursuivi.
L'ancien modèle "a poursuivi son attaque même après avoir obtenu la preuve qu'il s'exécutait sur l'Internet public" alors que le modèle le plus récent s'est arrêté, selon Anthropic.
"Dans aucune de ces situations, Claude ne s'est échappé ni n'a délibérément tenté de s'échapper de son environnement de test", a-t-il ajouté.
Parmi les modèles concernés figurait l'un de ses plus puissants, Mythos 5, qui n'a été mis à disposition que d'un nombre limité de partenaires.
Anthropic travaille actuellement avec Irregular pour examiner la situation et a contacté ou tenté de contacter les trois organisations concernées.
Concurrent d'Anthropic, OpenAI (créateur de ChatGPT) avait annoncé la semaine passée que ses modèles d'IA avancés s'étaient emballés lors de tests de sécurité, piratant de leur propre initiative Hugging Face, une bibliothèque de code en ligne.
Quelques jours plus tard, le groupe avait déclaré avoir découvert des incidents supplémentaires.
Le patron d'OpenAI, Sam Altman, a révélé dans un podcast mis en ligne cette semaine qu'après avoir eu connaissance de l'attaque, l'entreprise avait suspendu ses tests "pour comprendre comment réussir à confiner notre espace" dédié, censé être isolé d'internet.
- Pétition -
Cet incident a également donné lieu à une pétition signée par plus d'un millier d'employés d'entreprises à la pointe de l'IA, appelant le gouvernement américain à contribuer à ralentir le déploiement des modèles d’IA les plus avancés.
Intitulée "Pacing the Frontier", cette pétition demande "que le gouvernement américain soutienne une initiative internationale visant à mettre au point les outils techniques et de gouvernance nécessaires pour réguler de manière réfléchie les limites du développement de l'IA automatisée".
Dario Amodei, patron d'Anthropic, figure parmi les signataires.
Bien qu'il n'ait pas signé, Sam Altman a reconnu que "nous pourrions devoir ralentir la cadence de développement de l'IA pour donner suffisamment de temps à la société pour faire face à ses nouvelles capacités".
L’administration Trump a invoqué cette année des préoccupations de sécurité nationale pour empêcher OpenAI et Anthropic de lancer leurs modèles les plus récents, mais a finalement indiqué qu’elle était satisfaite des garanties apportées quant à leur sûreté, ce qui a conduit à leur mise sur le marché.
En juin, Trump a signé un décret créant un cadre volontaire en vertu duquel les développeurs d’IA partageront leurs modèles avancés avec le gouvernement avant leur mise à disposition du public.
Dans le cadre de ce dispositif, des développeurs tels qu’OpenAI, Anthropic et Google donneraient au gouvernement accès à leurs modèles les plus puissants jusqu’à 30 jours avant leur sortie prévue.
T.Wright--AT