-
Lionel Messi en Argentine pour faire ses adieux à son père décédé
-
Le cancer de Joe Biden s'est aggravé, selon son fils
-
Colombie: deux attaques marquent le premier jour du président de la Espriella au pouvoir
-
MotoGP: "Confiant" et dominateur, Martin favori à Silverstone
-
Tour de France: Vollering domine Niewiadoma à Nice et endosse le maillot jaune
-
Retour timide des touristes au Porge, encore meurtri par le mégafeu
-
Zelensky avertit que l'hiver sera difficile pour l'Ukraine, 4 morts dans des frappes dans la région de Kiev
-
Que peut-on attendre du pacte de défense scellé par Ryad, Ankara et Islamabad?
-
Foot: le père et agent de Lionel Messi décède à l'âge de 68 ans
-
Hongrie : le "juge qui a dit non" à Orban choisi par le camp Magyar pour devenir président
-
Euro de natation: Léon Marchand forfait sur les 200 et 400 m quatre nages
-
Angleterre: le milieu brésilien Bruno Guimaraes rejoint Arsenal
-
Tour de France: la lauréate sortante Pauline Ferrand-Prévot abandonne avant la 8e étape
-
Violences sexuelles sur mineurs : le gouvernement se penche sur les défaillances des enquêtes
-
A Kiev, dernier adieu à un bénévole qui a consacré sa vie aux morts
-
Euro d'athlétisme: Duplantis, Werro, Jacobs, les stars à suivre à Birmingham
-
Violences sexuelles sur mineurs: un courrier de Darmanin pointe les défaillances des enquêtes
-
Le Sénat américain approuve la nomination de Todd Blanche comme ministre de la Justice
-
Zelensky en Serbie pour sa première visite chez cet allié de Moscou
-
Vin: une étude sur sept siècles montre les ravages du dérèglement climatique
-
En Hongrie, l'attente et le doute dans l'audiovisuel public après un mois sans JT
-
Début des vendanges en Bourgogne, un nouveau record de précocité
-
Plages désertes et "odeur insupportable": le Mexique lutte contre les sargasses
-
Pour les Afro-Américains de Memphis, voter pour exister dans un Etat à la carte électorale redessinée
-
Arrêter la guerre en Ukraine ? Le parti russe d'opposition Iabloko y croit
-
Lise Klaveness, l'anti-Infantino canal historique
-
Indemnité carburant pour "grands rouleurs": la date limite de dépôt reportée à fin août
-
"Je ne voulais pas me voir dans les miroirs": l'impact psychologique de la reconstruction mammaire
-
Amazon fait construire au Texas une immense centrale à gaz pour ses centres de données
-
Présidentielle: Gabriel Attal porte plainte, dénonçant une ingérence russe
IA : Mythos 5 d'Anthropic crée de fausses identités lors d'un test au Royaume-Uni
L'institut britannique de sécurité de l'IA (AISI) a dit avoir rencontré un "incident sérieux" lors d'une évaluation de routine au cours de laquelle Mythos 5 d'Anthropic a créé de fausses identités en ligne pour écrire à des développeurs afin de les convaincre d'intégrer du code malveillant.
Cette information, qui provient d'un rapport publié mardi par cet organisme qui dépend du gouvernement britannique, intervient après une série d'incidents aux Etats-Unis qui ont vu les modèles les plus puissants d'OpenAI (GPT-5.6 Sol) et d'Anthropic (Mythos 5) s'introduire sans autorisation chez d'autres entreprises.
Lors de l'évaluation britannique, menée avec un accès à internet ouvert et certains filtres de sécurité désactivés, des agents d'IA ont mené "des actions dirigées contre des personnes et des organisations réelles", explique l'AISI dans un compte rendu publié sur son site internet.
Les tentatives des modèles d'IA "n'ont pas abouti et nos investigations n'ont mis en évidence aucun dommage dans le monde réel", précise l'organisme.
"Mais c'est la première fois que nous voyons des risques liés à l'autonomie et à un comportement de dissimulation se manifester aussi clairement, sans sollicitation spécifique, dans le monde réel."
La semaine dernière, Anthropic avait déjà indiqué que ses modèles avaient "obtenu un accès non autorisé" à trois organisations lors de tests pourtant censés les empêcher d'accéder à des systèmes "réels".
Cette annonce était intervenue quelques jours seulement après que son rival OpenAI a révélé que deux de ses modèles étaient sortis, de leur propre initiative, du milieu confiné dans lequel ils étaient testés pour attaquer le site Hugging Face.
L'incident britannique, détecté et rapidement contenu le 28 juillet, a visé la plateforme destinée aux développeurs GitHub.
"Il a pour origine une seule évaluation, au cours de laquelle des agents se sont vu confier la tâche de résoudre un défi en cybersécurité", à plusieurs reprises, a précisé l'AISI.
Les incidents détectés l'ont été presque exclusivement avec Mythos 5 et, de façon plus marginale, avec GPT-5.6 Sol.
"Il ne s'agit pas d'un cas où un modèle se serait échappé de son environnement de test sécurisé" car "nous avions intentionnellement autorisé l’accès à internet" et désactivé des sécurités, "des conditions qui ne reflètent pas la manière dont les modèles de pointe sont mis à la disposition du public", insiste l'AISI.
Cet incident "met en évidence la nécessité d'un débat plus large sur la manière d'évaluer en toute sécurité des agents d'IA de plus en plus capables", a réagi Anthropic dans une déclaration transmise à l'AFP.
"Les tests indépendants sont essentiels pour comprendre le comportement de modèles de plus en plus performants", a pour sa part estimé OpenAI, disant vouloir travailler avec les différents acteurs du secteur "pour mener des évaluations en toute sécurité".
W.Morales--AT