-
Monique Barbut remet son plan pour accélérer l'adaptation au changement climatique
-
Fin de la mission en Irak de la coalition antijihadiste dirigée par les Etats-Unis
-
Boeing va fabriquer le futur avion de combat de l'US Navy, et celui de l'Air Force
-
La Cour suprême américaine lève de nouveau des limites aux expulsions d'immigrés vers des pays tiers
-
Explosions dans la DMZ : Séoul exige des excuses, Pyongyang nie toute implication
-
Infections et cancers : des liaisons parfois dangereuses, souvent évitables
-
Milei en France en promoteur d'une Argentine ouverte aux affaires, mais qui patine
-
Mediapart dénonce la "violence sidérante" du RN après ses révélations sur Bardella
-
Ligue des nations: l'Angleterre gagne en République tchèque grâce au duo Gordon-Kane
-
Concurrence dans Android et la recherche en ligne: Google attaque des décisions de Bruxelles
-
Une ONG attaque OpenAI pour infraction à la loi sur les cyberattaques après l'incident Hugging Face
-
Ligue des nations: l'Espagne réussit son retour à la maison, Lamine Yamal inarrêtable
-
Sous l'oeil de Trump, les patrons de l'IA promettent de s'auto-réguler
-
Wall Street clôture en baisse, les taux touchent des sommets
-
Club Dorothée et Les Guignols favoris des téléspectateurs sur les 40 dernières années, selon un sondage
-
ONU: le Conseil de sécurité prolonge de six mois la force contre les gangs en Haïti
-
Angélique Kidjo exhorte les Africains à "créer ensemble"
-
Poussée de tension entre BFMTV, des lycéens et le maire de Saint-Denis
-
Trump plaide pour "l'auto-régulation" en recevant les grands patrons de l'IA
-
Espagne : face à la colère sociale, le gouvernement s'attaque à la crise du logement
-
Le Pacifique mexicain résiste au passage de l'ouragan Polo
-
En Espagne, Macron livre ses recettes contre la montée des "extrêmes" en Europe
-
Alerte près d'une base militaire en Angleterre: de l'essence mais aucun explosif retrouvé
-
Trump réunit les grands noms de l'IA à la Maison Blanche
-
Nombre de maternités: la mission "périnatalité" critique un modèle "insoutenable"
-
Foot: nouvelle passe d'armes entre l'UEFA et la Fifa
-
Foot: Manchester City reconnu "coupable" de "graves" infractions financières de 2009 à 2018 par la Premier League
-
Accusé d'antisémitisme, Bardella dénonce "une guerre totale" contre le RN, Mediapart fustige "la violence sidérante de l'extrême droite"
-
Birmanie : 50 morts sur un marché bombardé par l'armée, selon des sources humanitaires
-
Energie: l'Union européenne s'attend à un hiver difficile, avec des prix très élevés
-
La Bourse de Paris lestée par les incertitudes budgétaires, le taux français dépasse 4,80%
-
A Liverpool, Andy Burnham défend un réengagement de l'Etat et se projette au-delà de 2029
-
Les Bourses européennes terminent sans enthousiasme
-
Trump reçoit les patrons de l'IA à la Maison Blanche mardi
-
Thélyson Orélien, l'étoile fuyante
-
L'Iran menace de nouvelles frappes, dans l'attente d'une réponse américaine à son plan pour Ormuz
-
Allemagne: le Rhin à un niveau historiquement bas face à une sécheresse persistante
-
Slovaquie: une enseignante tuée et deux blessés dans une attaque au couteau dans une école
-
Macron en visite d'État en Espagne pour pousser une "Europe plus forte"
-
Allemagne: la plus haute éolienne du monde a atteint sa hauteur finale, à 365 mètres
-
"Ras-le-bol des bas salaires": la fonction publique dans la rue pour son pouvoir d'achat
-
Wall Street ouvre sans direction claire, surveille le pétrole et les taux
-
Equipe de France: l'état de grâce de Zidane
-
Slovaquie: une enseignante tuée et deux blessées dans une attaque au couteau dans une école
-
Cisjordanie: une violente attaque sur un village suscite de rares condamnations par Israël
-
Accusations d'antisémitisme : Bardella dénonce "une guerre totale" contre le RN, première crise pour la campagne Le Pen
-
Au Cameroun, les féminicides se multiplient, les familles réclament justice
-
A Liverpool, le Labour remobilisé derrière Andy Burnham mais attend des réponses
-
La Malaisie commence à renvoyer des ressortissants birmans, inquiétude de l'ONU
-
Budget : enquête ouverte après un signalement de Lecornu sur des fuites dans la presse
IA : Mythos 5 d'Anthropic crée de fausses identités lors d'un test au Royaume-Uni
L'institut britannique de sécurité de l'IA (AISI) a dit avoir rencontré un "incident sérieux" lors d'une évaluation de routine au cours de laquelle Mythos 5 d'Anthropic a créé de fausses identités en ligne pour écrire à des développeurs afin de les convaincre d'intégrer du code malveillant.
Cette information, qui provient d'un rapport publié mardi par cet organisme qui dépend du gouvernement britannique, intervient après une série d'incidents aux Etats-Unis qui ont vu les modèles les plus puissants d'OpenAI (GPT-5.6 Sol) et d'Anthropic (Mythos 5) s'introduire sans autorisation chez d'autres entreprises.
Lors de l'évaluation britannique, menée avec un accès à internet ouvert et certains filtres de sécurité désactivés, des agents d'IA ont mené "des actions dirigées contre des personnes et des organisations réelles", explique l'AISI dans un compte rendu publié sur son site internet.
Les tentatives des modèles d'IA "n'ont pas abouti et nos investigations n'ont mis en évidence aucun dommage dans le monde réel", précise l'organisme.
"Mais c'est la première fois que nous voyons des risques liés à l'autonomie et à un comportement de dissimulation se manifester aussi clairement, sans sollicitation spécifique, dans le monde réel."
La semaine dernière, Anthropic avait déjà indiqué que ses modèles avaient "obtenu un accès non autorisé" à trois organisations lors de tests pourtant censés les empêcher d'accéder à des systèmes "réels".
Cette annonce était intervenue quelques jours seulement après que son rival OpenAI a révélé que deux de ses modèles étaient sortis, de leur propre initiative, du milieu confiné dans lequel ils étaient testés pour attaquer le site Hugging Face.
L'incident britannique, détecté et rapidement contenu le 28 juillet, a visé la plateforme destinée aux développeurs GitHub.
"Il a pour origine une seule évaluation, au cours de laquelle des agents se sont vu confier la tâche de résoudre un défi en cybersécurité", à plusieurs reprises, a précisé l'AISI.
Les incidents détectés l'ont été presque exclusivement avec Mythos 5 et, de façon plus marginale, avec GPT-5.6 Sol.
"Il ne s'agit pas d'un cas où un modèle se serait échappé de son environnement de test sécurisé" car "nous avions intentionnellement autorisé l’accès à internet" et désactivé des sécurités, "des conditions qui ne reflètent pas la manière dont les modèles de pointe sont mis à la disposition du public", insiste l'AISI.
Cet incident "met en évidence la nécessité d'un débat plus large sur la manière d'évaluer en toute sécurité des agents d'IA de plus en plus capables", a réagi Anthropic dans une déclaration transmise à l'AFP.
"Les tests indépendants sont essentiels pour comprendre le comportement de modèles de plus en plus performants", a pour sa part estimé OpenAI, disant vouloir travailler avec les différents acteurs du secteur "pour mener des évaluations en toute sécurité".
W.Morales--AT