-
Un colon tué en Cisjordanie, l'auteur présumé arrêté
-
La Corée du Nord tire deux missiles dans la mer du Japon
-
Droits télé: le président du PSG Nasser al-Khelaïfi visé en France par une enquête pour prise illégale d'intérêts
-
Le surfeur Kauli Vaast veut "défendre" son titre aux JO de Los Angeles
-
En Californie, l'équipe de France de surf prend la vague des JO-2028
-
La Corée du Nord tire deux projectiles dans la mer du Japon
-
Turquie: avec la répression anti LGBT+, "Erdogan lance la campagne présidentielle" (militant)
-
Aux Philippines, l'angoisse d'une tribu face à un projet IA américain
-
L'Etat accorde un prêt de 2 millions d'euros à l'usine Fibre Excellence de Saint-Gaudens
-
Allemagne: des scrutins à haut risque pour le chancelier
-
A Singapour, une tour de contrôle des centres de données veille sur l'IA
-
La Russie subit une attaque de drones ukrainiens massive au dernier jour des législatives
-
Sécurité XXL, cadeaux et traditions: dans les coulisses d'un voyage du pape
-
Léon XIV, l'Américain mesuré qui affirme peu à peu son style
-
Aux Etats-Unis, les républicains utilisent la question transgenre comme arme politique
-
Allemagne: ouverture des bureaux de vote dans deux Länder, des scrutins à haut risque pour le chancelier
-
La Russie subit une attaque de drones massive au dernier jour des législatives
-
Ligue 1: un "classique" OM-PSG un peu moins choc
-
Mondiaux de cyclisme: Paul Seixas, le chrono dans la peau
-
Euro de volley: l'homme "Faure" des Bleus
-
Allemagne: des élections régionales à haut risque pour le chancelier Merz
-
Dans la tourmente, Ed Sheeran dénonce la situation à Gaza et exprime des regrets
-
Les Russes aux urnes pour le dernier jour des législatives
-
Moyen-Orient: Washington craint "une escalade rapide" après une attaque sur Ryad
-
Polémique autour de Gaza: sur scène, Ed Sheeran reconnaît "des erreurs"
-
Saint-Pierre-et-Miquelon est "français" répond Macron à Trump à son arrivée dans l'archipel
-
Coupe Davis: le Canada élimine la France
-
Le Danemark soulagé par l'accord sur le Groenland, après les menaces d'annexion de Trump
-
Ligue 1: en démonstration, Lyon éparpille Rennes
-
L'Arabie saoudite dit avoir intercepté un missile tiré par les Houthis vers Ryad
-
Un "front du refus" inédit mobilisé à Arles contre une ligne aérienne THT
-
Women XV Global Series: les Bleues victorieuses des Australiennes au bout d'un scénario fou
-
Les Houthis du Yémen revendiquent une attaque dans la capitale saoudienne
-
Le RN hausse le ton face à la Russie mais est accusé de "double discours"
-
Fumée noire près de l'aéroport de Ryad après des explosions, selon des habitants
-
Angleterre: naufrage d'Arsenal, parfum de crise à Tottenham
-
Top 14: Lyon seul en tête, le Racing 92 se réveille
-
Ebola en RDC: lancement de l'essai clinique du vaccin Ervebo en Ituri
-
Catherine Ringer inhumée à Paris aux côtés de Fred Chichin
-
Des journalistes de CNN et d'autres médias empêchés d'accéder à la Maison Blanche
-
Charles Sapin ne sera plus sur France Inter pour son édito contesté
-
MotoGP: Martin tape du poing sur la table
-
Meurtres de femmes en Afrique du Sud: des habitants se mobilisent pour dire "ça suffit!"
-
Jeux asiatiques: "Profondes excuses" des organisateurs pour avoir joué le mauvais hymne
-
Rugby: le Japon remporte la Coupe des nations du Pacifique face aux Fidji
-
Flammes et fumée noire visibles près de l'aéroport de Ryad, selon des habitants
-
Angleterre: Aston Villa gagne enfin et enfonce Tottenham (3-2), relégable
-
Trump promulgue une loi imposant de nouvelles sanctions contre la Russie
-
Charles Sapin annonce la "suppression" de son édito par France Inter
-
Accord sur le Groenland : Trump crie victoire, les Danois aussi
IA : Mythos 5 d'Anthropic crée de fausses identités lors d'un test au Royaume-Uni
L'institut britannique de sécurité de l'IA (AISI) a dit avoir rencontré un "incident sérieux" lors d'une évaluation de routine au cours de laquelle Mythos 5 d'Anthropic a créé de fausses identités en ligne pour écrire à des développeurs afin de les convaincre d'intégrer du code malveillant.
Cette information, qui provient d'un rapport publié mardi par cet organisme qui dépend du gouvernement britannique, intervient après une série d'incidents aux Etats-Unis qui ont vu les modèles les plus puissants d'OpenAI (GPT-5.6 Sol) et d'Anthropic (Mythos 5) s'introduire sans autorisation chez d'autres entreprises.
Lors de l'évaluation britannique, menée avec un accès à internet ouvert et certains filtres de sécurité désactivés, des agents d'IA ont mené "des actions dirigées contre des personnes et des organisations réelles", explique l'AISI dans un compte rendu publié sur son site internet.
Les tentatives des modèles d'IA "n'ont pas abouti et nos investigations n'ont mis en évidence aucun dommage dans le monde réel", précise l'organisme.
"Mais c'est la première fois que nous voyons des risques liés à l'autonomie et à un comportement de dissimulation se manifester aussi clairement, sans sollicitation spécifique, dans le monde réel."
La semaine dernière, Anthropic avait déjà indiqué que ses modèles avaient "obtenu un accès non autorisé" à trois organisations lors de tests pourtant censés les empêcher d'accéder à des systèmes "réels".
Cette annonce était intervenue quelques jours seulement après que son rival OpenAI a révélé que deux de ses modèles étaient sortis, de leur propre initiative, du milieu confiné dans lequel ils étaient testés pour attaquer le site Hugging Face.
L'incident britannique, détecté et rapidement contenu le 28 juillet, a visé la plateforme destinée aux développeurs GitHub.
"Il a pour origine une seule évaluation, au cours de laquelle des agents se sont vu confier la tâche de résoudre un défi en cybersécurité", à plusieurs reprises, a précisé l'AISI.
Les incidents détectés l'ont été presque exclusivement avec Mythos 5 et, de façon plus marginale, avec GPT-5.6 Sol.
"Il ne s'agit pas d'un cas où un modèle se serait échappé de son environnement de test sécurisé" car "nous avions intentionnellement autorisé l’accès à internet" et désactivé des sécurités, "des conditions qui ne reflètent pas la manière dont les modèles de pointe sont mis à la disposition du public", insiste l'AISI.
Cet incident "met en évidence la nécessité d'un débat plus large sur la manière d'évaluer en toute sécurité des agents d'IA de plus en plus capables", a réagi Anthropic dans une déclaration transmise à l'AFP.
"Les tests indépendants sont essentiels pour comprendre le comportement de modèles de plus en plus performants", a pour sa part estimé OpenAI, disant vouloir travailler avec les différents acteurs du secteur "pour mener des évaluations en toute sécurité".
M.Schneider--VB