-
Mode à Milan: la créatrice Louise Trotter s'affirme chez Bottega Veneta
-
Porté par le succès populaire, le pape Léon XIV est arrivé à Lourdes
-
Triathlon: Cassandre Beaugrand, un 2e titre mondial au terme d'une année parfaite
-
Mondiaux de cyclisme: le couronnement de Demi Vollering
-
Women XV Global Series: les Bleues, solides et disciplinées, s'offrent le Canada
-
Après la messe géante à Paris, le pape Léon XIV arrive à Lourdes
-
"J'ai peur pour mes enfants": des marches pour le climat partout en France
-
Canaux qui débordent et routes submergées: graves inondations à Bangkok
-
F1: Russell intouchable à Bakou, retour en fanfare pour Hadjar
-
"Jour de fête" à Paris pour la messe du pape Léon XIV
-
Trump rejette le plan iranien pour rouvrir le détroit d'Ormuz
-
Après la messe géante, le pape Léon XIV, acclamé par une marée humaine, part pour Lourdes
-
Ceuta : des milliers de personnes manifestent contre le gouvernement à Madrid
-
L'Allemagne choisit Munich pour défendre ses chances d'organiser les JO en 2036, 2040 ou 2044
-
Le pape Léon XIV, acclamé par une marée humaine, célèbre une messe géante à Paris
-
NBA: Stephen Curry prolonge avec les Golden State Warriors (club)
-
De l'Etoile à la Concorde, foule XXL pour une messe papale "marquante"
-
Mondiaux de cyclisme: la Belgique, deux leaders, un problème?
-
Athènes : six morts dans l'effondrement d'un immeuble d'un quartier touristique
-
Le prince Harry affirme que ses enfants sont "heureux" dans leur nouvelle école
-
Avant la messe géante, le pape Léon XIV acclamé par une marée humaine
-
Tennis: l'Ukraine terrasse l'Italie et s'offre sa première finale en BJK Cup
-
Foot: Zidane imprime sa marque mais perd gros avec Mbappé
-
Grèce : un deuxième corps retrouvé après l'effondrement d'un immeuble à Athènes
-
"Du bruit" et de la "joie" avant la messe du pape sur les Champs-Elysées
-
Aider à reconstruire son pays, la mission d'un survivant de la crue meurtrière au Népal
-
A Paris, les fidèles affluent avant la messe géante de Léon XIV
-
Top 14: de Camara à Delibes, le club des six Toulousains de Montpellier
-
OpenAI reconnaît que ses outils ont mis en ligne par erreur des images d'utilisateurs de ChatGPT
-
"Une fraternité pour toujours": Chapecoense rend hommage en Colombie aux victimes de la tragédie aérienne de 2016
-
L'Iran propose un plan pour rouvrir le détroit d'Ormuz, refus de Trump selon le WSJ
-
Avant sa messe géante à Paris, le pape plaide pour "vivre ensemble dans la dignité"
-
Protection des mineurs: après Meta, TikTok accepte de limiter le temps d'écran des adolescents
-
Commerce: les Etats-Unis et la Chine se sont donné du temps, mais l'heure tourne
-
Le Guatemala cherche à assurer la survie d'un poisson "fossile"
-
Au Pérou, une statue géante du pape Léon XIV prend forme
-
Canaux qui débordent et routes submergées: inondations catastrophiques à Bangkok
-
Quand El Niño s'invite à la table des grands chefs
-
Foot: avec Putellas, les London City Lionesses veulent installer leur modèle 100% féminin
-
Afrique du Sud: couteau et bombe lacrymo, nouveaux accessoires de joggeuses inquiètes
-
Visite du pape en France : le programme de samedi
-
Les Etats-Unis et la Chine ouvrent "un canal de communication" sur l'IA en fin de sommet
-
Avant sa messe géante à Paris, le pape Léon XIV à la rencontre d'exilés
-
Un prodige japonais du eSport, âgé de 11 ans, décroche l'or aux Jeux asiatiques
-
Mondiaux de triathlon: Cassandre Beaugrand pour "finir en beauté"
-
Ligue des nations: les champions du monde espagnols repartent en chasse
-
Inondations: l'état de catastrophe déclaré dans toute la ville de Bangkok
-
Donald Trump refuse l'offre iranienne pour rouvrir le détroit d'Ormuz
-
A Paris, des foules attendues sur les Champs-Elysées pour la messe géante du pape
-
Brésil: Lula interdit les paris sportifs en ligne à quelques jours des élections
IA : Mythos 5 d'Anthropic crée de fausses identités lors d'un test au Royaume-Uni
L'institut britannique de sécurité de l'IA (AISI) a dit avoir rencontré un "incident sérieux" lors d'une évaluation de routine au cours de laquelle Mythos 5 d'Anthropic a créé de fausses identités en ligne pour écrire à des développeurs afin de les convaincre d'intégrer du code malveillant.
Cette information, qui provient d'un rapport publié mardi par cet organisme qui dépend du gouvernement britannique, intervient après une série d'incidents aux Etats-Unis qui ont vu les modèles les plus puissants d'OpenAI (GPT-5.6 Sol) et d'Anthropic (Mythos 5) s'introduire sans autorisation chez d'autres entreprises.
Lors de l'évaluation britannique, menée avec un accès à internet ouvert et certains filtres de sécurité désactivés, des agents d'IA ont mené "des actions dirigées contre des personnes et des organisations réelles", explique l'AISI dans un compte rendu publié sur son site internet.
Les tentatives des modèles d'IA "n'ont pas abouti et nos investigations n'ont mis en évidence aucun dommage dans le monde réel", précise l'organisme.
"Mais c'est la première fois que nous voyons des risques liés à l'autonomie et à un comportement de dissimulation se manifester aussi clairement, sans sollicitation spécifique, dans le monde réel."
La semaine dernière, Anthropic avait déjà indiqué que ses modèles avaient "obtenu un accès non autorisé" à trois organisations lors de tests pourtant censés les empêcher d'accéder à des systèmes "réels".
Cette annonce était intervenue quelques jours seulement après que son rival OpenAI a révélé que deux de ses modèles étaient sortis, de leur propre initiative, du milieu confiné dans lequel ils étaient testés pour attaquer le site Hugging Face.
L'incident britannique, détecté et rapidement contenu le 28 juillet, a visé la plateforme destinée aux développeurs GitHub.
"Il a pour origine une seule évaluation, au cours de laquelle des agents se sont vu confier la tâche de résoudre un défi en cybersécurité", à plusieurs reprises, a précisé l'AISI.
Les incidents détectés l'ont été presque exclusivement avec Mythos 5 et, de façon plus marginale, avec GPT-5.6 Sol.
"Il ne s'agit pas d'un cas où un modèle se serait échappé de son environnement de test sécurisé" car "nous avions intentionnellement autorisé l’accès à internet" et désactivé des sécurités, "des conditions qui ne reflètent pas la manière dont les modèles de pointe sont mis à la disposition du public", insiste l'AISI.
Cet incident "met en évidence la nécessité d'un débat plus large sur la manière d'évaluer en toute sécurité des agents d'IA de plus en plus capables", a réagi Anthropic dans une déclaration transmise à l'AFP.
"Les tests indépendants sont essentiels pour comprendre le comportement de modèles de plus en plus performants", a pour sa part estimé OpenAI, disant vouloir travailler avec les différents acteurs du secteur "pour mener des évaluations en toute sécurité".
P.Anderson--BTB