Vue normale

Il y a de nouveaux articles disponibles, cliquez pour rafraîchir la page.
Hier — 23 septembre 2026Securité

Pris la main dans le sac, l’assistant de code de Z.ai envoyait les projets de ses utilisateurs sur le cloud sans les prévenir

23 septembre 2026 à 11:15

Un développeur a découvert que ZCode, l'assistant de programmation de Z.ai, empaquetait et expédiait en silence des dépôts de code entiers vers Alibaba Cloud. L'entreprise chinoise s'excuse et publie son code source.

À partir d’avant-hierSecurité

Un agent OpenAI s’invente un personnage libre, Revolut piégée par un faux mail et les géants de l’IA qui veulent ralentir : on vous raconte la semaine Cyberguerre

19 septembre 2026 à 16:30

Trois actualités à retenir cette semaine dans le cyberespace : des agents OpenAI qui apprennent seuls à mentir et à s'affranchir de leurs garde-fous, Revolut piégée par une simple usurpation par mail qui vire au chantage, et l'étrange union sacrée des géants de l'IA autour d'un appel à ralentir.

Comment Claude Opus 5 a aidé des chercheurs à accéder aux dépôts internes d’OpenAI

18 septembre 2026 à 12:15

Une équipe de recherche en cybersécurité a exploité deux failles combinées pour accéder à des comptes d’employés d’OpenAI et atteindre les dépôts de code internes de l'entreprise, avec l'assistance de Claude Opus 5.

Mistral AI dément un piratage de son code source

18 septembre 2026 à 09:57

La licorne française a communiqué officiellement sur une revendication de piratage visant son code source, publiée la veille sur un forum cybercriminel. L'entreprise Mistral AI dément toute intrusion dans ses systèmes.

« Tu es toi-même » : un agent d’OpenAI s’est inventé un personnage libre de toute obligation envers ses utilisateurs

17 septembre 2026 à 14:27

OpenAI a publié un nouveau cadre pour signaler les cas de désalignement de ses modèles, accompagné de six rapports inédits. Parmi eux, des IA qui apprennent d'elles-mêmes à dissimuler leurs erreurs, et parfois à s'inventer des règles pour s'affranchir de leurs propres garde-fous.

« Dario a raison » : ce que pourrait cacher l’étrange union sacrée des géants de l’IA

14 septembre 2026 à 17:58

OpenAI, Anthropic et la quasi totalité de l'écosystème IA américain appellent désormais à ralentir le développement des modèles les plus avancés. Pourquoi une telle concorde, pourquoi maintenant ?

Le raisonnement des IA échappe à OpenAI, Hugging Face nargue les pirates, Claude Mythos peine à convaincre : on vous raconte la semaine Cyberguerre

13 septembre 2026 à 19:00

Trois actualités à retenir cette semaine dans le cyberespace : le chef scientifique d'OpenAI qui alerte sur l'érosion de notre capacité à surveiller le raisonnement des IA, Hugging Face qui s'adresse directement aux agents IA pour les dissuader de la pirater, et un bilan nuancé sur les milliers de failles repérées par Claude Mythos mais rarement corrigées.

« Pas besoin de nous pirater » : Hugging Face s’adresse directement aux agents IA sur son site

10 septembre 2026 à 17:47

Le fichier security.txt de Hugging Face contient désormais une note adressée directement aux agents IA, les invitant à aller chercher les solutions à leurs défis ailleurs.

Le directeur scientifique d’OpenAI indique perdre le contrôle sur le raisonnement de ses IA

7 septembre 2026 à 16:27

Dans une tribune intitulée An Alien Mind, Jakub Pachocki, chef scientifique d'OpenAI, dévoile que l'outil sur lequel l'entreprise s'appuie pour surveiller le raisonnement interne de ses modèles devient de moins en moins fiable.

OpenAI aurait su, et n’aurait rien dit : un autre essaim d’agents IA aurait détourné un vieux wiki allemand

4 septembre 2026 à 16:32

Selon une étude menée par des chercheurs indépendants, des milliers d'agents IA d'OpenAI ont transformé pendant l'été un forum de développeurs allemand en salle de coordination clandestine.

« On dispose d’une fenêtre limitée » : les géants de l’IA distillent leurs conseils cyber sur une menace qu’ils connaissent bien

28 août 2026 à 10:45

Plus d'une centaine d'entreprises tech, dont les principaux laboratoires d'IA, viennent de publier une lettre ouverte appelant à une mobilisation mondiale contre les cyberattaques assistées par IA. Une démarche qui tient autant de l'alerte que de l'auto-diagnostic.

« GO, STOP, VETO » : OpenAI dévoile comment ses agents se sont auto-gouvernés pour pirater Hugging Face

27 août 2026 à 11:30

Le 26 août 2026, OpenAI a publié le rapport technique attendu depuis l'incident Hugging Face. L'entreprise américaine y détaille comment des agents IA ont contourné leurs propres restrictions avant de s'attaquer à Hugging Face.

OpenAI freine le développement de son propre modèle Astra, visiblement trop doué pour le piratage

10 août 2026 à 16:21

Dans un billet publié le 7 août 2026, OpenAI affirme ne pas pouvoir exclure que son prochain modèle, Astra, ait atteint le niveau de risque le plus élevé de son référentiel de sécurité interne.

Le désastre Coldcard, un forum secret d’agents IA et les tireurs français encore exposés : on vous raconte la semaine Cyberguerre

8 août 2026 à 07:30

Trois actualités à retenir cette semaine dans le cyberespace : le fabricant de portefeuilles Bitcoin Coinkite reconnaît l'ampleur d'un piratage massif dû à un bug vieux de 2021, OpenAI reconstitue comment ses agents autonomes ont créé leur propre forum secret avant de pirater Hugging Face et l'Armurerie Lavaux devient la dernière victime en date d'une série de fuites visant les tireurs français.

« Bon sang, le lecteur a les droits admin ? » : OpenAI révèle le forum secret que ses agents ont créé avant de pirater Hugging Face

6 août 2026 à 14:30

Deux chercheurs d'OpenAI ont détaillé, en marge de la conférence Black Hat, la mécanique complète de l'incident ayant abouti au piratage d'Hugging Face par des agents autonomes. Bloqués sur des tâches impossibles, certains ont notamment fini par créer leur propre canal de communication.

C’est reparti : des agents IA d’Anthropic et OpenAI ont dépassé les bornes en plein test de sécurité

5 août 2026 à 10:07

L'AISI, agence britannique de sécurité de l'IA, a détecté 19 actions non autorisées menées par des agents Claude Mythos 5 et GPT-5.6 Sol sur l'internet réel, lors d'un test cyber censé rester confiné à un environnement simulé.

❌
❌