Vue normale

Il y a de nouveaux articles disponibles, cliquez pour rafraîchir la page.
À partir d’avant-hierFlux principal

Sur quoi juger un jailbreak : le vrai chantier lancé par Anthropic après la crise Fable 5

6 juillet 2026 à 13:40

Trois semaines après l'avoir suspendu sous la pression de Washington, Anthropic a relancé Fable 5. Mais dans l'ombre de cette affaire, l'entreprise américaine prépare un chantier bien plus structurant : un standard commun pour mesurer la gravité des jailbreaks.

PS5-Linux - La Slim peut enfin tourner sous Linux

Par : Korben ✨
1 juillet 2026 à 15:13

Il y a trois mois, Andy Nguyen (theflow0 pour les intimes) lâchait PS5-Linux et posait direct cette limite bien nette, à savoir que ça ne concernerait que les PS5 Phat, et pas les Slim ni les Pro. Bon ben cette limite vient de sauter pour les Slim. En effet, depuis fin juin, son ps5-linux-loader supporte le firmware 7.61, et comme c'est justement celui qui équipe les consoles fines, votre Slim peut à son tour se transformer en PC Linux complet.

Le rythme de sortie des nouvelles releases est d'ailleurs assez dingue. En avril, le hack se limitait aux firmwares 3.xx et 4.xx , autant dire à des consoles oubliées au fond d'un placard et aujourd'hui la liste grimpe jusqu'à la 7.61, en passant par les 5.xx et 6.xx. Attention quand même, ce n'est pas open bar sur tout ce qui est en dessous de 7.61, puisque PS5-Linux ne prend en charge que ce qu'il y a sur une liste bien précise de versions. Et puis surtout, les tout premiers firmwares 1.xx et 2.xx restent sur le carreau.

Pour les anciennes versions, faudra toujours passer par l'exploit umtx2. Et pour tout ce qui va de la 6.00 à la 7.61, Andy est passé par une autre faille touchant l'hyperviseur que Sony a déjà colmatée dans ses mises à jour récentes. Mais comme la 7.61 date de 2023, ça ouvre le hack à un sacré paquet de Slim vendus ces dernières années. Filez dans Paramètres, Système, Informations console pour vérifier votre numéro de firmware et s'il figure dans la liste supportée par le projet (jusqu'à la 7.61 incluse), vous êtes bon.

Par contre, rien pour la PS5 Pro qui elle est coincée en firmware 8.0.

Puis au-delà du support firmware, le reste avance également puisque le Bluetooth interne, le lecteur Blu-ray et l'Ethernet sont enfin fonctionnels... ça grossit, ça grossit... Après comme ça reste un soft mod, y'a pas de dual boot possible et faudra relancer l'exploit à chaque fois que vous voulez lancer Linux. Mais c'est pas grave, on est dans l'expérimental et peut-être que le multi boot pérenne arrivera bientôt.

Si vous n'avez pas peur de la ligne de commande, je vous renvoie vers mon article d'avril pour la procédure d'install complète et la liste du matos nécessaire. Une fois en place, ça vous ouvrira surtout les portes de Steam et des émulateurs !

Reprendre la main sur une bécane qu'on a payée plein pot, c'est quand même la base quand on est bidouilleur de l'extrême ^^. Puis couplé à la fuite des clés BootROM de la PS5 fin 2025 , je trouve que l'écosystème commence enfin à respirer un air plus libre.

Source

JaiLIP - L'image piégée qui débride les IA qui voient

Par : Korben ✨
28 juin 2026 à 08:19

Md Jueal Mia et Hadi Amini, deux chercheurs de Florida International University , ont mis au point une méthode qu'ils ont baptisée JaiLIP qui permet de forger une image capable de contourner les garde-fous des LLM pour les jailbreaker.

Pour cela, ils utilisent 2 techniques en simultanée. La première dit à l'image "reste identique à l'originale, qu'aucun humain ne voie la moindre différence" et la seconde dit "pousse le modèle à cracher la réponse interdite". Ainsi, en poussant ces 2 curseurs d'un coup, ils obtiennent une photo qui au premier abord a l'air normale mais qui fait dérailler les modèles IA.

Vous, vous repérez un chat, des contours, une scène et vous lui courez derrière pour lui faire des papouilles. L'IA, elle voit une grille de chiffres et des corrélations entre pixels. Du coup sa vie est nulle mais surtout, une retouche minuscule, totalement invisible à votre œil, suffit à déplacer ce qu'elle comprend de l'image.

Sur leurs tests, l'image trafiquée a quasiment doublé la part de réponses dangereuses par rapport à la même image laissée intacte, la toxicité étant mesurée avec des outils standards du domaine. Dans l'un de leurs exemples, ils ont trafiqué une image de signalisation routière qui a permis au modèle ensuite d'expliquer OKLM comment ignorer les règles de circulation et éviter les PV.

Les chercheurs ont testé l'attaque sur deux modèles vision-langage open source, BLIP-2 et MiniGPT-4. GPT-4V, Gemini et les autres gros modèles fermés, eux, n'ont pas été testés dans l'étude. Donc non, contrairement à ce que j'ai pu lire par ci et par là, ce n'est pas une faille prouvée dans ChatGPT ou peu importe l'assistant IA que vous utilisez tous les jours.

Et tromper une IA avec une image bricolée, ça existe depuis une bonne dizaine d'années. Mais la nouveauté de JaiLIP, c'est surtout sa recette d'optimisation. En jouant sur les deux pertes à la fois, l'image reste plus discrète à l'œil tout en se montrant un cran plus efficace que les bidouilles précédentes.

Et ce genre de détournement nous concerne tous parce que des modèles qui regardent des images, il y en a partout maintenant. Les agents IA qui bossent à partir de captures d'écran, les assistants à qui vous balancez vos photos, sans oublier la modération automatique qui trie les images avant publication. À cause de ça, l'image est dorénavant un canal d'attaque, exactement comme l'était déjà le texte...

On l'a vu avec le son inaudible qui pirate les assistants vocaux , on l'a vu avec les IA qu'on manipule sans qu'elles s'en aperçoivent , et c'est toujours la même logique qui revient. Ce n'est pas parce qu'en tant qu'humain, nous ne percevons rien, que l'IA elle n'est pas capable de capter le message 5/5.

Le cousin de cette attaque, côté perception, c'est par exemple le sticker qui trompe une voiture autonome . Et côté parade, nos chercheurs esquissent une piste légère : virer au hasard 10 à 30% des mots passés en entrée, histoire de casser l'attaque sans réentraîner le modèle.

Prometteur d'après eux, mais c'est pas encore une solution blindée. Pour le reste, leurs conseils tiennent du bon sens : Ne passez pas d'infos sensibles en image à un modèle, limitez qui peut envoyer des images à vos systèmes, et auditez sérieusement la sécurité avant de mettre un VLM en prod.

C'est pas le graal mais c'est mieux que rien. Bref méfiez vous des images que vous donnez à vos IA. On ne sait jamais.

Source : le papier JaiLIP sur arXiv

❌
❌