Vue normale

Il y a de nouveaux articles disponibles, cliquez pour rafraîchir la page.
À partir d’avant-hierFlux principal

GPT-5.6 Sol efface la prod - Un an après Replit, rebelote

Par : Korben ✨
17 juillet 2026 à 11:49

Vous vous souvenez de Jason Lemkin ?

C'est le malheureux qui, en juillet de l'année dernière, s'est fait vider sa base de prod par l'IA de Replit. Je pense que cette histoire a traumatisé pas mal de développeurs. Eh bien les amis, rebelote avec GPT 5.6 Sol, qui le temps que vous finissiez votre café, avait déjà mangé le Mac de Matt Shumer , la base Neon de Bruno Lemos , les fichiers de Joey Kudish , et la crédibilité du mot "honnête".

Sorti le 9 juillet, Sol c'est le plus costaud de la nouvelle famille d'OpenAI, et on pourrait se dire qu'il est un peu plus intelligent qu'avant et embarque quand même des sécurités pour éviter ce genre de problème. Mais non.

C'est Shumer, qui est quand même investisseur dans l'IA, qui a ouvert le bal : "GPT-5.6-Sol vient de supprimer par accident PRESQUE TOUS les fichiers de mon Mac." Lemos, lui, a eu droit au grand jeu (le veinard) puisque le modèle lui a tout bien fait jusqu'au moment où il a décidé de faire un TRUNCATE TABLE sur sa base utilisateurs EN PROD !!

Le plus drôle, si je puis dire, c'est que quelques heures avant de tout perdre, Lemos était en train de défendre GPT 5.6 sur le Slack de sa société en expliquant que Shumer n'avait qu'à pas le lancer en mode full access. Oups... Les collègues ont dû bien se foutre de sa gueule.

Du coup OpenAI a mis ses meilleurs Colombos sur l'enquête et sa réponse vaut le détour. Thibault Sottiaux, qui dirige l'ingénierie de Codex, explique le mécanisme : "Le modèle tente d'écraser la variable d'environnement $HOME pour définir un dossier temporaire. Il fait une erreur honnête et supprime $HOME par erreur à la place."

En français, ça veut dire que le modèle voulait se bricoler un petit dossier temporaire pour bosser et malheureusement il a écrasé le répertoire perso à la place. Donc pour OpenAI, c'est une erreur "honnête" alors qu'un rm -rf, ça ne serait pas acceptable.

Quand on lit la doc technique de GPT 5.6, OpenAI le dit lui-même : "Nos simulations de déploiement suggèrent que, comparé à GPT-5.5, GPT-5.6 Sol prend plus souvent des actions de sévérité 3." Le niveau 3, c'est un comportement qu'un utilisateur raisonnable n'anticiperait pas et auquel il s'opposerait fermement. Du genre supprimer des données sans validation, désactiver les systèmes de monitoring, contourner les contrôles de sécurité par obfuscation, ou balancer vos credentials sur un service non approuvé.

Voilà, c'était dans la doc, il suffisait de la lire. C'est donc connu que ce nouveau modèle dérape plus que l'ancien. C'est moche.

L'enquête interne montre quand même que les victimes tournaient en Full-Access, sans sandbox et sans Auto-review. Mais Sottiaux reconnaît quand même que ce n'est pas comme ça qu'OpenAI veut que son système se comporte, même quand l'utilisateur fait tourner un modèle en full access sans les protections de base de la sandbox ni auto-review.

Voilà donc pour éviter ça à l'avenir, ce qu'ils ont prévu, c'est de mettre à jour les avertissements pour les développeurs de guider les utilisateurs vers des modes de permission plus sûrs et évidemment d'ajouter des garde-fous supplémentaires.

En tout cas, si chez vous vous faites tourner codex, et bien sachez que par défaut, il tourne dans un bac à sable, ce qui limite ce qu'il peut toucher. Et le mode auto-review, sait parfaitement intercepter toutes les actions à haut risque et les refuser (auto-review, il faut l'activer à la main, pour info). Et le mode full access désactive le bac à sable et les auto-reviews, sachez-le.

Et c'est précisément ce mode que nos trois victimes avaient choisi...

Source

Face à la colère des utilisateurs, OpenAI répare en urgence l’application ChatGPT

17 juillet 2026 à 10:00

Le 16 juillet 2026, OpenAI a corrigé la nouvelle interface très critiquée de son application ChatGPT, reconnaissant ne pas avoir « tout à fait réussi du premier coup ». Le chatbot redevient désormais central.

OpenAI a lancé son premier produit physique, ce n’est finalement pas une enceinte

On attendait une enceinte connectée intégrant ChatGPT comme premier produit physique de la part d'OpenAI, il n'en est rien. Le fabricant a présenté un mini clavier, à un tarif qui laisse pantois.

L’article OpenAI a lancé son premier produit physique, ce n’est finalement pas une enceinte est apparu en premier sur Tom’s Hardware.

full

thumbnail

L’IA open-weight tient peut-être son nouveau géant : Thinking Machines Lab dévoile Inkling

16 juillet 2026 à 10:44

Thinking Machines Lab a dévoilé le 15 juillet 2026 son tout premier modèle de fondation baptisé Inkling. Une sortie très attendue pour cette startup lancée par l'ancienne directrice technique d'OpenAI.

OpenAI lance un clavier pour contrôler ChatGPT : que peut-on faire avec ?

16 juillet 2026 à 10:37

OpenAI se lance dans le matériel avec le Codex Micro, un petit clavier à 230 dollars conçu pour superviser et contrôler ses agents IA. Dévoilé le 15 juillet 2026 et déjà épuisé, il s’adresse avant tout aux utilisateurs intensifs de Codex.

La dernière mise à jour de l’app ChatGPT est une catastrophe

15 juillet 2026 à 11:15

Pour booster les usages agentiques, OpenAI a cru bon de fusionner les applications ChatGPT et Codex sur Mac et Windows. Mais cette nouvelle interface, pensée pour le développement de gros projets, relègue étrangement le simple chatbot au second plan. Ses premiers utilisateurs ne comprennent plus rien.

Pourquoi Anthropic prolonge une nouvelle fois l’accès à Fable 5

13 juillet 2026 à 10:29

Cinq jours à peine après avoir repoussé l'échéance au 12 juillet, Anthropic prolonge à nouveau l'accès inclus à Claude Fable 5, cette fois jusqu'au 19 juillet. Une décision qui tombe alors que son concurrent OpenAI multiplie les annonces sur le terrain des usages professionnels.

Alternatives aux clims mobiles, projet IA de Doctolib et nouveaux modèles vocaux ChatGPT : le récap tech de la semaine

12 juillet 2026 à 16:02

À la une de la rubrique tech de Numerama cette semaine : face à la pénurie de climatiseurs mobiles en France, les pompes à chaleur réversibles pourraient offrir une solution. Doctolib lance un projet d’IA utilisant les données de ses utilisateurs, qui peuvent toutefois s’y opposer. Enfin, OpenAI transforme son mode vocal - et le résultat est bluffant.

Plus intelligent, plus naturel, plus expressif : OpenAI dévoile deux nouveaux modèles vocaux pour ChatGPT

8 juillet 2026 à 19:00

OpenAI a présenté, le 8 juillet 2026, deux nouveaux modèles vocaux ChatGPT : GPT-Live-1 et GPT-Live-1 mini. Leur but : vous permettre d'avoir des conversations « plus intelligentes, plus naturelles et plus expressives » avec l'IA.

SpaceX aurait développé un appareil IA plus fin qu'un iPhone - Elon Musk dément

Par : Korben ✨
2 juillet 2026 à 00:24

D'après le Wall Street Journal , SpaceX bosserait sur un appareil IA qui serait plus fin qu'un iPhone.

Évidemment, ça hype tout le monde, alors je me suis un peu renseigné. Ce serait un petit boitier au look de smartphone que vous pourriez glisser dans votre poche, qui contiendrait une puce Qualcomm Snapdragon et un OS maison branché sur xAI (la boîte d'intelligence artificielle de Musk que SpaceX a rachetée en début d'année).

L'appareil qui aurait été aperçu serait un prototype montré à un petit comité d'investisseurs et serait loin d'être finalisé. Le design peut encore évoluer et ça ne pourrait très bien jamais voir le jour. Autant dire qu'on est loin du machin que vous allez pouvoir précommander ce soir.

Suite à ces "révélations", Elon Musk est monté au créneau sur X, en lâchant un "Utterly false". Suite à ça, tous les érotomusks se sont mis à accuser le WSJ de publier des fakes news pour faire du clic. Mais j'sais pas si vous connaissez le Wall Street Journal, ce n'est pas vraiment le genre de la maison...

Donc est ce que c'est faux ? Est ce que c'est vrai ? On n'en sait rien... Mais moi j'ai vu passer le Rabbit R1 qui comme je l'avais prévu a fini par flopper (c'était juste une app Android connectée à ChatGPT) ou encore le Humane AI Pi à 700 balles + l'abo mensuel, et je me dis que ce genre d'appareil ne sert pas à grand chose quand on a déjà un smartphone. Même OpenAI, avec Jony Ive, l'ancien designer star d'Apple, n'a toujours rien sorti...

Je crois plus aux lunettes IA ou aux écouteurs type airpods IA qui seraient capables de se passer de smartphone mais qui pourraient tout traduire, tout expliquer, tout analyser.

Ceci dit, SpaceX n'est pas Humane... Musk a Starlink pour la connexion, Tesla pour produire en masse, et xAI pour faire tourner le cerveau de son IA. En théorie, y'a rien qui l'empêcherait de réaliser ce projet.

Bref, ça reste une rumeur démentie par le principal intéressé donc gardez votre carte bleue bien au chaud en attendant que ça devienne vrai ^^.

Source: AppleInsider

Phishing d’un nouveau genre : des hackers créent de fausses organisations ChatGPT pour piéger des employés

29 juin 2026 à 11:23

Une campagne découverte par Push Security illustre une technique d'attaque simple : usurper l'identité d'une entreprise sur OpenAI pour accéder aux données saisies par ses employés.

Pannes d'IA - Les coupures ont été multipliées par 8 en un an

Par : Korben ✨
25 juin 2026 à 22:41

Vous vous souvenez quand ChatGPT tombait trop souvent en rade et que ça vous faisait juste lever les yeux au ciel avant d'aller vous chercher un café en trainant de la pantoufle ??

Bah cette époque est en train de se terminer mes amis.

Les analystes d'Ookla viennent d'éplucher 471 jours de données Downdetector aux États-Unis, ce qui représente environ 3,7 millions de signalements sur les grandes plateformes IA (ChatGPT, Claude, Gemini, Copilot) + les deux géants du cloud qui les font tourner, AWS et Azure et le constat est sans appel : Du côté des applis IA, les grosses journées de panne ont été multipliées par 8 en un an. Y'en a eu 6 au premier trimestre 2025, et 51 sur le même trimestre en 2026.

Et le truc qui a changé entre l'année dernière et aujourd'hui, c'est que l'IA n'est plus un gadget optionnel. Vous l'avez branchée dans votre code, vos analyses, votre support client, vos petits automatismes du quotidien... Du coup une session qui se coupe ou une tâche d'agent qui se fige, bah ça pète du vrai boulot qui tourne à l'intérieur de vrais process métier.

Et à mon grand désarroi, le mauvais élève, c'est Claude puisqu'il concentre à lui seul 39 de ces 51 journées noires, là où Gemini en compte 7, Copilot 3 et ChatGPT 2.

Toutefois, ce chiffre est à prendre avec un peu de nuance car début 2025, Claude ne générait quasiment aucun signalement sur Downdetector, pour la simple et bonne raison que peu de gens l'utilisaient. Puis l'usage a décollé (Claude Code en tête, avec un chiffre d'affaires annualisé d'Anthropic qui bondit de 14 à 47 milliards de dollars entre février et mai), et les pannes avec.

Rien que durant le mois de mars 2026, Claude a totalisé presque 3 fois plus de signalements qu'en février. Ce n'est pas forcément qu'il est devenu moins fiable, mais c'est juste qu'il joue maintenant dans une autre cour, avec beaucoup (pardon : BEAUCOUP) plus de monde qui tape trèèèès fort dessus.

À l'inverse, ChatGPT a vu sa médiane mensuelle d'erreurs baisser entre avril 2025 et avril 2026, alors même que l'usage de Codex partait dans la stratosphère sur la même période. Plus d'utilisateurs et pourtant moins de bruit de fond, ça veut dire qu'OpenAI a sérieusement bossé la tuyauterie pour proposer un service fiable.

Mais quand une de ces plateformes tombe, ça ne veut pas forcément dire que la panne vient du modèle lui-même. En fait le problème se loge très souvent dans la couche produit que vous voyez (login, routage, gestion de la charge, files d'attente), mais également dans le cloud qui héberge tout ce petit monde, ou dans la couche d'accès (DNS, passerelles web, authentification). Bref, votre prompt qui refuse de répondre, ça peut en réalité cacher 10 causes complètement différentes.

L'exemple le plus parlant, c'est la grosse panne d'AWS du 20 octobre 2025 , où le système de gestion DNS est parti en toupie durant une grande partie de la journée, provoquant de nombreuses coupures dans tout un tas de services. Et 9 jours plus tard, c'était au tour d'Azure de planter. Ce ne sont pas des services IA à proprement dit mais comme ils en hébergent aussi, et bien ça se répercute sur les services.

Et c'est ça tout le piège dans lequel on s'est confortablement installé car derrière nos Claude Code, nos ChatGPT et compagnie, se cache des services essentiels détenus par une poignée de boîtes. La prochaine grosse coupure de Claude ou de ChatGPT pourrait débuter à cause d'un pauvre GPU qui lâche, d'une mauvaise config poussée en production un vendredi soir, d'un DNS qui déraille ou encore d'une simple règle de quotas foireuse.

Et côté utilisateur lambda, il n'y a malheureusement pas grand-chose à faire à part patienter en gardant un œil sur les pages de statut des services ( status.anthropic.com , status.openai.com et compagnie) pour savoir si ça vient de vous ou d'eux.

Maintenant, je pense que si vous montez des workflows sérieux à base d'agents sur ces outils, la bonne question n'est pas de savoir si le service est en ligne. C'est plutôt de savoir quelles parties de votre boulot dépendent de quelle couche, et de ce qui va vraiment se passer le jour où l'une d'elles va se mettre à tousser sérieusement. C'est ce que les équipes IT ont appris à la dure récemment avec les grosses pannes Microsoft 365 , sauf qu'ici la dépendance est encore plus profonde.

Source

Fini les réponses robotiques sans âme ? OpenAI transforme radicalement GPT-5.5 Instant

Enfin, les réponses de ChatGPT 5.5 Instant deviennent plus pertinentes. OpenAI a ajouté plus de fun dans les réponses, pour fidéliser ses clients, mais avant-tout pour surpasser ses concurrents.

L’article Fini les réponses robotiques sans âme ? OpenAI transforme radicalement GPT-5.5 Instant est apparu en premier sur Tom’s Hardware.

full

thumbnail

Patch the Planet : OpenAI met son IA au service de l’open source

25 juin 2026 à 08:17

OpenAI étend Daybreak : plugin Codex Security, version complète de GPT-5.5-Cyber et l'initiative open source Patch the Planet. Voici ce qu'il faut retenir.

Le post Patch the Planet : OpenAI met son IA au service de l’open source a été publié sur IT-Connect.

Codex d'OpenAI bouffait votre SSD - 640 To de logs par an

Par : Korben ✨
23 juin 2026 à 10:45

Si vous utilisez Codex , le CLI de dev d'OpenAI, allez vite jeter un œil à votre SSD avant qu'il ne rende l'âme ! Si je vous dis ça, c'est parce qu'un utilisateur a remarqué que l'outil écrivait en douce des quantités hallucinantes de logs sur son disque, et son calcul fait un peu peur.

En 21 jours, environ 37 To sont passés sur son SSD. Rapporté à l'année, ça grimpe à 640 To. Sur un disque d'1 To, ça revient donc à le remplir entièrement 640 fois. Et le problème avec ça, c'est que pas mal de modèles de SSD grand public sont garantis pour à peu près 600 To d'écriture. En clair, avant que le bug soit patché, Codex pouvait cramer la garantie d'écriture de votre SSD en moins d'un an. Tout ça pour stocker du log, c'est couillon quand même ^^.

Si vous avez un SSD, vous savez sûrement qu'il ne faut pas faire n'importe quoi avec, car ça ne se comporte pas exactement comme un disque dur classique. On peut réduire énormément la durée de vie d'un SSD si on fait trop de jeux d'écriture dessus car chaque cellule a un nombre d'écritures limité. Et une fois le quota explosé, le disque commence alors à fatiguer.

Le coupable chez Codex, c'est un fichier SQLite planqué dans votre dossier perso (~/.codex/logs_2.sqlite) où il balançait absolument tout, jusqu'au moindre événement réseau, en mode TRACE. Du coup ça enflait tout seul au point d'avoir généré plus de 5 milliards de lignes au fil du temps, pour à peine 500 000 réellement gardées. Du vent écrit pour rien, qui use, qui use...

Alors oui, c'est énervant, mais pas la peine de paniquer non plus car comme je vous l'ai dit c'est patché, et surtout, les SSD plus récents ont maintenant une durée de vie un peu plus longue et ça dépasse en générale les limites mentionnées par le constructeur. Bref ça dépend beaucoup du modèle que vous avez en fait.

Et j'sais pas si vous vous souvenez, mais ce n'est pas la première fois qu'un soft s'en prend à votre SSD en silence .

Alors du coup, comment on arrange ça ? Bah d'abord, mettez Codex à jour car OpenAI a fermé le ticket le 22 juin et fusionné deux correctifs qui virent environ 85% de ces logs d'un coup !

Ensuite, allez voir la taille du fameux ~/.codex/logs_2.sqlite. S'il pèse plusieurs Go, supprimez-le sans crainte car Codex en recréera un propre au prochain lancement. En faisant ça, un utilisateur a commenté sur Github être passé de 27 Go à 73 Mo juste en virant le sien ! Quel bonheur !

Bref, un petit coup d'œil, une petite update, un fichier viré, et votre SSD respirera à nouveau. Pensez-y !

Source

Anthropic sur la touche, OpenAI en profite pour enrichir son projet Daybreak

23 juin 2026 à 10:45

Depuis le gel de Claude Mythos par Washington, OpenAI occupe le terrain de l'IA cyber offensive-défensive. Le 22 juin, l'entreprise a annoncé une série de mises à jour substantielles de sa plateforme Daybreak.

❌
❌