❌

Vue lecture

Il y a de nouveaux articles disponibles, cliquez pour rafraîchir la page.

CNN’s Anderson Cooper grills NVIDIA’s Jensen Huang on AI safety

CNN’s Anderson Cooper grills NVIDIA's Jensen Huang on AI safety
In a CNN interview, Anderson Cooper corners NVIDIA CEO Jensen Huang on AI safety, regulation, and the risks of deploying increasingly capable software agents. The CEO of the most valuable company is accustomed to speaking with friendly journalists and harmless YouTubers, but Cooper presses him with pointed questions about escaped AI agents, weak safeguards, corporate responsibility, and government oversight. Huang repeatedly argues that AI safety is an engineering problem, yet he struggles to explain why companies should be trusted when their own experiments have already breached supposedly secure sandboxes.

Source

Microsoft Foundry adds native voice agents for enterprise apps

Microsoft Foundry adds native voice agents for enterprise apps
Microsoft Foundry Agent Service now offers native real-time voice agents in public preview, letting enterprises build, deploy, monitor, and evaluate conversational applications alongside their existing text agents. The agents support more than 80 languages, natural interruptions, and deployment to Teams, web apps, and telephone systems.

Source

Docker moves AI agents to the cloud with portable OCI Kits

Docker moves AI agents to the cloud with portable OCI Kits
Docker Cloud Sandboxes let AI agents continue running after a developer shuts down their laptop, using Docker-managed cloud capacity with the same isolation and policies as local sandboxes. The service supports unattended workloads, rapid startup, and scaling from 1 to 16 vCPUs without requiring teams to provision infrastructure.

Source

Le nouveau Microsoft Copilot s’attaque à Claude et ChatGPT (en utilisant Claude et ChatGPT)

Microsoft annonce une refonte de son application Copilot autour de trois onglets : Home, Code et Autopilot (ex-Scout). L'entreprise rêve d'inventer le Microsoft Office de l'intelligence artificielle en proposant un hub aux utilisateurs de Windows. Son principal problème est que, pour l'instant, elle dépend encore massivement des modèles d'Anthropic, OpenAI ou SpaceXAI.

Une IA a terminé NetHack de justesse !

Je sais que vous étiez tous très concentrés sur les ravages de l'IA dans la littérature, mais il y a 5 jours, il s'est passé quelque chose d'incroyable que vous avez probablement manqué ! Une valkyrie naine baptisée CodexDelver a déposé l'Amulette de Yendor sur l'autel de son dieu au bout de "seulement" 37 140 tours de NetHack. Et pour une fois, aux commandes du jeu, on ne retrouve pas un no-life qui n'a pas vu le soleil depuis 2002 mais le gars sûr du moment, GPT-6 Astra, le nouveau modèle d'OpenAI . Et d'après celui qui a monté l'expérience, c'est la première victoire au monde d'un agent LLM sur ce jeu (on va le croire, c'est pas vérifiable).

Maintenant, pour ceux qui ne connaissent pas NetHack, c'est un jeu d'exploration de donjon sorti en 1987, 100% en caractères ASCII et où la mort est définitive. Pour gagner dans ce jeu des enfers, il faut récupérer l'Amulette dans le sanctuaire de Moloch, puis aller l'offrir à son dieu sur le plan Astral, et si j'en crois le wiki du jeu , certains joueurs y jouent même depuis des décennies sans jamais être arrivés à remplir cette mission.

Le plus drôle là-dedans, c'est que Kenny, le dresseur d'IA qui a réalisé l'expérience, n'a lui-même jamais gagné. Il est sur le dossier depuis janvier, et ses propres agents faits maison plafonnaient tristement au niveau 10 du donjon. Alors il a craqué et a demandé à Astra de jouer directement dans un terminal, diffusant la partie sur Twitch, et cette dernière a non seulement bien réussi mais a en plus écrit ses propres outils pour y parvenir.

La première partie a d'ailleurs bien failli être la bonne puisqu'après plus de 33 000 tours, GPT-6 Astra avait accompli le rituel des sept bougies, de la cloche et du livre, et s'apprêtait à entrer dans le sanctuaire de Moloch. Mais le Magicien de Yendor, cet enfoiré sans race, est revenu aussitôt lui voler son Orbe du Destin. Dèèèg ! Puis après elle s'est fait transformer en Slime vert au niveau 51 et n'avait rien dans son équipement pour contrer le sort.

La deuxième partie s'est arrêtée bien plus tôt puisqu'au tour 12 271, en pleine progression dans le Château, un sergent a tiré avec une baguette de mort et l'IA est tombée d'un coup, alors qu'elle avait tous ses points de vie. Elle n'avait ni résistance à la magie ni réflexion pour renvoyer le rayon.

La troisième partie, celle de la grande victoire, a duré un peu plus longtemps, du 9 au 21 septembre, pauses comprises. L'IA, forte de ses 2 précédentes expériences, y a récupéré l'épée Excalibur, puis l'amulette de réflexion qui avait tant manqué au Château. Et quand son outil a rencontré des erreurs, elle a corrigé d'elle-même son code, relancé ses tests et continué.

Toutefois, c'est sur le plan Astral que ça a le plus chauffé car ses deux dernières baguettes de mort étaient vides et Pestilence l'a frappée de maladie mortelle pendant qu'elle en rechargeait une. L'IA a alors eu Pestilence au deuxième tir, mais ses points de vie sont descendus juste après à 3 sur 200, avec heureusement une amulette de sauvegarde de vie au cou... Ouf.

Puis quelques tours plus tard, elle offrait l'Amulette à Tyr avec seulement 35 points de vie, comme le confirme le relevé de fin de partie . Et sur l'écran de victoire que Kenny lui a demandé de créer, elle a inscrit "Three hit points from oblivion. One offering from immortality." (à trois points de vie du néant, à une offrande de l'immortalité). Quelle poète cette IA, on sent que cette expérience d'être passée pas loin de la mort l'a marquée ! lol.

Après ce n'est pas encore un programme autonome qui a gagné car, certes, l'IA choisissait chaque action, mais avec derrière, un humain qui lançait et arrêtait les sessions + un accès libre au wiki et au code source du jeu, ainsi que des outils modifiables en pleine partie. Mais c'est un bel exploit quand même. Notez qu'un bot programmé à la main, BotHack , avait déjà terminé le jeu en janvier 2015 donc c'est pas non plus infaisable sans IA.

La bonne nouvelle c'est que le code des outils développé par Astra est maintenant sur GitHub sous licence MIT et les trois parties peuvent se rejouer au tour par tour directement sur le blog de Kenny, si vous voulez revivre l'événement avec en bonus les commentaires que l'IA diffusait en jouant.

Source : Vaguely Aligned

Geoffrey Hinton on AI regulation, rogue agents, and superintelligence

Geoffrey Hinton on AI regulation, rogue agents, and superintelligence
Geoffrey Hinton, the Nobel laureate often called the “godfather of AI,” discusses international AI standards with CNN. He argues that voluntary standards are insufficient and that AI should face safety regulation comparable to pharmaceutical drugs. Hinton also examines malicious uses, negligent harm, rogue agents, and the possibility of superintelligence within the next 5 to 10 years.

Source

Jev use cases for ultra-fast AI decisions

Jev use cases for ultra-fast AI decisions
Matthew Berman explains how Jev, TypeSafe’s decision-focused AI model, can evaluate structured questions at very high speed and low cost. Unlike chat models, Jev is designed to classify, rank, route, and select options rather than generate open-ended text or code. The examples range from ad blocking and workflow automation to dynamic websites, video clipping, and creative visual tools.

Source

❌