Retour au radar

🟧 RADAR IA : OPENAI DÉVOILE SA PUCE JALAPEÑO (26/08)

📡 RADAR IA · MERCREDI 26 AOÛT 2026

3,4 fois moins de latence que du Nvidia Blackwell. OpenAI publie les premiers résultats de sa puce maison, Jalapeño.

━━━━━━━━━━━━━━━━━━━━

AU SOMMAIRE

• OpenAI publie les premiers chiffres de sa puce Jalapeño • ChatGPT Work sait maintenant naviguer et réserver sur le web • Claude unifie sa mémoire entre Chat et Cowork • Claude Code : la compaction de contexte fait oublier les règles de sécurité • Gatik lève 200 M$ sur les camions autonomes • 12 brèves • 3 lignes de chiffres du jour • 4 outils à connaître • 1 action à tester

━━━━━━━━━━━━━━━━━━━━

🔴 LE TOP DU JOUR

1️⃣ OPENAI PUBLIE LES PREMIERS RÉSULTATS DE SA PUCE JALAPEÑO

📌 Le fait OpenAI dévoile les premiers benchmarks publics de Jalapeño, sa puce dédiée à l'inference (le moment où l'IA produit sa réponse). Comparée aux systèmes Nvidia Blackwell, elle affiche jusqu'à 3,4 fois moins de latence et 1,9 fois plus d'efficacité énergétique. C'est la première fois qu'OpenAI met des chiffres publics sur son matériel propriétaire.

📊 Les chiffres Jusqu'à 3,4 fois moins de latence que Nvidia Blackwell 1,9 fois plus d'efficacité énergétique

🎯 Pour toi Si ces chiffres tiennent en production, ils pèsent sur le coût des appels d'API et sur la dépendance du secteur à Nvidia. L'élément à creuser : ce que ça fait au prix au million de mots traités chez OpenAI dans les mois qui viennent.

🔗 OpenAI

━━━━━━━━━━━━━━━━━━━━

2️⃣ CHATGPT WORK SE CONNECTE AUX SITES WEB POUR AGIR À TA PLACE

📌 Le fait ChatGPT Work peut désormais se connecter à des sites web pour exécuter des tâches réelles : réserver, comparer des offres d'assurance, remplir des formulaires. OpenAI précise que ChatGPT ne voit pas les identifiants de connexion. On passe d'un assistant qui rédige à un assistant qui clique.

🎯 Pour toi Les tâches administratives répétitives (comparaisons de contrats, formulaires fournisseurs, réservations) deviennent délégables. Reste à voir comment ta direction juridique traite la question de l'action automatisée au nom de l'entreprise.

🔗 ChatGPT sur X

━━━━━━━━━━━━━━━━━━━━

3️⃣ CLAUDE UNIFIE SA MÉMOIRE ENTRE CHAT ET COWORK

📌 Le fait Anthropic relie la mémoire de Claude entre ses deux environnements : un souvenir enregistré dans Chat est disponible dans Cowork, et inversement. Un onglet mémoire dédié permet de consulter et gérer ce qui est stocké. Une gestion spécifique est ajoutée pour les sujets sensibles.

🎯 Pour toi Fin du recollage de contexte à chaque nouvelle conversation : ce que tu as expliqué une fois sur ton métier, tes clients ou tes méthodes suit d'un espace à l'autre. Un passage par l'onglet mémoire vaut le coup pour vérifier ce que Claude a retenu de toi.

🔗 TestingCatalog sur X

━━━━━━━━━━━━━━━━━━━━

4️⃣ CLAUDE CODE : LA COMPACTION DE CONTEXTE EFFACE LES RÈGLES DE SÉCURITÉ

📌 Le fait Une recherche publiée montre que la compaction de contexte dans Claude Code (le mécanisme qui résume l'historique quand la conversation devient trop longue) dégrade fortement la mémoire des consignes. La rétention des règles de sécurité tombe de 53 % à 10 % après cinq cycles de compaction. Un tri explicite des connaissances à conserver améliore la préservation de 2 à 4 fois.

📊 Les chiffres Rétention des règles de sécurité : 53 % au départ, 10 % après 5 cycles Gain de préservation avec un tri des connaissances : 2 à 4 fois

🎯 Pour toi Sur une session longue, les consignes posées au début ne sont plus appliquées à la fin, sans que rien ne te prévienne. Réinjecter tes règles critiques régulièrement, ou repartir d'une session propre, coûte moins cher que de relire tout le résultat.

🔗 Omar Sar sur X

━━━━━━━━━━━━━━━━━━━━

5️⃣ GATIK LÈVE 200 MILLIONS SUR LES CAMIONS AUTONOMES

📌 Le fait Gatik, spécialiste du camion autonome pour la logistique intermédiaire (les trajets entre entrepôts et points de vente), boucle une série D de 200 millions de dollars. L'entreprise revendique 100 000 livraisons effectuées sans chauffeur et un taux de ponctualité de 99 %.

📊 Les chiffres 200 M$ levés en série D 100 000 livraisons sans chauffeur revendiquées 99 % de ponctualité annoncée

🎯 Pour toi C'est un des rares dossiers IA où les chiffres portent sur des opérations réelles, pas sur des benchmarks. Lecture possible : les investisseurs paient désormais pour de l'exécution logistique mesurée, pas pour de la promesse.

🔗 Aakash Gupta sur X

━━━━━━━━━━━━━━━━━━━━

📌 EN BREF

• ChatGPT Business Premium : OpenAI ouvre un siège à 100 $ par mois pour les petites équipes, sans la limite de 5 heures et avec plus de capacité. • Perplexity sort PPLX 27B, un modèle de 27 milliards de paramètres qui tourne en local pour son outil Computer ; il peut basculer vers un modèle plus puissant, faisant passer son score de 59,6 % à 73 % sur un benchmark. • Microsoft glisse un identifiant invisible dans les images générées par IA depuis Paint et Photos, y compris quand le filigrane Copilot est désactivé. Traçabilité des visuels produits en interne à surveiller. • Une étude montre que la variance des scores des agents IA dépend 7,8 fois plus du harnais logiciel qui les entoure que du modèle lui-même. De quoi relativiser les classements de modèles. • 🟡 Rumeur non confirmée : OpenAI aurait fini le pré-entraînement d'un modèle de plus de 10 000 milliards de paramètres, nommé Bel, successeur d'Astra, avec mémoire et apprentissage continu. • OpenAI lance le WebMCP Challenge, un hackathon de 10 jours autour du standard WebMCP (connecteur qui permet à une IA de dialoguer avec un site web), doté de 35 000 $ de prix. • Anthropic déploie Morning Brief sur Claude : une synthèse quotidienne générée à partir de tâches planifiées. • HP signe un accord de licence avec Huawei pour utiliser ses brevets Wi-Fi. Signal du poids pris par la propriété intellectuelle chinoise. • L'agent Hermes de Nous Research ajoute 44 connecteurs MCP vers des applications courantes, activables en un clic. • Antigravity, l'outil de développement de Google, s'intègre dans Xcode pour coder sur l'écosystème Apple sans changer d'éditeur. • R2T2, modèle open source de transcription vocale en temps réel, se dit au niveau de GPT-Live-Transcribe ; code et poids annoncés comme bientôt publics. • Seedance 2.5, le générateur vidéo, s'utilise directement depuis Claude et Codex via Monid.

━━━━━━━━━━━━━━━━━━━━

📊 LES CHIFFRES DU JOUR

• Sur le classement Texte de LM Arena, Claude Fable 5 mène avec 1508 points sur 24 331 votes ; en édition d'image, GPT-image-2 domine avec 1462 points sur 212 326 votes. • Sur l'indice Artificial Analysis, qui note l'intelligence globale des modèles : Claude Opus 5 en tête à 63,1 pour 10 $ le million de mots traités, contre 62,1 pour Claude Fable 5 facturé 20 $. Deux fois le prix pour un point de moins. • Le plancher utile pour du volume : Ling 3.0 Flash affiche 37,8 à 0,11 $ le million de mots et 404 mots par seconde, quand GPT-5.6 Sol monte à 60,9 pour 8 $.

━━━━━━━━━━━━━━━━━━━━

🛠️ OUTILS ET CODE

• hayamimi : transcrit la parole en temps réel directement sur ton ordinateur, sans carte graphique dédiée ni passage par le cloud. Multilingue, avec identification des intervenants et traduction en direct dans le navigateur. La réponse pour qui veut retranscrire des réunions confidentielles sans envoyer l'audio ailleurs. • FailoverAI : passerelle open source (code public, librement modifiable) qui redirige automatiquement les demandes d'image, de vidéo ou de texte vers un autre fournisseur en cas de panne. Utile dès que ton activité dépend d'une seule API. • n8n : la nouvelle version stable casse deux choses. Les appels d'API avec contenu exigent désormais un format JSON déclaré, et le paramètre offset disparaît de l'historique des workflows. Si tu as des automatisations en production, à vérifier avant qu'elles ne tombent. • Next.js : la version 16.3.3 corrige deux failles permettant à un attaquant non identifié d'exécuter du code à distance, l'une sur les serveurs Windows, l'autre via l'optimisation d'images AVIF. Si ton site ou celui de ton client tourne sous Next.js, la mise à jour est prioritaire.

━━━━━━━━━━━━━━━━━━━━

🎯 À TESTER AUJOURD'HUI

Ouvre l'onglet mémoire de Claude et fais le tri. Maintenant que le souvenir circule entre Chat et Cowork, ce qui y traîne influence toutes tes conversations : cinq minutes de nettoyage évitent des réponses calées sur un client que tu n'as plus.

━━━━━━━━━━━━━━━━━━━━

📝 SOURCES 1 → OpenAI : https://openai.com/index/jalapeno-first-results 2 → ChatGPT sur X : https://x.com/ChatGPT/status/2092366554965107164 3 → TestingCatalog sur X : https://x.com/testingcatalog/status/2092382971944702272 4 → Omar Sar sur X : https://x.com/omarsar0/status/2092326207077634351 5 → Aakash Gupta sur X : https://x.com/aakashgupta/status/2092395199846907939 6 → Sam Altman sur X : https://x.com/sama/status/2092339694210040187 7 → Perplexity sur X : https://x.com/perplexity_ai/status/2092321955836043587 8 → TLDR Newsletter sur X : https://x.com/tldrnewsletter/status/2092374814086627413 9 → Omar Sar sur X : https://x.com/omarsar0/status/2092412718573899970 10 → Haider sur X : https://x.com/haider1/status/2092348791668015190 11 → OpenAI Devs sur X : https://x.com/OpenAIDevs/status/2092344873764704345 12 → TestingCatalog sur X : https://x.com/testingcatalog/status/2092378535805526346 13 → shedntcare sur X : https://x.com/shedntcare_/status/2092472465566158998 14 → Nous Research sur X : https://x.com/NousResearch/status/2092326815193055681 15 → Antigravity sur X : https://x.com/antigravity/status/2092376671206912235 16 → Hasan sur X : https://x.com/hasantoxr/status/2092446601591873664 17 → Shushant sur X : https://x.com/shushant_l/status/2092472794898706541 18 → GitHub hayamimi : https://github.com/oboroge0/hayamimi 19 → GitHub FailoverAI : https://github.com/Reality-JH/FailoverAI 20 → GitHub n8n : https://github.com/n8n-io/n8n/releases/tag/stable 21 → GitHub Next.js : https://github.com/vercel/next.js/releases/tag/v16.3.3