🟧 RADAR IA : GPT-5.6 SOL DEVIENT UNIQUE SUR CHATGPT (07/08)
📡 RADAR IA · VENDREDI 7 AOÛT 2026
2 780 milliards de paramètres qui tournent sans le moindre GPU, sur 8 Go de RAM. C'est le fait technique du jour. Côté produit, ChatGPT change de modèle par défaut.
━━━━━━━━━━━━━━━━━━━━
AU SOMMAIRE
• GPT-5.6 Sol devient le modèle unique de ChatGPT • AMD rachète Taalas et grave les modèles dans le silicium • Kimi K3 tourne sans GPU dans 176 Ko de code • Claude Fable 5 desserre ses garde-fous santé • Meta place Muse Spark 1.2 sur la frontière coût-performance • 📌 En bref : 11 mouvements • 📊 Les chiffres du jour • 📅 Ce qui arrive • 🛠️ Outils et code : 3 entrées • 🎯 À tester aujourd'hui
━━━━━━━━━━━━━━━━━━━━
🔴 LE TOP DU JOUR
1️⃣ GPT-5.6 SOL DEVIENT LE MODÈLE UNIQUE DE CHATGPT
📌 Le fait OpenAI fusionne chat rapide et raisonnement dans un seul modèle, GPT-5.6 Sol. Un curseur permet de régler l'effort de réflexion selon la question posée. Les erreurs factuelles chutent de 68 % par rapport à GPT-5.5 Instant. Disponible pour les abonnés Plus et Pro.
📊 Les chiffres Erreurs factuelles : -68 % vs GPT-5.5 Instant Note globale Artificial Analysis (indice qui classe les modèles) : 60,9 en mode max Prix : 11,25 $ le million de tokens (unités de texte lues ou écrites) Vitesse : 68 tokens par seconde
🎯 Pour toi Fini l'arbitrage entre un modèle rapide et un modèle qui réfléchit : tu doses toi-même. Sur les dossiers où la précision compte, la baisse d'erreurs annoncée mérite un test comparatif sur tes propres documents.
🔗 OpenAI
━━━━━━━━━━━━━━━━━━━━
2️⃣ AMD RACHÈTE TAALAS, QUI GRAVE LES MODÈLES DANS LA PUCE
📌 Le fait AMD s'offre Taalas, une startup de Toronto. Sa technique : inscrire le modèle d'IA directement dans le silicium au lieu de le charger depuis la mémoire à chaque utilisation. Sa première puce de test fait tourner Llama 3.1 8B à près de 17 000 tokens par seconde. AMD prévoit de coupler cette approche avec ses GPU Instinct.
🎯 Pour toi La bataille des puces IA ne se joue plus seulement sur la puissance brute mais sur le coût du moment où l'IA produit sa réponse. Si ce type de matériel se généralise, le prix des appels IA que tu paies aujourd'hui n'est pas un plancher.
🔗 TLDR Newsletter
━━━━━━━━━━━━━━━━━━━━
3️⃣ KIMI K3 TOURNE SANS GPU, DANS 176 KO DE CODE
📌 Le fait Kimi K3, modèle frontière de 2 780 milliards de paramètres, tient désormais dans 176 Ko de code C99 pur. Au lieu de charger tout le modèle en mémoire, il va chercher ses experts sur le disque au fur et à mesure. Résultat : aucun GPU, aucun framework, 8 Go de RAM suffisent.
📊 Les chiffres 2 780 milliards de paramètres 176 Ko de code 8 Go de RAM requis 0 GPU
🎯 Pour toi L'argument « il faut du matériel hors de prix pour faire tourner un gros modèle chez soi » perd du terrain. Sujet à suivre de près si la confidentialité de tes données bloque l'usage du cloud.
🔗 Dr Cintas (X)
━━━━━━━━━━━━━━━━━━━━
4️⃣ CLAUDE FABLE 5 REFUSE 85 % DE MOINS DE QUESTIONS DE SANTÉ
📌 Le fait Anthropic recalibre les garde-fous biologiques de Claude Fable 5. Les faux positifs, ces refus injustifiés sur des questions de santé et d'éducation, chutent de 85 %. Fable continue de bloquer les demandes à double usage (virologie, toxicologie, conception moléculaire) et les redirige vers Opus 5.
🎯 Pour toi Si tu bosses dans la santé, la formation ou le conseil scientifique, les blocages qui cassaient tes sessions devraient largement diminuer. À vérifier sur les prompts qui échouaient encore la semaine dernière.
🔗 Claude (X)
━━━━━━━━━━━━━━━━━━━━
5️⃣ META PLACE MUSE SPARK 1.2 SUR LA FRONTIÈRE COÛT-PERFORMANCE
📌 Le fait Muse Spark 1.2, le modèle de Meta, entre sur la frontière de Pareto coût-performance de l'indice Artificial Analysis, c'est-à-dire la ligne des modèles qu'aucun concurrent ne bat à la fois sur le prix et sur la qualité. Il livre une intelligence comparable à Claude Opus 4.8 pour un cinquième du prix.
📊 Les chiffres 4,25 $ le million de tokens en mode xhigh Un cinquième du prix pour un niveau comparable à Claude Opus 4.8
🎯 Pour toi Sur les volumes importants (traitement de masse de documents, agents qui tournent en continu), le facteur cinq change l'équation budgétaire. Le point à vérifier reste la qualité sur tes cas précis, pas sur les benchmarks.
🔗 Artificial Analysis (X)
━━━━━━━━━━━━━━━━━━━━
📌 EN BREF
• Codex Security Review : l'outil d'OpenAI passe en preview recherche et examine automatiquement chaque proposition de modification de code sur GitHub, avec le contexte complet du dépôt, résultats affichés directement dans la demande.
• OpenAI et l'APA : partenariat avec l'Association américaine de psychologie pour encadrer l'usage de l'IA dans la santé mentale des jeunes, avec guides, ressources et garde-fous.
• Qwen3.8 Max : le modèle d'Alibaba passe numéro un de l'indice agentique d'Artificial Analysis, qui mesure la capacité à enchaîner des actions plutôt qu'à répondre à une question.
• WeatherNext : le modèle météo de Google DeepMind franchit un cap en prédiction de cyclones, sur la trajectoire comme sur l'intensité des phénomènes tropicaux.
• IA locale : un modèle Qwen dense de 27 milliards de paramètres bat désormais le Llama 405B d'il y a 21 mois, sur la même carte RTX 3090.
• Cognition : -40 % sur le coût d'un niveau d'intelligence équivalent à Fable, en faisant planifier le modèle le plus puissant et coder les modèles moins chers.
• Genspark : la startup, qui construit un moteur de recherche piloté par agents, rejoint la communauté des licornes du Forum économique mondial et siégera à Davos.
• Perplexity Computer : GPT-5.6 Terra devient le modèle par défaut des sous-agents, GPT-5.6 Luna gère les automatisations planifiées, Terra est aussi disponible comme chef d'orchestre.
• Wan 3.0 : Alibaba génère des vidéos natives de 30 secondes en acceptant des références au-delà du texte et de l'image (audio, vidéo, et même un tableur), en open source, code public et librement modifiable.
• MiniMax H3 : sortie en open source d'un générateur vidéo avec audio natif, qui tourne sur une carte bien inférieure à une RTX 5090 et clone une voix de manière cohérente d'une vidéo à l'autre.
• Seedance 2.5 : arrive sur Dreamina avec montage vidéo direct, jusqu'à 50 références simultanées, découpage temporel par intervalles et plug-in Blender/Maya.
━━━━━━━━━━━━━━━━━━━━
📊 LES CHIFFRES DU JOUR
• Claude Fable 5 mène le classement Texte de LM Arena avec 1507 points sur 19 390 votes, et tient aussi la première place en Vision. • Écart à surveiller : Claude Opus 5 en effort maximum note 63,1 sur l'indice Artificial Analysis à 10 $ le million de tokens, quand Claude Fable 5 note 62,1 à 20 $. Deux fois le prix pour une note légèrement en dessous. • Prix plancher utile : Ling-3.0-flash, signé InclusionAI, affiche 37,8 d'indice à 0,11 $ le million de tokens et 335 tokens par seconde. • Images : GPT-Image 2 domine à la fois la génération (1380) et la retouche (1463), avec 165 278 votes sur l'édition.
━━━━━━━━━━━━━━━━━━━━
📅 CE QUI ARRIVE
• Enceinte connectée OpenAI, sans écran, en forme de donut, avec parties mobiles et lumières signalant l'écoute : sortie prévue en 2027, prix annoncé au-dessus de 300 $, information rapportée par Bloomberg.
━━━━━━━━━━━━━━━━━━━━
🛠️ OUTILS ET CODE
• Claude Code v2.1.224 : les sessions peuvent maintenant se parler entre elles, et la limite de 200 sous-agents saute. Concrètement, tu peux faire tourner plusieurs assistants en parallèle sur un même projet sans plafond. Les équipes Team et Enterprise gagnent aussi un exécuteur hébergé chez elles. Un correctif de sécurité ferme un contournement des restrictions d'accès aux fichiers.
• Codex CLI 0.147.0 : l'outil en ligne de commande d'OpenAI importe désormais les skills de Cursor, ces mini-modes d'emploi que tu écris une fois et que l'IA réutilise. Il ajoute aussi des auto-approbations pour ne plus valider chaque action à la main. Attention si tu as des scripts existants : l'option --full-auto est supprimée.
• Aetheris : ce projet open source orchestre six agents pour mener une recherche académique sur 60 bases scientifiques, du sujet jusqu'à un papier complet, via 101 skills. Piste à regarder pour qui produit des notes documentées ou de la veille sectorielle.
━━━━━━━━━━━━━━━━━━━━
🎯 À TESTER AUJOURD'HUI
Ouvre ChatGPT et joue avec le curseur d'effort de GPT-5.6 Sol sur une même question posée deux fois. Compare la réponse rapide et la réponse en effort maximum sur un de tes dossiers réels : c'est le meilleur moyen de savoir où tu peux économiser du temps sans perdre en fiabilité.
━━━━━━━━━━━━━━━━━━━━
📝 SOURCES 1 → OpenAI (X) : https://x.com/OpenAI/status/2085434712429052386 2 → TLDR Newsletter (X) : https://x.com/tldrnewsletter/status/2085482891325342185 3 → Dr Cintas (X) : https://x.com/dr_cintas/status/2085475960543924334 4 → Claude (X) : https://x.com/claudeai/status/2085563808773189680 5 → Artificial Analysis (X) : https://x.com/ArtificialAnlys/status/2085509023852572804 6 → OpenAI Devs (X) : https://x.com/OpenAIDevs/status/2085482310636560830 7 → OpenAI : https://openai.com/index/openai-and-apa-partner-to-advance-responsible-ai 8 → Artificial Analysis : https://artificialanalysis.ai/?intelligence=agentic-index 9 → Google DeepMind : https://deepmind.google/blog/weathernext-ai-model-achieves-breakthrough-in-forecasting-cyclones/ 10 → AI Engineer (X) : https://x.com/aiDotEngineer/status/2085539602559848464 11 → Genspark (X) : https://x.com/genspark_ai/status/2085463565490966835 12 → Perplexity (X) : https://x.com/perplexity_ai/status/2085442634240438307 13 → AngryTom (X) : https://x.com/AngryTomtweets/status/2085488883580768361 14 → MattVidPro (X) : https://x.com/MattVidPro/status/2085516626808431050 15 → Kimmonismus (X) : https://x.com/kimmonismus/status/2085450717805097038 16 → Bloomberg via Kimmonismus (X) : https://x.com/kimmonismus/status/2085484280726057300 17 → GitHub Anthropic : https://github.com/anthropics/claude-code/releases/tag/v2.1.224 18 → GitHub OpenAI : https://github.com/openai/codex/releases/tag/rust-v0.147.0 19 → GitHub Aetheris : https://github.com/shiqiaoshangxue/aetheris