🟧 RADAR IA : NVIDIA AUGMENTE SES SERVEURS DE 15% (24/08)
📡 RADAR IA · LUNDI 24 AOÛT 2026
62 %. C'est la part des tokens (unités de texte qu'un modèle lit ou écrit) servis par des modèles ouverts sur Vercel, contre 28 % il y a deux mois. Le coût devient le premier critère de choix.
━━━━━━━━━━━━━━━━━━━━
AU SOMMAIRE
• Nvidia relève de 15 % le prix de ses serveurs IA • Les modèles ouverts doublent leur part sur Vercel • Anthropic admet publiquement les défauts d'Opus 5 • Perplexity discuterait une valorisation à 30 milliards • 4 brèves • Les chiffres du jour • 3 outils repérés • L'action du jour
━━━━━━━━━━━━━━━━━━━━
🔴 LE TOP DU JOUR
1️⃣ NVIDIA ANNONCE 15 % DE HAUSSE SUR SES SERVEURS IA
📌 Le fait Nvidia a prévenu Microsoft, Google et Oracle d'une hausse de 15 % du prix de ses serveurs IA dès début 2026. La justification donnée ne porte pas sur les puces mais sur la mémoire, dont le coût grimpe. Les trois destinataires sont précisément ceux qui revendent de la puissance de calcul au reste du marché.
🎯 Pour toi Une hausse chez le fournisseur des fournisseurs finit rarement absorbée en silence. Si tu as des coûts d'IA en production ou un budget cloud négocié pour 2026, c'est le moment de regarder les clauses de révision de prix.
🔗 X / @heyshrutimishra
━━━━━━━━━━━━━━━━━━━━
2️⃣ LES MODÈLES OUVERTS PASSENT DE 28 À 62 % DES TOKENS SUR VERCEL
📌 Le fait Sur Vercel, plateforme d'hébergement d'applications web très utilisée par les développeurs, la part des tokens servis par des modèles ouverts (dont les paramètres sont publics et réutilisables hors du fournisseur) a plus que doublé en deux mois. Le Financial Times relie la baisse d'usage de Claude Fable 5 à son coût. Le basculement ne se fait pas sur la qualité mais sur la facture.
📊 Les chiffres Part des modèles ouverts il y a deux mois : 28 % Part aujourd'hui : 62 %
🎯 Pour toi Le signal vaut au-delà des développeurs : le haut de gamme n'est plus le réflexe par défaut pour les tâches répétitives. Si tu fais construire un outil interne, la question du modèle utilisé mérite d'être posée ligne par ligne.
🔗 X / @kimmonismus
━━━━━━━━━━━━━━━━━━━━
3️⃣ ANTHROPIC RECONNAÎT LES DÉFAUTS D'OPUS 5
📌 Le fait Anthropic admet publiquement qu'Opus 5 n'est pas parfait et fait de sa correction une priorité. C'est la première reconnaissance officielle des critiques accumulées sur le modèle depuis sa sortie. L'éditeur ne détaille ni les défauts visés, ni le calendrier.
🎯 Pour toi Si tu as constaté des régressions sur tes usages Claude ces dernières semaines, tu n'étais pas seul. Documenter précisément ce qui coince chez toi te servira au moment de la correction.
🔗 X / @kimmonismus
━━━━━━━━━━━━━━━━━━━━
4️⃣ 🟡 Rumeur non confirmée : NVIDIA EN DISCUSSION SUR PERPLEXITY À 30 MILLIARDS
📌 Le fait Nvidia discuterait d'un investissement dans Perplexity sur la base d'une valorisation de 30 milliards de dollars. L'information n'est pas confirmée par les parties. Le moteur de recherche IA était valorisé 20 milliards il y a moins d'un an.
📊 Les chiffres Valorisation discutée : 30 milliards de dollars Valorisation il y a moins d'un an : 20 milliards de dollars
🎯 Pour toi Le fabricant de puces qui entre au capital de ses propres clients, c'est un schéma à surveiller : il brouille la frontière entre fournisseur et investisseur dans toute la chaîne IA.
🔗 X / @heyshrutimishra
━━━━━━━━━━━━━━━━━━━━
📌 EN BREF
• DeepSeek : le chinois supprime depuis le 23 août l'écart de prix entre heures pleines et heures creuses le week-end. La tarification se simplifie pour qui traite du volume le samedi et le dimanche.
• Projet Marin : Andrew Ng met en avant une initiative qui publie code, données et recettes d'entraînement. Rare : la plupart des acteurs ouvrent le modèle final, pas la méthode qui y mène.
• Perplexity Computer : un sélecteur d'effort granulaire est en préparation, pour choisir combien de puissance une tâche consomme. Objectif affiché, réduire la consommation de crédits.
• Grok : le mode vocal de l'IA d'xAI gagne deux voix, Aurora et Liora.
━━━━━━━━━━━━━━━━━━━━
📊 LES CHIFFRES DU JOUR
• Sur l'indice Artificial Analysis (note globale qui classe les modèles), Claude Opus 5 en effort maximal mène à 63,1 pour 10 $ le million de tokens. Claude Fable 5 le suit à 62,1 mais facture 20 $, soit le double pour un point de moins.
• GPT-5.6 Sol d'OpenAI note 60,9 à 11,25 $ le million, avec 78 tokens par seconde contre 53 pour Opus 5 : plus rapide, un cran en dessous en qualité.
• Prix plancher utile : Ling 3.0 Flash tourne à 0,11 $ le million pour 37,8 d'indice et 406 tokens par seconde. Chez Alibaba, Qwen3.5 4B descend à 0,06 $ le million.
• Sur les classements publics LM Arena, Claude Fable 5 domine le texte (1508 points, 24 331 votes) et la vision, gpt-image-2 tient la génération et la retouche d'images (1463 points et 199 275 votes sur l'édition).
━━━━━━━━━━━━━━━━━━━━
🛠️ OUTILS ET CODE
• watermark-remover : ce projet efface les filigranes des générateurs d'images IA et purge les métadonnées C2PA, le marquage invisible qui indique qu'un fichier a été produit par une IA, sur sept formats. 760 étoiles en une nuit sur GitHub. À connaître si tu comptais sur ce marquage pour prouver l'origine d'un visuel : il se retire.
• rome : orchestre plusieurs agents Claude Code et Codex en parallèle, comme un système d'exploitation qui répartit les tâches. Pour ceux qui pilotent déjà plusieurs agents et perdent le fil entre eux.
• better-voice : dictée vocale qui tient compte de ce qui est affiché à l'écran au moment où tu parles. Utile quand tu commentes un document sans avoir à décrire le contexte à chaque phrase.
━━━━━━━━━━━━━━━━━━━━
🎯 À TESTER AUJOURD'HUI
Prends une tâche IA que tu fais tourner en volume (résumés, extractions, reformulations) et refais-la tourner sur un modèle ouvert bon marché type Ling 3.0 Flash. Compare le résultat au modèle haut de gamme que tu paies aujourd'hui : c'est exactement l'arbitrage que 62 % du trafic Vercel vient de trancher.
━━━━━━━━━━━━━━━━━━━━
📝 SOURCES 1 → X / @heyshrutimishra : https://x.com/heyshrutimishra/status/2091711683962048746 2 → X / @kimmonismus : https://x.com/kimmonismus/status/2091659039562219818 3 → X / @kimmonismus : https://x.com/kimmonismus/status/2091636964894347330 4 → X / @heyshrutimishra : https://x.com/heyshrutimishra/status/2091741964475703458 5 → X / @kimmonismus : https://x.com/kimmonismus/status/2091578220084691058 6 → X / @AndrewYNg : https://x.com/AndrewYNg/status/2091688153048645650 7 → X / @testingcatalog : https://x.com/testingcatalog/status/2091626197490798616 8 → X / @testingcatalog : https://x.com/testingcatalog/status/2091607082013270215 9 → GitHub : https://github.com/ShadowAqueduct/watermark-remover 10 → GitHub : https://github.com/rome-os/rome 11 → GitHub : https://github.com/TarunTomar122/better-voice