Retour au radar

🟧 RADAR IA : ANTHROPIC LANCE CLAUDE FABLE 5.1 (02/09)

📡 RADAR IA · MERCREDI 2 SEPTEMBRE 2026

55,8 % contre 42 %. C'est l'écart entre Claude Fable 5.1 et Fable 5 sur les tâches de codage en terminal, à prix inchangé. Et OpenAI annonce dans la foulée le premier modèle classé "Critique" en cybersécurité.

━━━━━━━━━━━━━━━━━━━━

AU SOMMAIRE

• Claude Fable 5.1 sort, les sessions longues coûtent jusqu'à 45 % moins cher • OpenAI annonce Astra, premier modèle au seuil "Critique" en cybersécurité • Gemini regarde les vidéos en décidant quoi regarder, 88 % de tokens en moins • Le prix de Fable 5.1 face à Opus 5 fait débat • Perplexity branche Fable 5.1 sur son agent Computer • 6 brèves • Les chiffres du jour • 4 échéances datées • 4 outils et sorties de code • L'action du jour

━━━━━━━━━━━━━━━━━━━━

🔴 LE TOP DU JOUR

1️⃣ CLAUDE FABLE 5.1 SORT, LES SESSIONS LONGUES COÛTENT JUSQU'À 45 % MOINS CHER

📌 Le fait Anthropic met en ligne Claude Fable 5.1 dans Claude Code et sur la plateforme Claude. Le modèle va plus loin dans une tâche longue avant de solliciter l'utilisateur et signale mieux ses blocages. Son style d'écriture est décrit comme plus naturel. Le prix affiché ne bouge pas par rapport à Fable 5, mais la relecture des documents déjà envoyés (le cache) chute de 75 %.

📊 Les chiffres Terminal-Bench 4.0 dans Claude Code, banc d'essai qui mesure l'exécution de tâches en ligne de commande : 55,8 % pour Fable 5.1, 52,3 % pour Opus 5, 42 % pour Fable 5 Coût des sessions longues facturées au tarif API : de 25 % à 45 % en moins Lectures en cache : 0,25 $ le million de tokens (unités de texte), contre 1 $ auparavant

🎯 Pour toi Si tu fais tourner de longues sessions sur un même dossier de documents, c'est là que la facture baisse : le modèle relit quatre fois moins cher ce qu'il a déjà vu.

🔗 Claude Developers sur X

━━━━━━━━━━━━━━━━━━━━

2️⃣ OPENAI ANNONCE ASTRA, PREMIER MODÈLE CLASSÉ "CRITIQUE" EN CYBERSÉCURITÉ

📌 Le fait Sam Altman annonce le lancement imminent d'Astra. C'est le premier modèle d'OpenAI à franchir le seuil de capacité "Critique" en cybersécurité selon le cadre de préparation interne de l'entreprise. OpenAI dit avoir ralenti le rythme de sortie pour garantir la sûreté des modèles suivants, et avoir renforcé les garde-fous en parallèle des capacités.

📊 Les chiffres ExploitBench : saturé à 100 % Nouveau banc d'essai construit à partir de bugs réels divulgués après l'entraînement : 39 % pour Astra à 74k tokens, contre 11,5 % pour Sol à 134k tokens 2 failles zero-day (inconnues de l'éditeur du logiciel) trouvées et enchaînées pendant l'évaluation

🎯 Pour toi Un modèle grand public capable d'enchaîner deux failles inédites, ça déplace la conversation sécurité de la théorie au budget. Sujet à poser à ton prestataire informatique cette semaine.

🔗 Sam Altman sur X

━━━━━━━━━━━━━━━━━━━━

3️⃣ GEMINI REGARDE LES VIDÉOS EN DÉCIDANT QUOI REGARDER

📌 Le fait Google DeepMind active une compréhension vidéo dite agentique dans Gemini. Au lieu de traiter un fichier à vitesse fixe du début à la fin, le modèle décide activement quoi regarder, à quelle vitesse, et par quel canal : images, audio ou transcription. Google annonce une précision améliorée en parallèle de la baisse de consommation.

📊 Les chiffres Consommation de tokens : jusqu'à 88 % en moins Coût : jusqu'à 66 % en moins

🎯 Pour toi Analyser des heures de réunions filmées, de visites de chantier ou de webinaires devient nettement moins coûteux. Le cas d'usage à tester en premier : le compte rendu automatique de vidéos longues.

🔗 Google DeepMind sur X

━━━━━━━━━━━━━━━━━━━━

4️⃣ LE PRIX DE FABLE 5.1 FACE À OPUS 5 FAIT DÉBAT

📌 Le fait L'écart tarifaire entre les deux modèles d'Anthropic est contesté publiquement. Fable 5.1 bat Opus 5 sur la plupart des évaluations, mais de justesse, alors qu'il coûte deux fois plus cher. L'analyse pointe aussi que les filtres de sécurité de Fable lui retirent des points face à Mythos 5.1, le même modèle sans filtres, et que l'essentiel de son avance vient du banc d'essai science, celui où l'incertitude de mesure est la plus large.

📊 Les chiffres Écart avec Opus 5 : 3 à 5 points sur la plupart des évaluations Coût des filtres de sécurité : 5 points face à Mythos 5.1 Barres d'erreur sur le benchmark science : jusqu'à 4,5 points

🎯 Pour toi Lecture possible : avant de basculer tous tes usages sur le modèle le plus cher, mesure sur tes propres tâches. Un écart de 3 points dans un test public ne se voit pas forcément sur ton flux de travail réel.

🔗 Aakash Gupta sur X

━━━━━━━━━━━━━━━━━━━━

5️⃣ PERPLEXITY BRANCHE FABLE 5.1 SUR SON AGENT COMPUTER

📌 Le fait Perplexity intègre Claude Fable 5.1 dans Perplexity Computer, son agent qui exécute des tâches à la place de l'utilisateur. L'accès est ouvert aux abonnés Pro et Max. Perplexity publie ses propres mesures : le modèle arrive premier de son évaluation WANDR du mois d'août.

📊 Les chiffres Score WANDR d'août : 0,601, soit 21 % de mieux que Fable 5 Coût par tâche : 12,76 $, soit 37 % de moins que Fable 5

🎯 Pour toi Un chiffre rare et utile : le coût complet d'une tâche exécutée par un agent, pas seulement le prix du modèle. C'est cette unité de mesure qu'il faut réclamer à tout prestataire qui te vend un agent.

🔗 Perplexity sur X

━━━━━━━━━━━━━━━━━━━━

📌 EN BREF

• Anthropic verrouille contre la distillation (copie du raisonnement d'un modèle par un concurrent) : l'édition du contexte avant les blocs de réflexion est désormais bloquée dans les conversations à plusieurs tours, pour les nouveaux comptes sur Fable 5.1.

• Google teste en interne Gemini 3.8 Flash dans Jetski, son outil de codage : les ingénieurs l'ont préféré à Opus 5 d'Anthropic, rapporte le Wall Street Journal.

• openJiuwen, un harnais open source (code public, librement modifiable) pour agents de codage, atteint 82,6 % sur SWE-bench Verified et 87,19 % sur Terminal-Bench 2.1, devant les meilleures entrées officielles. Les gains viennent de l'enveloppe autour du modèle, pas du modèle.

• Mémoire des agents : un papier compare la mémoire structurée en graphe à la recherche vectorielle classique sur le long terme. Le graphe perd, avec un score F1 de 0,42 contre 0,47, surtout quand il faut se souvenir d'un échange précédent. L'élagage marche bien : 9,8 % des nœuds supprimés sans perte.

• Higgsfield lance Genjutsu, qui applique des effets visuels de qualité professionnelle sur des vidéos brutes. Cible annoncée : les cinéastes qui intègrent l'IA en production.

• NVIDIA sort DLSS 5, sa technologie de rendu neuronal guidé par la 3D : cinq fois plus rapide en six mois, et elle tourne désormais sur une seule RTX 5090. Disponible sur toute la gamme GeForce RTX 50 et sur GeForce NOW.

━━━━━━━━━━━━━━━━━━━━

📊 LES CHIFFRES DU JOUR

• Sur WebDev, Qwen 3.8 Max prend la tête du classement LM Arena à Claude Opus 5 Max, après un gain de 22 points obtenu par une seule mise à jour de post-entraînement. • Indice Artificial Analysis, la note globale qui classe les modèles : Fable 5.1 en tête à 65,7 pour 20 $ le million de tokens, devant Opus 5 à 63,1 pour 10 $. • Meilleur rapport qualité-prix du jour : Ling 3.0 Flash, note de 37,8 pour 0,11 $ le million de tokens, à 371 tokens par seconde. • Sur LM Arena, Claude Fable 5 garde la première place en Texte (1508) et en Vision (1313), gpt-image-2 domine la génération et l'édition d'images.

━━━━━━━━━━━━━━━━━━━━

📅 CE QUI ARRIVE

• Gemini 3.8 Flash : ce mercredi ou jeudi, selon le Wall Street Journal. • Keynote entreprises d'OpenAI sur la façon dont l'IA de pointe redéfinit la cybersécurité : jeudi 13h heure du Pacifique, avec le cofondateur Greg Brockman, contre 10h pour les lancements habituels. • DLSS 5 de NVIDIA : le 3 septembre, avec NBA 2K27 comme premier jeu supporté. • Vague de sorties annoncée dans les dix prochains jours : Astra, Grok 4.7, et peut-être Opus 5.1.

━━━━━━━━━━━━━━━━━━━━

🛠️ OUTILS ET CODE

• Claude Code passe en 2.1.258 : Fable 5.1 devient le modèle par défaut avec 1 million de tokens de contexte, un sélecteur de modèle et une section Compte/Usage arrivent dans VSCode, et le crash au lancement sur macOS 12 est corrigé. Attention si tu as une configuration locale : le mode "bypassPermissions" y est désormais ignoré, il faut le définir dans les paramètres utilisateur.

• meta-ads-skill : un module qui apprend à un agent IA à piloter des campagnes publicitaires Meta de bout en bout. À regarder si tu gères de l'acquisition payante.

• gojiberryai-sales-os : automatise une équipe commerciale complète via un serveur MCP, le connecteur qui permet à Claude de parler à un autre outil. Utile pour voir comment on branche une IA sur un cycle de vente.

• zodchiy : audite l'architecture d'un logiciel en mesurant le coût réel de chaque défaut à partir de l'historique des versions. Intéressant si tu fais évaluer du code livré par un prestataire.

━━━━━━━━━━━━━━━━━━━━

🎯 À TESTER AUJOURD'HUI

Relance une de tes sessions Claude Code les plus longues avec Fable 5.1 et compare ta facture d'hier à celle d'aujourd'hui. Avec des lectures en cache passées de 1 $ à 0,25 $ le million de tokens, c'est le seul test qui te dira si l'économie annoncée se voit sur ton usage réel.

━━━━━━━━━━━━━━━━━━━━

📝 SOURCES 1 → Claude Developers sur X : https://x.com/ClaudeDevs/status/2094851229734277228 2 → Claude Developers sur X (tarifs) : https://x.com/ClaudeDevs/status/2094851235694497836 3 → Claude Developers sur X (distillation) : https://x.com/ClaudeDevs/status/2094851238219403582 4 → Sam Altman sur X : https://x.com/sama/status/2094934592062959832 5 → Chetas Lua sur X (benchmarks Astra) : https://x.com/chetaslua/status/2095013971782996291 6 → Synthwave sur X (keynote OpenAI) : https://x.com/synthwavedd/status/2094961700885651538 7 → Google DeepMind sur X : https://x.com/GoogleDeepMind/status/2094840179676660097 8 → Kimmonismus sur X (Gemini 3.8 Flash) : https://x.com/kimmonismus/status/2094913109185962199 9 → Aakash Gupta sur X : https://x.com/aakashgupta/status/2094928539875496191 10 → Perplexity sur X : https://x.com/perplexity_ai/status/2094865042873467261 11 → LexnLin sur X (vague de modèles) : https://x.com/LexnLin/status/2095007607027294246 12 → LexnLin sur X (Qwen) : https://x.com/LexnLin/status/2095002980944871847 13 → Omar Sanseviero sur X (openJiuwen) : https://x.com/omarsar0/status/2094883750996013457 14 → Omar Sanseviero sur X (mémoire des agents) : https://x.com/omarsar0/status/2094972586358927466 15 → Higgsfield AI sur X : https://x.com/higgsfield_ai/status/2094932147257884857 16 → TLDR Newsletter sur X : https://x.com/tldrnewsletter/status/2094911642714698015