🟧 RADAR IA : GPT-6 ASTRA DÉTRÔNE CLAUDE SUR WEBDEV (06/09)
📡 RADAR IA · DIMANCHE 6 SEPTEMBRE 2026
GPT-6 Astra détrône Claude sur le classement WebDev avec 35 points d'avance. Le même jour, New York et Los Angeles interdisent l'IA dans leurs écoles.
━━━━━━━━━━━━━━━━━━━━
AU SOMMAIRE
• GPT-6 Astra prend la tête du classement WebDev • Moratoire IA dans les deux plus grands districts scolaires américains • Gemini Business ouvre les connecteurs MCP personnalisés • Claude Code laisse ses agents créer des sous-agents • Artificial Analysis change sa façon de noter les modèles • 📌 En bref : 8 mouvements • 📊 Les chiffres du jour • 🛠️ Outils et code : 4 entrées • 🎯 À tester aujourd'hui
━━━━━━━━━━━━━━━━━━━━
🔴 LE TOP DU JOUR
1️⃣ GPT-6 ASTRA PREND LA TÊTE DU CLASSEMENT WEBDEV
📌 Le fait GPT-6 Astra, le modèle d'OpenAI, passe premier du classement WebDev Arena, celui qui mesure la capacité à construire des interfaces web. Il dépasse Claude Fable 5.1 d'Anthropic de 35 points. Le modèle chinois Qwen 3.8 Max sort du top 3 dans le même mouvement. TestingCatalog signale aussi qu'il redessine la frontière prix-performance à 40 dollars le million de tokens (unité de texte que l'IA lit ou écrit).
📊 Les chiffres Score WebDev de GPT-6 Astra Max : 1797 points, sur 1199 votes Écart avec Claude Fable 5.1 : 35 points Prix cité : 40 $ le million de tokens
🎯 Pour toi Si tu fais générer des maquettes ou des pages web par une IA, le classement bascule côté OpenAI. Sur le texte pur, Claude reste devant : le choix du modèle dépend encore de la tâche.
🔗 TestingCatalog
━━━━━━━━━━━━━━━━━━━━
2️⃣ NEW YORK ET LOS ANGELES INTERDISENT L'IA DANS LEURS ÉCOLES
📌 Le fait Les deux plus grands districts scolaires des États-Unis, New York et Los Angeles, imposent un moratoire sur l'utilisation de l'IA dans les établissements. Décision simultanée des deux plus gros réseaux publics du pays. Le signal est politique autant que pédagogique.
🎯 Pour toi Lecture possible : les organisations qui accueillent du public ou des mineurs commencent à documenter un refus formel de l'IA. Si tu vends de la formation ou du conseil à des structures publiques, l'argument « usage interdit en interne » va revenir dans les objections.
🔗 Tech Policy Press
━━━━━━━━━━━━━━━━━━━━
3️⃣ GEMINI BUSINESS OUVRE LES CONNECTEURS MCP PERSONNALISÉS
📌 Le fait Google autorise désormais les connecteurs MCP sur mesure dans Gemini Business, sa version entreprise. MCP, c'est le standard qui permet à une IA de parler directement à un autre outil. Concrètement, tes données privées et tes logiciels internes se branchent dans l'assistant sans passer par un copier-coller.
🎯 Pour toi C'est le même principe que les connecteurs Claude, appliqué à l'écosystème Google. Si ton entreprise vit dans Workspace, l'écart d'intégration avec Anthropic et OpenAI se resserre. Sujet à poser à ton prestataire IT cette semaine.
🔗 TestingCatalog
━━━━━━━━━━━━━━━━━━━━
4️⃣ CLAUDE CODE LAISSE SES AGENTS CRÉER DES SOUS-AGENTS
📌 Le fait Anthropic ajoute un outil create_session à Claude Code, son outil de développement assisté. Un agent peut maintenant créer nativement ses propres sous-agents et poursuivre sa lignée de travail. Jusqu'ici, il fallait bricoler avec de la compaction de contexte ou des transferts manuels d'historique.
🎯 Pour toi Traduction : une tâche longue peut se découper toute seule en sous-tâches sans perdre le fil. Pour qui fait construire des automatisations, ça réduit la casse sur les projets qui dépassent une session de travail.
🔗 Paradite
━━━━━━━━━━━━━━━━━━━━
5️⃣ ARTIFICIAL ANALYSIS CHANGE SA FAÇON DE NOTER LES MODÈLES
📌 Le fait Artificial Analysis passe son indice d'intelligence en version 4.2. Deux nouveaux tests entrent : AA-Briefcase, qui mesure les tâches agentiques longues, et GDP.pdf, qui évalue le raisonnement sur des milliers de documents. Le test GPQA Diamond est retiré, jugé saturé : trop de modèles y font un sans-faute.
📊 Les chiffres Version de l'indice : 4.2 Tête du classement : Claude Fable 5.1 à 56,8 points, pour 20 $ le million de tokens Deuxième : GPT-6 Astra Max à 54,7 points, à 20 $ le million également
🎯 Pour toi Le classement de référence bascule vers deux critères qui te concernent directement : tenir une tâche longue et digérer beaucoup de documents. Les notes vont bouger, y compris pour des modèles que tu utilises déjà.
🔗 Artificial Analysis
━━━━━━━━━━━━━━━━━━━━
📌 EN BREF
• xAI : Grok Imagine Agent bascule sur le modèle Image 2.0, avec une génération améliorée pour les visuels publicitaires. • OpenClaw : la version 2026.9.2 intègre GPT-6 Astra, ajoute la reprise de session là où tu t'étais arrêté et accélère les longues conversations. • Vercel AI SDK : la boîte à outils qui relie les applis aux modèles ajoute les réglages de raisonnement pour GPT-6. • Codex Astra Luna Orchestrator : un projet qui fait travailler deux agents en binôme, Astra planifie, Luna exécute. 78 étoiles sur GitHub. • Claude ADHD : une extension qui envoie des rappels sur les conversations Claude Code laissées en plan. 71 étoiles. • LLM API Speedtest : un outil qui chronomètre les modèles d'IA, temps de première réponse et vitesse de génération. Utile pour arbitrer un fournisseur sur autre chose que le prix affiché. • Human Atlas : 2 234 modèles 3D d'anatomie humaine explorables par couches, avec recherche. 544 étoiles, le repo le plus suivi du jour. • Supabase CLI : la version 0.4.0 de la config ajoute le contrôle d'exposition des workers et un réglage du nombre d'instances.
━━━━━━━━━━━━━━━━━━━━
📊 LES CHIFFRES DU JOUR
• Sur le texte, Claude Fable 5 garde la tête : 1507 points sur 27 189 votes. • Sur l'édition d'images, GPT Image 2 domine avec 1461 points et 228 827 votes, le classement le plus fourni de tous. • Vidéo : Gemini Omni 1.1 Flash mène sur texte-vers-vidéo (1515), MiniMax H3 sur image-vers-vidéo (1497). • Rapport qualité-prix du jour : Agnes 2.5 Pro Beta affiche 39,5 d'intelligence pour 0,15 $ le million de tokens, soit plus de 130 fois moins cher que les modèles du top 5. • Prix plancher utile : Ling 3.0 Flash, 0,11 $ le million et 347 tokens par seconde, pour du volume à traiter vite.
━━━━━━━━━━━━━━━━━━━━
🛠️ OUTILS ET CODE
• OKF Agent Memory : donne une mémoire durable aux agents de codage, stockée directement dans Git, l'outil qui archive les versions d'un projet. Ton agent retrouve le contexte d'une session à l'autre, avec 80 % de tokens consommés en moins selon le projet. 51 points sur Hacker News. • Codenotch : affiche en permanence à l'écran tes quotas d'usage Claude Code, Cursor et Codex. Bête et efficace si tu as déjà été coupé en plein travail. 322 étoiles. • Short Video Generator AI : découpe des vidéos YouTube en clips courts avec sous-titres et voix off. Pour qui recycle des webinaires ou des interviews en contenu social. 315 étoiles. • MobileCode : construit et prévisualise des applications iOS et Android depuis un dérivé d'opencode. À regarder si tu envisages un prototype mobile sans équipe dédiée.
━━━━━━━━━━━━━━━━━━━━
🎯 À TESTER AUJOURD'HUI
Compare toi-même GPT-6 Astra et Claude Fable 5.1 sur une tâche d'interface web, la seule où le classement vient de basculer. Donne le même brief aux deux, une page de présentation client par exemple, et regarde si les 35 points d'écart se voient à l'oeil nu sur ton usage réel.
━━━━━━━━━━━━━━━━━━━━
📝 SOURCES 1 → TestingCatalog (GPT-6 Astra) : https://x.com/testingcatalog/status/2096350628054176240 2 → Tech Policy Press : https://www.techpolicy.press/americas-two-largest-school-districts-impose-ai-moratoriums/ 3 → TestingCatalog (Gemini Business) : https://x.com/testingcatalog/status/2096357644491456542 4 → Paradite : https://x.com/paradite_/status/2096457384650780793 5 → Artificial Analysis : https://x.com/ArtificialAnlys/status/2096395066747306102 6 → OpenClaw : https://x.com/openclaw/status/2096367438443262091 7 → TestingCatalog (Grok Imagine) : https://x.com/testingcatalog/status/2096332080929968424 8 → GitHub (OKF Agent Memory) : https://github.com/okf-memory/okf-agent-memory