Retour au radar

🟧 RADAR IA : OX ALPHA EST LE CHINOIS GLM-5.3 (22/08)

📡 RADAR IA · SAMEDI 22 AOÛT 2026

Ox Alpha a enfin un nom : GLM-5.3, signé Zhipu AI, en Chine. Le même jour, OpenAI baisse ses prix pour la deuxième fois en une semaine.

━━━━━━━━━━━━━━━━━━━━

AU SOMMAIRE

• Ox Alpha démasqué : c'est GLM-5.3, de Zhipu AI • OpenAI casse encore le prix de GPT-5.6 Sol • Anthropic recrute le père des puces TPU de Google • Codex passe de 3 à 20 millions d'utilisateurs • 7 mouvements en bref • Les chiffres du jour • Ce qui arrive • 4 outils et versions à connaître • 1 action à tester

━━━━━━━━━━━━━━━━━━━━

🔴 LE TOP DU JOUR

1️⃣ OX ALPHA DÉMASQUÉ : C'EST GLM-5.3, DE ZHIPU AI

📌 Le fait Le modèle testé sous le nom de code Ox Alpha est identifié : il s'agit de GLM-5.3, développé par le laboratoire chinois Zhipu AI. L'écart entre labos américains et chinois se réduit. Le modèle a été comparé dans 4 environnements d'exécution (le harness, la couche logicielle qui fait tourner le modèle et lui donne accès aux outils) : Deepseek Harness sort vainqueur sur la qualité visuelle, Codex App termine dernier. Comportement notable : il a passé 26 de ses 29 minutes de test à raisonner avant d'agir.

📊 Les chiffres 4 environnements d'exécution testés 26 minutes de raisonnement sur 29 minutes de tâche

🎯 Pour toi Le classement d'un modèle dépend autant de l'outil qui l'héberge que du modèle lui-même. À garder en tête avant de conclure qu'un modèle « ne marche pas » chez toi.

🔗 X / kimmonismus

━━━━━━━━━━━━━━━━━━━━

2️⃣ OPENAI CASSE ENCORE LE PRIX DE GPT-5.6 SOL

📌 Le fait OpenAI applique 20 % de baisse supplémentaire sur GPT-5.6 Sol, pour une durée de 3 mois. Le tarif passe de 5 $/30 $ à 4 $/20 $ par million d'unités de texte (les tokens, c'est-à-dire ce que le modèle lit en entrée et écrit en sortie). C'est la deuxième baisse en une semaine. La guerre des prix entre fournisseurs s'intensifie.

📊 Les chiffres Entrée : 5 $ vers 4 $ par million d'unités de texte Sortie : 30 $ vers 20 $ par million Baisse : 20 % supplémentaires Durée annoncée : 3 mois

🎯 Pour toi Si un prestataire fait tourner tes automatisations sur ce modèle, ta facture d'août devrait baisser sans rien changer. Bon moment pour redemander un devis à jour.

🔗 X / OpenAI

━━━━━━━━━━━━━━━━━━━━

3️⃣ ANTHROPIC RECRUTE LE PÈRE DES PUCES TPU DE GOOGLE

📌 Le fait Anthropic embauche Amir Salek, fondateur du programme de puces custom de Google et responsable des TPU jusqu'en 2022. Il rejoint l'équipe compute pour développer les semi-conducteurs maison d'Anthropic. Traduction : l'entreprise veut fabriquer ses propres puces plutôt que dépendre uniquement de fournisseurs externes.

🎯 Pour toi Un signal sur les coûts à moyen terme. Qui maîtrise ses puces maîtrise ses prix, et donc ce que tu paieras pour faire tourner Claude dans deux ans.

🔗 X / TLDR Newsletter

━━━━━━━━━━━━━━━━━━━━

4️⃣ CODEX PASSE DE 3 À 20 MILLIONS D'UTILISATEURS

📌 Le fait L'agent de développement d'OpenAI est passé de 3 à 20 millions d'utilisateurs depuis avril. Cinq millions ont été gagnés sur les 9 derniers jours. Le moteur identifié : les remises à zéro des limites d'usage, transformées en boucle de croissance qui ramène l'utilisateur à intervalles réguliers.

📊 Les chiffres 3 millions d'utilisateurs en avril 20 millions aujourd'hui +5 millions en 9 jours

🎯 Pour toi Le mécanisme est reproductible hors du code : une limite qui se recharge crée un rendez-vous. À regarder si tu conçois une offre par abonnement.

🔗 X / Aakash Gupta

━━━━━━━━━━━━━━━━━━━━

📌 EN BREF

• Ox Alpha gratuit : Nous Research ouvre le modèle sur son portail, avec une capacité d'un billiard d'unités de texte par jour. Offre limitée dans le temps. • Google : Gemini 3.7 Flash est le lancement de modèle le plus rapide de l'histoire de Google, selon Logan Kilpatrick. C'est le modèle léger, donc le moins cher de la gamme. • DeepSeek sort V4-Flash-Vision-Exp : mêmes performances que V4-Flash avec la lecture d'images en plus, au niveau d'Opus 4.8. Utilisable dans Cline dès maintenant. • Meta publie Muse Spark 1.2 sur OpenRouter, à 0,10 $/0,20 $ par million d'unités de texte, avec des performances proches de GPT-5.6 Terra. Le niveau « Contributeur » signifie que tes données peuvent servir à améliorer les produits Meta : à éviter sur des documents clients. • Instinct, outil IA de gestion d'emails, indexe et conserve les emails sans demander de permission et sans option de suppression. Peter Yang déconseille l'outil tant que ce n'est pas corrigé. • Éducation : une étude montre que l'IA améliore les notes aux devoirs mais fait chuter celles aux examens. 165 points sur Hacker News. • Claudette, outil open source (code public, librement modifiable), force Claude à abandonner le ton « article BuzzFeed ». 226 points sur Hacker News.

━━━━━━━━━━━━━━━━━━━━

📊 LES CHIFFRES DU JOUR

• Sur LM Arena, Claude Fable 5 mène le classement Texte avec 1508 points sur 24 331 votes, et prend aussi la Vision à 1312. Claude Opus 5 Max domine le développement web à 1691. • Images : GPT-Image 2 tient les deux classements, génération (1381) et retouche (1463), cette dernière sur 199 275 votes. • Intelligence brute : Claude Opus 5 en tête de l'indice Artificial Analysis à 63,1 pour 10 $ le million d'unités de texte, devant Claude Fable 5 (62,1) facturé 20 $, soit deux fois plus cher pour une note inférieure. • Meilleur rapport qualité-prix : Ling 3.0 Flash, note 37,8 pour 0,11 $ le million et 429 unités de texte produites par seconde. Le plancher reste Qwen3.5 4B à 0,06 $ le million, note 20,4.

━━━━━━━━━━━━━━━━━━━━

📅 CE QUI ARRIVE

• Réactions des labos américains à l'identification de GLM-5.3 : attendues la semaine prochaine.

━━━━━━━━━━━━━━━━━━━━

🛠️ OUTILS ET CODE

• claudish-to-english : réécrit en direct chaque message de Claude Code dans un langage clair, en local sur ta machine. 579 étoiles en moins de 24 heures. Pour qui utilise Claude Code sans lire couramment le jargon développeur. • store-screenshots : transforme des captures d'écran brutes en visuels marketing prêts pour l'App Store et Google Play. Utile si tu publies une application et que tu n'as pas de graphiste sous la main. • dsh-android : pilote un téléphone ou un émulateur Android depuis une conversation avec une IA. Pratique pour automatiser des manipulations répétitives sur mobile ou tester une app. • Claude Code v2.1.239 : les sessions lancées dans le cloud survivent maintenant à un redémarrage, les messages de limite de dépense affichent la date de remise à zéro, et l'inférence hébergée aux États-Unis (le moment où l'IA produit sa réponse) est facturée avec un multiplicateur de 1,1. À vérifier si tu suis ton budget à la ligne.

━━━━━━━━━━━━━━━━━━━━

🎯 À TESTER AUJOURD'HUI

Va tester GLM-5.3 sur le portail de Nous Research pendant que l'accès est gratuit. Compare-le à ton modèle habituel sur une tâche que tu connais par coeur : c'est la seule façon honnête de juger si l'écart avec les labos américains s'est vraiment refermé.

━━━━━━━━━━━━━━━━━━━━

📝 SOURCES 1 → X / kimmonismus : https://x.com/kimmonismus/status/2090912736012054829 2 → X / OpenAI : https://x.com/OpenAI/status/2090885187634905500 3 → X / TLDR Newsletter : https://x.com/tldrnewsletter/status/2090908116955058457 4 → X / Aakash Gupta : https://x.com/aakashgupta/status/2091010976317661590 5 → X / Nous Research : https://x.com/NousResearch/status/2090899914700054780 6 → X / Logan Kilpatrick : https://x.com/OfficialLoganK/status/2091007303285887091 7 → X / Cline : https://x.com/cline/status/2090894920269853120 8 → X / TestingCatalog : https://x.com/testingcatalog/status/2090931370776199342 9 → X / Peter Yang : https://x.com/petergyang/status/2090936583814025417 10 → CANews24 : https://canews24.online/?p=71 11 → GitHub / nobuzz : https://github.com/adnanakil/nobuzz 12 → GitHub / claudish-to-english : https://github.com/Leutenegger/claudish-to-english 13 → GitHub / store-screenshots : https://github.com/LeeHueeng/store-screenshots 14 → GitHub / dsh-android : https://github.com/ZSeven-W/dsh-android 15 → GitHub / Claude Code : https://github.com/anthropics/claude-code/releases/tag/v2.1.239