Retour au radar

🟧 RADAR IA : OPENAI FREINE ASTRA POUR SECURITE (08/08)

📡 RADAR IA · SAMEDI 8 AOÛT 2026

OpenAI classe son prochain modèle, Astra, comme premier modèle « critique » en cybersécurité et repousse sa sortie grand public. Journée courte côté annonces, mais celle-là compte.

━━━━━━━━━━━━━━━━━━━━

AU SOMMAIRE

• OpenAI freine Astra pour raisons de cybersécurité • Google DeepMind montre un corps complet pour robots humanoïdes • 9 brèves : rumeur Meta, correctifs de sécurité, dépôts open source du jour • Les chiffres du jour : 4 lignes de classement et de prix • Outils et code : 4 entrées • À tester aujourd'hui

━━━━━━━━━━━━━━━━━━━━

🔴 LE TOP DU JOUR

1️⃣ OPENAI DÉCLARE SON MODÈLE ASTRA « CRITIQUE » EN CYBERSÉCURITÉ

📌 Le fait OpenAI annonce que son prochain modèle, Astra, franchit un seuil de capacité en cybersécurité que l'entreprise qualifie de « critique ». C'est la première fois qu'OpenAI place un de ses modèles dans cette catégorie. Conséquence directe : des contrôles supplémentaires sont activés et la disponibilité générale est repoussée. L'objectif affiché est de confier ces capacités d'abord aux défenseurs, c'est-à-dire aux équipes de sécurité, avant tout accès large.

🎯 Pour toi Un éditeur qui retarde volontairement son propre lancement, c'est un argument solide à sortir quand un client te demande où en est la sécurité de l'IA générative. Le point à creuser : si un modèle est jugé assez fort pour trouver des failles, il est aussi assez fort pour en exploiter, et c'est ce raisonnement qui pilote désormais les calendriers de sortie.

🔗 OpenAI

━━━━━━━━━━━━━━━━━━━━

2️⃣ GOOGLE DEEPMIND FAIT MARCHER, S'ACCROUPIR ET COLLABORER SES HUMANOÏDES

📌 Le fait Google DeepMind présente ce qu'il décrit comme une intelligence corporelle complète pour robots humanoïdes. La démonstration couvre la marche, l'accroupissement, la préhension d'objets, le nouage et le travail collaboratif entre robots. L'enjeu n'est plus le dialogue mais la coordination physique enchaînée dans une seule et même pile logicielle.

🎯 Pour toi Rien d'immédiatement utilisable pour un cabinet ou une PME de services, mais un signal pour tout ce qui touche à la logistique, à l'atelier et au chantier. Lecture possible : la même famille de modèles qui rédige tes comptes rendus commence à piloter des gestes, et ça déplace le débat sur l'automatisation vers les métiers manuels.

🔗 Min Choi (X)

━━━━━━━━━━━━━━━━━━━━

📌 EN BREF

• Meta 🟡 Rumeur non confirmée : une application de bureau macOS « Meta AI super app » serait en préparation, pour chatter, créer et collaborer avec l'IA. L'info repose sur des indices repérés en ligne, aucune confirmation officielle.

• Anthropic retire les modèles Claude Opus 4.1, devenus obsolètes, de son kit de connexion pour développeurs. Si un prestataire a câblé un de tes automatismes dessus, c'est le moment de vérifier.

• n8n, l'outil d'automatisation sans code, passe en version 2.33.6 : correctifs sur la surveillance des tâches et menus déroulants de l'éditeur rendus plus lisibles.

• Supabase CLI 2.112.0 corrige une faille de traversée de chemin (un attaquant pouvait accéder à des fichiers hors du dossier prévu) lors du téléchargement de fonctions.

• Changement de rupture chez Supabase : le déploiement de fonctions ne transmet plus le jeton d'authentification npm au conteneur de build. Les projets concernés casseront sans intervention.

• Super Productivity 18.19.0 durcit la sécurité : chiffrement obligatoire des envois quand le chiffrement de bout en bout est exigé, et jeton désormais requis pour accéder à son interface locale.

• Le kit de développement IA de Vercel, en version 7.0.58, accepte un format d'image « adaptatif » pour la génération vidéo, et allège son poids de chargement.

• Sur GitHub, codex-ios-assistant (77 étoiles) pilote un iPhone depuis Codex, l'agent de code d'OpenAI, via iMessage et les Raccourcis.

• Toujours sur GitHub, anti-slop (37 étoiles) impose des règles de design pour éviter les interfaces génériques produites en série par les agents IA.

━━━━━━━━━━━━━━━━━━━━

📊 LES CHIFFRES DU JOUR

• Sur le classement Texte de LM Arena, Claude Fable 5 mène avec 1507 points sur 19 390 votes. Claude Opus 5 Max domine le développement web (1686), Gemini Omni Flash la génération de vidéo (1513).

• Mouvement du jour : Grok Imagine Image 2.0 entre dans le top 3 sur la génération d'images ET sur la retouche d'images. Muse Image et MAI Image 2.5 sortent respectivement de ces deux podiums.

• Intelligence : Claude Opus 5 en effort maximal prend la tête de l'indice Artificial Analysis, la note globale qui classe les modèles, avec 63,1 pour 10 $ par million de mots traités. Claude Fable 5 est juste derrière à 62,1, mais coûte 20 $, soit le double.

• Meilleur rapport du jour : Ling 3.0 Flash, 37,8 d'indice pour 0,11 $ le million de mots traités et 395 mots par seconde. Le plancher reste Qwen3.5 4B à 0,06 $, mais à 20,4 d'indice seulement.

━━━━━━━━━━━━━━━━━━━━

🛠️ OUTILS ET CODE

• Claude Code 2.1.226 ajoute des plafonds de dépense côté passerelle et une demande de confiance avant de lancer des agents dans un dossier de travail. Si tu fais tourner Claude Code en équipe, ça répond à deux questions récurrentes : combien ça coûte et qui a le droit d'exécuter quoi. Au passage, les erreurs d'authentification 401 sur macOS et les blocages de sessions web sont corrigés.

• Le kit de connexion Anthropic (version 0.19.1 côté Vertex) charge désormais automatiquement les skills depuis GitHub, et introduit des budgets par session. Traduction : les compétences que tu construis pour Claude se distribuent depuis un dépôt commun, sans recopie manuelle, et chaque conversation peut être plafonnée en dépense.

• Jarvis Assistant Vocal, la pépite GitHub du jour, est un assistant vocal en français qui tourne en local, pilote Claude ou un modèle installé sur ta machine, commande des lampes Hue et passe des appels téléphoniques. Bon terrain d'observation pour qui veut un assistant qui ne fait pas transiter sa voix par un serveur distant.

• Open Kimi PPT Skill (23 étoiles) génère des présentations PowerPoint éditables, pas des images figées. Directement parlant pour les consultants et formateurs qui livrent des slides.

━━━━━━━━━━━━━━━━━━━━

🎯 À TESTER AUJOURD'HUI

Ouvre la note d'OpenAI sur les capacités cyber « critiques » d'Astra (lecture courte). C'est le premier texte où un éditeur explique noir sur blanc pourquoi il retarde un modèle, et c'est exactement le genre de source que tu peux citer en comité de direction quand on te demande si l'IA est prête pour la production.

━━━━━━━━━━━━━━━━━━━━

📝 SOURCES 1 → OpenAI : https://openai.com/index/responding-next-frontier-critical-cyber-capabilities 2 → Min Choi (X) : https://x.com/minchoi/status/2085853082999476618 3 → TestingCatalog (X) : https://x.com/testingcatalog/status/2085862238221402516