Motif de la recommandation :NVIDIA détaille les workflows agentiques et le support de ROS Lyrical dans Isaac ROS 5.0, ce qui permet de situer les changements pour les développeurs robotiques.
L'Égypte a franchi le cap de la production en IA, avec une base d'apprenants du NVIDIA Deep Learning Institute multipliée par plus de dix en un an et une licence accordée en juin à Hassan Allam Data Centers pour construire et exploiter des data centers, dont un investissement estimé à 400 millions de dollars avec A15. Quatre AI factories ont été annoncées ou mises en service en Afrique en un an, avec 656 mégawatts de capacité supplémentaire en préparation, tandis que Cassava Technologies prévoit des déploiements en Égypte, au Kenya, au Nigeria et au Maroc pour un investissement pouvant atteindre 720 millions de dollars. Le programme NVIDIA Inception en Égypte réunit notamment Aidera, Intella, Marses Robotics, Proteinea et Stakpak, et la NVIDIA VC Alliance s'est élargie avec A15 et M Empire.
NVIDIA publie OpenShell, un runtime sécurisé open source qui applique des politiques hors de portée de l'agent et fournit une exécution en sandbox pour encadrer l'accès des agents aux données, au réseau et aux ressources système. Les partenaires de l'Open Secure AI Alliance s'appuient dessus : DefenseClaw de Cisco ajoute une couche de gouvernance, et JFrog intègre OpenShell pour scanner et vérifier les skills des agents et appliquer des politiques sur ceux auxquels ils peuvent accéder. La sécurité des agents exige des frontières exécutoires indépendantes du raisonnement du modèle, une identité traçable par agent, des approbations humaines pour les actions sensibles, ainsi que des tests répétés après tout changement de modèle, d'outil ou de workflow.
Hugging Face annonce la release candidate de tokenizers v1, dont le chemin d'encodage est 3 à 30 fois plus rapide que la v0.23 sur un thread avec un Apple M4 Max。
Motif de la recommandation :L'article détaille les changements d'implémentation de tokenizers v1 et fournit des benchmarks reproductibles, ce qui permet d'évaluer l'impact sur les pipelines d'entraînement et de service.
Google Research introduit MilleMiglia, un générateur d'instances en C++ conçu pour créer des benchmarks réalistes pour les problèmes de livraison du middle mile.
Motif de la recommandation :Le récit détaillé d'une migration de runtime de 430 000 lignes de TypeScript vers Rust menée par des agents, avec les chiffres de cache, de compaction et de répartition des rôles.
Motif de la recommandation :Les résultats MLPerf v6.1 chiffrent le gain de débit du système Vera Rubin NVL72 face à GB300 NVL72 et l'efficacité de mise à l'échelle, utiles pour comparer les options d'infrastructure d'inférence.
IBM Research présente le Consistency Analyzer, un outil de diagnostic intégré à ALTK-Evolve qui identifie les points de décision instables d'un agent en rééchantillonnant une trajectoire enregistrée, sans vérité terrain ni nouvelle exécution complète. Sur AppWorld test_normal avec un agent ReAct sur GPT-4.1, l'écart de cohérence entre Mean@5 (77,4 %) et Pass^5 (53,0 %) atteint 24,4 points ; les directives de cohérence générées à partir de ces diagnostics réduisent cet écart à 12,0 points, avec Pass^5 à 69,0 % et Mean@5 à 81,0 %. Le dépôt open source ALTK-Evolve inclut désormais l'outil et la génération de directives, et le rapport technique est publié sur arXiv.
Motif de la recommandation :L'original expose une méthode de diagnostic de la variabilité des agents et des directives correctives, avec des chiffres avant/après sur AppWorld.
Hugging Face présente Workflow1111, un canevas de workflow unique qui reconstruit la plupart des fonctionnalités d'AUTOMATIC1111 sous forme de 11 pipelines multimédias construits avec 73 nœuds. Le canevas couvre la génération texte-image, le hi-resolution fix, l'image-to-image, la matrice de prompts, l'interrogation VLM, la détection vers masque d'inpainting, les annotateurs de style ControlNet, la suppression d'arrière-plan, le stockage PNG Info et l'image-to-video, avec des modèles comme FLUX.1-Kontext, Qwen3-4B, Qwen2.5-VL, DETR, AuraSR ×4, BRIA RMBG-2.0 et Wan 2.2 I2V A14B. Chaque nœud de sortie devient un point d'accès REST, et avec mcp_server=True, ces points d'accès deviennent des outils MCP appelables par des assistants IA comme Claude Code ou Cursor.
Motif de la recommandation :L'article détaille comment reconstruire l'ensemble des fonctionnalités d'AUTOMATIC1111 avec 73 nœuds Gradio Workflow, et comment chaque sortie devient un point d'accès REST et un outil MCP.
Motif de la recommandation :L'annonce expose l'API Agents et son service managé pour l'orchestration et les sessions longues, utile pour évaluer les flux d'agents cloud.
Motif de la recommandation :L'article détaille une architecture concrète pour entraîner un adaptateur LoRA avec Async GRPO sur des Jobs séparés, avec des chiffres de bout en bout et un diagnostic du goulot d'étranglement.
Motif de la recommandation :L'article détaille un workflow d'agents structuré avec harnais de parité et documentation préalable, directement transposable à d'autres migrations de code legacy.
Motif de la recommandation :GitHub détaille trois modes d'orchestration multi-modèles et des résultats de benchmarks avec écarts de coût, utiles pour évaluer les compromis qualité-coût des workflows d'agents.
Motif de la recommandation :Le modèle météo phare de Google DeepMind passe à une résolution de 5 km et à des prévisions horaires, avec une intégration directe dans Search, Gemini et Maps.
Legora a utilisé GPT-6 Astra pour examiner 41 documents en quelques minutes et détecter les quatre erreurs dissimulées dans ce workflow de revue financière. La performance s'est améliorée de près de 40 % sur cette tâche.
Google DeepMind lance le Fairwind Program, un programme à accès limité destiné aux gouvernements et partenaires de confiance pour utiliser ses capacités de cyberdéfense avancées. Le programme associe le modèle Gemini 3.8 Flash Cyber au harness CodeMender pour trouver, vérifier et corriger des vulnérabilités à l'échelle agentique, avec des correctifs vérifiés prêts au déploiement générés en quelques minutes au lieu de plusieurs semaines. Plus de 650 partenaires participent, avec un accès initial réservé aux gouvernements, autorités cyber nationales, opérateurs d'infrastructures critiques et plateformes technologiques, sous conditions d'usage strictes incluant l'authentification multifacteur. Google.org porte son financement total en cybersécurité à plus de 100 millions de dollars.
Motif de la recommandation :Le programme détaille l'accès restreint à Gemini 3.8 Flash Cyber et CodeMender, ce qui permet de situer les capacités de correction autonome de vulnérabilités et leurs conditions d'accès.
ChatGPT peut désormais se connecter à des données de santé de confiance, afin d'aider les cliniciens à accéder en toute sécurité au contexte des patients。
Le cabinet d'avocats Gilbert + Tobin déploie ChatGPT Enterprise et Codex à l'échelle de l'ensemble de ses activités en s'appuyant sur un engagement porté par sa direction。
Polimill utilise les modèles GPT et Codex d'OpenAI pour aider les municipalités japonaises à rechercher et exploiter leurs connaissances administratives。
Motif de la recommandation :L'original détaille la boucle de récupération multi-étapes et les gains chiffrés sur FinanceBench et OfficeQA Pro, ce qui aide à juger l'écart avec le RAG one-shot.