Google annonce la prochaine génération de son système d'apprentissage fédéré (FL).
Motif de la recommandation :L'article détaille l'architecture TEE du nouveau système FL de Google et son déploiement sur Gboard, permettant de comprendre comment la vérifiabilité et l'auditabilité sont mises en œuvre.
NVIDIA annonce une configuration 64GB de son DGX Spark, disponible ce mois-ci chez Acer.
Motif de la recommandation :La configuration 64GB et le cluster à deux nœuds précisent le budget mémoire, le prix et les cas d'usage des agents locaux.
ServiceNow CoreAI présente AutoSynthData, un pipeline qui transforme les échecs d'un modèle cible et les succès d'un enseignant plus fort en nouvelles tâches d'entraînement validées dans l'environnement. Le système génère des tâches composées d'une spécification système, d'un prompt utilisateur et d'un vérificateur, avec des contrôles de faisabilité, de réalisme et de difficulté, puis une vérification positive et négative et une phase de réparation. Sur EnterpriseOps Gym Hybrid, avec Gemma-4-26B-A4B-it comme cible et Qwen3.8-27B comme enseignant, 2 000 échantillons générés en environ 18 heures améliorent le Pass@1 moyen de 7,2 points, soit une hausse relative de 35 %, et le taux de succès du vérificateur passe de 63,01 % à 68,55 %. Sur ITSM, avec DeepSeek-V4.1-Flash comme enseignant, 1 994 échantillons générés en 66 heures font passer le Pass@1 moyen de 18,77 % à 27,18 %.
Motif de la recommandation :L'article détaille un pipeline de génération de données d'entraînement pour agents d'entreprise, avec les critères de qualité et les résultats chiffrés sur deux domaines.
CoreWeave annonce la disponibilité des systèmes NVIDIA Vera Rubin NVL72 avec réseau Spectrum-X 102.4T Ethernet.
Motif de la recommandation :L'annonce détaille la disponibilité en production de Vera Rubin NVL72 et de la CPU Vera, avec des chiffres de débit et de démarrage de sandbox qui aident à évaluer les charges agentiques.
OpenAI a publié un récapitulatif de DevDay 2026, qui regroupe plus de 20 annonces couvrant GPT-6 Astra, ChatGPT, Codex, les API, la sécurité et de nouveaux outils pour les développeurs.
Microsoft Research publie une étude systématique montrant que déporter l'inférence d'IA physique hors du robot.
Motif de la recommandation :L'étude quantifie les gains de déport de l'inférence sur la réussite des tâches et l'autonomie des robots, avec un outillage Kubernetes open source associé.
Google DeepMind détaille une évolution de son architecture Private AI Compute qui ajoute une couche de mémoire persistante côté serveur.
Motif de la recommandation :L'article détaille l'architecture de mémoire persistante côté serveur de Google et ses mécanismes de chiffrement, utile pour comprendre comment concilier continuité multi-appareils et confidentialité.
Airbnb élargit l'accès à GPT-6 Astra et aux modèles de pointe d'OpenAI, afin d'aider ses équipes d'ingénierie à résoudre des bugs, concevoir des systèmes et livrer plus rapidement.
GitHub a réécrit le runtime de l'agent Copilot, initialement en TypeScript sur Node.js.
Motif de la recommandation :Le récit détaillé d'une migration de runtime de 430 000 lignes de TypeScript vers Rust menée par des agents, avec les chiffres de cache, de compaction et de répartition des rôles.
Mistral AI a migré 40 000 lignes de Fortran 77 vers C++ pour un opérateur énergétique européen.
Motif de la recommandation :L'article détaille un workflow d'agents structuré avec harnais de parité et documentation préalable, directement transposable à d'autres migrations de code legacy.
Google DeepMind et Google Research présentent WeatherNext 3.
Motif de la recommandation :Le modèle météo phare de Google DeepMind passe à une résolution de 5 km et à des prévisions horaires, avec une intégration directe dans Search, Gemini et Maps.
Mistral lance Agentic Search, une couche de récupération qui permet aux modèles de rechercher.
Motif de la recommandation :L'original détaille la boucle de récupération multi-étapes et les gains chiffrés sur FinanceBench et OfficeQA Pro, ce qui aide à juger l'écart avec le RAG one-shot.
Mistral annonce trois avancées pour l'IA souveraine : la disponibilité générale des Mistral Regional Endpoints.
Motif de la recommandation :Mistral détaille ses endpoints régionaux et son Priority Tier, ce qui aide à évaluer les options de conformité et de résidence des données pour l'inférence.
IBM Research et le Berkeley Sky Lab étendent K-Search, un framework de recherche évolutive de kernels piloté par LLM.
Motif de la recommandation :L'article détaille une couche de traduction CUDA vers MLX et les gains mesurés sur les kernels Attention et Mamba, utile pour évaluer la portabilité des optimisations GPU.
OpenAI annonce le lancement des travaux d'un projet de centre de données de 1GW dans le Michigan。
Motif de la recommandation :L'annonce précise la puissance de 1GW et le cadre Stargate, ce qui permet de situer l'échelle du projet dans la course aux infrastructures d'IA.
Les modèles frontière d'OpenAI et Codex sont désormais généralement disponibles sur AWS。
Motif de la recommandation :Les modèles frontière d'OpenAI et Codex sont désormais disponibles sur AWS, ce qui permet aux entreprises de les déployer via les environnements et processus d'achat AWS existants.
OpenAI annonce que ses modèles GPT, Codex et Managed Agents sont désormais disponibles sur AWS. Les entreprises peuvent ainsi développer des solutions d'IA sécurisées directement dans leur environnement AWS.
Motif de la recommandation :Les modèles OpenAI, Codex et Managed Agents sont désormais disponibles sur AWS, ce qui permet aux entreprises de déployer l'IA dans leur environnement cloud existant.
OpenAI annonce que ChatGPT for Clinicians devient gratuit pour les médecins, infirmiers praticiens et pharmaciens américains vérifiés. Le produit est destiné aux soins cliniques。
Motif de la recommandation :L'original précise le périmètre d'accès gratuit et les usages cliniques visés, ce qui permet de juger de l'impact sur les flux de travail médicaux.