NVIDIA annonce une configuration 64GB de son DGX Spark, disponible ce mois-ci chez Acer.
Motif de la recommandation :La configuration 64GB et le cluster à deux nœuds précisent le budget mémoire, le prix et les cas d'usage des agents locaux.
GPT-6 Astra Ultrafast, exécuté sur les GPU NVIDIA Blackwell.
Motif de la recommandation :L'original expose les gains de vitesse et les scénarios d'agents concernés, ce qui permet de juger l'impact sur les boucles de développement.
Microsoft Research présente Quine, un effort de recherche combinant un modèle mondial multimodal de biologie et un harnais interactif reliant modèles.
Motif de la recommandation :Microsoft Research présente Quine, un modèle mondial multimodal de biologie couplé à un harnais, avec une validation en laboratoire humide sur le cancer du pancréas.
GitHub Security Lab publie le Fuzzing Taskflow, un pipeline de fuzzing autonome pour les projets C/C++ construit sur son framework Taskflow Agent. Il suffit d'indiquer un dépôt GitHub pour que l'agent identifie les points d'entrée, analyse le système de build, écrit les harnesses, lance AFL++, lit les rapports de couverture, améliore les harnesses, trie les crashs et rédige un rapport de vulnérabilité par bug unique. Le pipeline sépare les décisions de l'agent des outils MCP qui exécutent réellement les opérations, stocke l'état dans une base SQLite et utilise Claude Sonnet 5 par défaut. L'auteur prévient que le taskflow exécute afl-fuzz, clang et des commandes de build choisies par le LLM directement sur l'hôte, et recommande de ne le lancer que dans un environnement jetable sans privilèges élevés.
Motif de la recommandation :Le pipeline détaille la répartition des tâches entre l'agent et les outils MCP, ainsi que la boucle de rétroaction sur la couverture, une méthode directement transposable à d'autres automatisations de sécurité.
Google DeepMind lance Gemini 3.8 Live with Live Avatar.
Motif de la recommandation :L'original détaille les capacités visuelles temps réel, l'exécution asynchrone d'outils et la prise en charge de 97 langues, ce qui aide à évaluer l'usage en entreprise.
OpenAI met GPT-Live-1 à disposition dans l'API, apportant des conversations vocales naturelles en full-duplex。
Motif de la recommandation :L'original présente les capacités vocales et le support téléphonique de GPT-Live-1, ce qui permet de juger des scénarios de voix en temps réel dans l'API.
Google DeepMind présente AlphaGenome Atlas, une plateforme contenant les prédictions des effets de 9 milliards de variants mononucléotidiques.
Motif de la recommandation :Le texte détaille une ressource de 1 pétaoctet couvrant 9 milliards de variants et un score AVI unifié, ce qui permet de situer la portée pratique pour la recherche génomique.
Mistral lance Agentic Search, une couche de récupération qui permet aux modèles de rechercher.
Motif de la recommandation :L'original détaille la boucle de récupération multi-étapes et les gains chiffrés sur FinanceBench et OfficeQA Pro, ce qui aide à juger l'écart avec le RAG one-shot.
Replit lance Free Mode, propulsé par GPT-5.6 Luna, afin que chacun puisse transformer ses idées en logiciels fonctionnels sans se soucier du coût des tokens.
Motif de la recommandation :Replit lance un mode gratuit propulsé par GPT-5.6 Luna, ce qui permet de mesurer comment le coût des tokens conditionne l'accès à la création logicielle.
ChatGPT Ads s'étend à 31 marchés européens. OpenAI indique que les annonceurs peuvent ainsi toucher les utilisateurs au moment où ils explorent, comparent des options et prennent des décisions.
OpenAI présente Ultrafast, un nouveau palier de service de l'API OpenAI qui exécute GPT-5.6 Sol jusqu'à 14 fois plus vite. Propulsé par Cerebras, il atteint jusqu'à 750 tokens de sortie par seconde.
Motif de la recommandation :OpenAI présente un nouveau palier d'API propulsé par Cerebras, avec un débit de sortie allant jusqu'à 750 tokens par seconde, ce qui permet d'évaluer l'impact sur les scénarios à faible latence.
Mistral annonce trois avancées pour l'IA souveraine : la disponibilité générale des Mistral Regional Endpoints.
Motif de la recommandation :Mistral détaille ses endpoints régionaux et son Priority Tier, ce qui aide à évaluer les options de conformité et de résidence des données pour l'inférence.
OpenAI commence à tester des publicités dans ChatGPT afin de soutenir l'accès gratuit. Le dispositif prévoit un étiquetage clair。
Motif de la recommandation :L'original expose les garde-fous prévus pour la publicité dans ChatGPT, un point utile pour juger de son impact sur l'accès gratuit et l'expérience utilisateur.
Health in ChatGPT permet désormais aux utilisateurs éligibles aux États-Unis de connecter en toute sécurité leurs dossiers médicaux et Apple Health afin d'obtenir des informations plus personnalisées et de mieux comprendre leur santé.
Motif de la recommandation :L'original expose l'ouverture de Health in ChatGPT à la connexion des dossiers médicaux et d'Apple Health, ce qui permet de juger de l'évolution des usages santé.
GPT-5.6 devient le modèle préféré dans Microsoft 365 Copilot. Selon OpenAI, il apporte des capacités d'IA renforcées dans Word。
Motif de la recommandation :GPT-5.6 devient le modèle préféré de Microsoft 365 Copilot, ce qui permet de suivre l'évolution des capacités dans Word, Excel, PowerPoint, Chat et Cowork.
OpenAI présente ChatGPT Work, un agent capable d'agir dans vos applications et fichiers, de rester sur un projet pendant des heures si nécessaire et de transformer un objectif en travail achevé.
Motif de la recommandation :Présentation de ChatGPT Work comme agent capable d'agir sur les applications et fichiers et de mener un projet sur plusieurs heures.
OpenAI et Broadcom présentent Jalapeño, une puce IA personnalisée conçue pour l'inférence LLM, afin d'améliorer les performances, l'efficacité et la mise à l'échelle des systèmes d'IA.
Motif de la recommandation :OpenAI et Broadcom dévoilent une puce d'inférence LLM dédiée, un jalon dans l'optimisation matérielle pour les charges de travail IA.