NVIDIA annonce une configuration 64GB de son DGX Spark, disponible ce mois-ci chez Acer.
Motif de la recommandation :La configuration 64GB et le cluster à deux nœuds précisent le budget mémoire, le prix et les cas d'usage des agents locaux.
GPT-6 Astra Ultrafast, exécuté sur les GPU NVIDIA Blackwell.
Motif de la recommandation :L'original expose les gains de vitesse et les scénarios d'agents concernés, ce qui permet de juger l'impact sur les boucles de développement.
Florian Euchner a publié ESP-SDR sur GitHub, un firmware qui transforme la radio Wi-Fi 2。
Motif de la recommandation :Un firmware open source transforme la radio Wi-Fi de l'ESP32 en SDR sans matériel dédié, avec les limites de calibration documentées.
GPT-6.1 Sol est désormais généralement disponible sur Amazon Bedrock, apportant un raisonnement renforcé pour le codage agentique。
Motif de la recommandation :L'original détaille les gains de raisonnement agentique de GPT-6.1 Sol et les contrôles de sécurité proposés par Amazon Bedrock, ce qui aide à évaluer son adoption en production.
Microsoft Research présente Quine, un effort de recherche combinant un modèle mondial multimodal de biologie et un harnais interactif reliant modèles.
Motif de la recommandation :Microsoft Research présente Quine, un modèle mondial multimodal de biologie couplé à un harnais, avec une validation en laboratoire humide sur le cancer du pancréas.
GitHub Security Lab publie le Fuzzing Taskflow, un pipeline de fuzzing autonome pour les projets C/C++ construit sur son framework Taskflow Agent. Il suffit d'indiquer un dépôt GitHub pour que l'agent identifie les points d'entrée, analyse le système de build, écrit les harnesses, lance AFL++, lit les rapports de couverture, améliore les harnesses, trie les crashs et rédige un rapport de vulnérabilité par bug unique. Le pipeline sépare les décisions de l'agent des outils MCP qui exécutent réellement les opérations, stocke l'état dans une base SQLite et utilise Claude Sonnet 5 par défaut. L'auteur prévient que le taskflow exécute afl-fuzz, clang et des commandes de build choisies par le LLM directement sur l'hôte, et recommande de ne le lancer que dans un environnement jetable sans privilèges élevés.
Motif de la recommandation :Le pipeline détaille la répartition des tâches entre l'agent et les outils MCP, ainsi que la boucle de rétroaction sur la couverture, une méthode directement transposable à d'autres automatisations de sécurité.
Google DeepMind lance Gemini 3.8 Live with Live Avatar.
Motif de la recommandation :L'original détaille les capacités visuelles temps réel, l'exécution asynchrone d'outils et la prise en charge de 97 langues, ce qui aide à évaluer l'usage en entreprise.
NVIDIA publie Isaac ROS 5.0, une collection de paquets accélérés par GPU bâtie sur ROS。
Motif de la recommandation :NVIDIA détaille les workflows agentiques et le support de ROS Lyrical dans Isaac ROS 5.0, ce qui permet de situer les changements pour les développeurs robotiques.
Hugging Face ajoute le support de l'exécution des modèles GGUF dans transformers。
Motif de la recommandation :L'original expose la méthode d'intégration GGUF dans transformers et les écarts de débit avec llama.cpp, ce qui permet de juger si l'inférence locale peut passer sur les API existantes.
Hugging Face annonce la release candidate de tokenizers v1, dont le chemin d'encodage est 3 à 30 fois plus rapide que la v0.23 sur un thread avec un Apple M4 Max。
Motif de la recommandation :L'article détaille les changements d'implémentation de tokenizers v1 et fournit des benchmarks reproductibles, ce qui permet d'évaluer l'impact sur les pipelines d'entraînement et de service.
OpenAI lance ChatGPT for Financial Services, qui intègre des données financières natives et GPT-6 Astra pour la recherche, la modélisation et la production de documents destinés aux clients.
Hugging Face présente Workflow1111, un canevas de workflow unique qui reconstruit la plupart des fonctionnalités d'AUTOMATIC1111 sous forme de 11 pipelines multimédias construits avec 73 nœuds. Le canevas couvre la génération texte-image, le hi-resolution fix, l'image-to-image, la matrice de prompts, l'interrogation VLM, la détection vers masque d'inpainting, les annotateurs de style ControlNet, la suppression d'arrière-plan, le stockage PNG Info et l'image-to-video, avec des modèles comme FLUX.1-Kontext, Qwen3-4B, Qwen2.5-VL, DETR, AuraSR ×4, BRIA RMBG-2.0 et Wan 2.2 I2V A14B. Chaque nœud de sortie devient un point d'accès REST, et avec mcp_server=True, ces points d'accès deviennent des outils MCP appelables par des assistants IA comme Claude Code ou Cursor.
Motif de la recommandation :L'article détaille comment reconstruire l'ensemble des fonctionnalités d'AUTOMATIC1111 avec 73 nœuds Gradio Workflow, et comment chaque sortie devient un point d'accès REST et un outil MCP.
OpenAI met GPT-Live-1 à disposition dans l'API, apportant des conversations vocales naturelles en full-duplex。
Motif de la recommandation :L'original présente les capacités vocales et le support téléphonique de GPT-Live-1, ce qui permet de juger des scénarios de voix en temps réel dans l'API.
OpenAI lance l'API Agents, un service managé propulsé par le Codex harness pour l'orchestration。
Motif de la recommandation :L'annonce expose l'API Agents et son service managé pour l'orchestration et les sessions longues, utile pour évaluer les flux d'agents cloud.
Google DeepMind présente AlphaGenome Atlas, une plateforme contenant les prédictions des effets de 9 milliards de variants mononucléotidiques.
Motif de la recommandation :Le texte détaille une ressource de 1 pétaoctet couvrant 9 milliards de variants et un score AVI unifié, ce qui permet de situer la portée pratique pour la recherche génomique.
OpenAI lance ChatGPT Images 2.5, qui transforme les idées, croquis et photos de référence en images plus personnalisées et plus soignées, reflétant mieux les intentions de l'utilisateur.
GitHub annonce Project HydraFusion, un aperçu de recherche disponible sur tous les forfaits GitHub Copilot via /experimental dans GitHub Copilot CLI。
Motif de la recommandation :GitHub détaille trois modes d'orchestration multi-modèles et des résultats de benchmarks avec écarts de coût, utiles pour évaluer les compromis qualité-coût des workflows d'agents.
Google DeepMind lance le Fairwind Program, un programme à accès limité destiné aux gouvernements et partenaires de confiance pour utiliser ses capacités de cyberdéfense avancées. Le programme associe le modèle Gemini 3.8 Flash Cyber au harness CodeMender pour trouver, vérifier et corriger des vulnérabilités à l'échelle agentique, avec des correctifs vérifiés prêts au déploiement générés en quelques minutes au lieu de plusieurs semaines. Plus de 650 partenaires participent, avec un accès initial réservé aux gouvernements, autorités cyber nationales, opérateurs d'infrastructures critiques et plateformes technologiques, sous conditions d'usage strictes incluant l'authentification multifacteur. Google.org porte son financement total en cybersécurité à plus de 100 millions de dollars.
Motif de la recommandation :Le programme détaille l'accès restreint à Gemini 3.8 Flash Cyber et CodeMender, ce qui permet de situer les capacités de correction autonome de vulnérabilités et leurs conditions d'accès.