Aller au contenu
  1. Hugging Face Blog62

    ServiceNow présente AutoSynthData, un pipeline de génération de données d'entraînement pour agents d'entreprise

    ServiceNow CoreAI présente AutoSynthData, un pipeline qui transforme les échecs d'un modèle cible et les succès d'un enseignant plus fort en nouvelles tâches d'entraînement validées dans l'environnement. Le système génère des tâches composées d'une spécification système, d'un prompt utilisateur et d'un vérificateur, avec des contrôles de faisabilité, de réalisme et de difficulté, puis une vérification positive et négative et une phase de réparation. Sur EnterpriseOps Gym Hybrid, avec Gemma-4-26B-A4B-it comme cible et Qwen3.8-27B comme enseignant, 2 000 échantillons générés en environ 18 heures améliorent le Pass@1 moyen de 7,2 points, soit une hausse relative de 35 %, et le taux de succès du vérificateur passe de 63,01 % à 68,55 %. Sur ITSM, avec DeepSeek-V4.1-Flash comme enseignant, 1 994 échantillons générés en 66 heures font passer le Pass@1 moyen de 18,77 % à 27,18 %.

    Motif de la recommandation :L'article détaille un pipeline de génération de données d'entraînement pour agents d'entreprise, avec les critères de qualité et les résultats chiffrés sur deux domaines.

  1. Google DeepMind88

    Google DeepMind annonce Gemini 4 Argon, son nouveau modèle frontière

    Google DeepMind annonce Gemini 4 Argon, un modèle frontière conçu pour maintenir un raisonnement profond sur des workflows complexes et longs.

    Motif de la recommandation :L'annonce détaille les capacités d'Argon en codage, travail de connaissance et cybersécurité, ainsi que son prix et son déploiement progressif.

  1. NVIDIA Blog62

    NVIDIA et CoreWeave mettent en production Vera Rubin NVL72 et la CPU Vera pour l'IA agentique

    CoreWeave annonce la disponibilité des systèmes NVIDIA Vera Rubin NVL72 avec réseau Spectrum-X 102.4T Ethernet.

    Motif de la recommandation :L'annonce détaille la disponibilité en production de Vera Rubin NVL72 et de la CPU Vera, avec des chiffres de débit et de démarrage de sandbox qui aident à évaluer les charges agentiques.

  1. OpenAI News85

    OpenAI lance GPT-6.1 Sol

    OpenAI lance GPT-6.1 Sol, présenté comme offrant une intelligence proche d'Astra pour le codage。

    Motif de la recommandation :L'annonce donne le positionnement du modèle et un écart de prix par rapport à Astra, utile pour évaluer le coût d'un changement de modèle.

  1. GitHub Blog · AI & ML62

    GitHub Security Lab Taskflow Agent : un pipeline de fuzzing autonome pour les projets C/C++

    GitHub Security Lab publie le Fuzzing Taskflow, un pipeline de fuzzing autonome pour les projets C/C++ construit sur son framework Taskflow Agent. Il suffit d'indiquer un dépôt GitHub pour que l'agent identifie les points d'entrée, analyse le système de build, écrit les harnesses, lance AFL++, lit les rapports de couverture, améliore les harnesses, trie les crashs et rédige un rapport de vulnérabilité par bug unique. Le pipeline sépare les décisions de l'agent des outils MCP qui exécutent réellement les opérations, stocke l'état dans une base SQLite et utilise Claude Sonnet 5 par défaut. L'auteur prévient que le taskflow exécute afl-fuzz, clang et des commandes de build choisies par le LLM directement sur l'hôte, et recommande de ne le lancer que dans un environnement jetable sans privilèges élevés.

    Motif de la recommandation :Le pipeline détaille la répartition des tâches entre l'agent et les outils MCP, ainsi que la boucle de rétroaction sur la couverture, une méthode directement transposable à d'autres automatisations de sécurité.

  1. GitHub Blog · AI & ML83

    GitHub Copilot migre son runtime d'agent vers Rust avec l'aide de Copilot

    GitHub a réécrit le runtime de l'agent Copilot, initialement en TypeScript sur Node.js.

    Motif de la recommandation :Le récit détaillé d'une migration de runtime de 430 000 lignes de TypeScript vers Rust menée par des agents, avec les chiffres de cache, de compaction et de répartition des rôles.

  1. Mistral AI62

    Mistral AI : moderniser un code legacy complexe avec des agents IA

    Mistral AI a migré 40 000 lignes de Fortran 77 vers C++ pour un opérateur énergétique européen.

    Motif de la recommandation :L'article détaille un workflow d'agents structuré avec harnais de parité et documentation préalable, directement transposable à d'autres migrations de code legacy.

  1. OpenAI News78

    GPT-5.6 : comment concilier intelligence de pointe et efficacité

    OpenAI présente GPT-5.6, qui améliore l'efficacité de l'IA au niveau des modèles, de l'inférence et des workflows d'agents, afin d'offrir davantage d'intelligence utile par dollar dépensé.

    Motif de la recommandation :L'original indique que GPT-5.6 améliore l'efficacité au niveau du modèle, de l'inférence et des workflows d'agents, ce qui permet de juger de l'évolution du rapport coût-performance.

  1. OpenAI News67

    OpenAI présente ChatGPT Work, un agent pour les projets ambitieux

    OpenAI présente ChatGPT Work, un agent capable d'agir dans vos applications et fichiers, de rester sur un projet pendant des heures si nécessaire et de transformer un objectif en travail achevé.

    Motif de la recommandation :Présentation de ChatGPT Work comme agent capable d'agir sur les applications et fichiers et de mener un projet sur plusieurs heures.

  1. OpenAI News60

    ChatGPT enrichit la découverte de produits avec l'Agentic Commerce Protocol

    ChatGPT introduit une expérience d'achat plus riche et visuellement immersive, propulsée par l'Agentic Commerce Protocol. Elle permet la découverte de produits。

    Motif de la recommandation :ChatGPT ajoute une découverte produit visuelle et comparative via l'Agentic Commerce Protocol, avec intégration marchande.

  1. OpenAI News78

    OpenAI lance GPT-5.4 mini et nano

    OpenAI lance GPT-5.4 mini et nano, deux versions plus petites et plus rapides de GPT-5.4。

    Motif de la recommandation :L'original indique les scénarios ciblés par les deux petites versions de GPT-5.4, utile pour évaluer le choix de modèle pour les charges API à haut volume.

  1. OpenAI News60

    OpenAI équipe la Responses API d'un environnement informatique pour agents

    OpenAI a construit un runtime d'agent en s'appuyant sur la Responses API, l'outil shell et des conteneurs hébergés, afin d'exécuter des agents sécurisés et évolutifs avec fichiers, outils et état.

    Motif de la recommandation :L'article détaille l'architecture d'un runtime d'agent basé sur la Responses API, utile pour comprendre le déploiement d'agents sécurisés.

  1. OpenAI News60

    OpenAI lance Codex Security en research preview

    OpenAI annonce Codex Security, un agent de sécurité applicative IA disponible en research preview. Il analyse le contexte du projet pour détecter。

    Motif de la recommandation :Présentation d'un agent de sécurité applicative qui analyse le contexte du projet pour détecter, valider et corriger les vulnérabilités complexes.

  1. OpenAI News88

    OpenAI lance GPT-5.4, modèle frontière pour le travail professionnel

    OpenAI lance GPT-5.4, présenté comme son modèle frontière le plus capable et le plus efficace pour le travail professionnel. Il met en avant des capacités de pointe en codage。

    Motif de la recommandation :Le résumé officiel expose les capacités de codage, d'usage informatique et de recherche d'outils ainsi que la fenêtre de contexte de 1M tokens, ce qui permet de situer les changements de ce modèle frontière.

  1. OpenAI News62

    OpenAI lance Instant Checkout et l'Agentic Commerce Protocol dans ChatGPT

    OpenAI annonce les premiers pas du commerce agentique dans ChatGPT, avec de nouveaux moyens permettant aux utilisateurs。

    Motif de la recommandation :L'original expose les premiers pas d'OpenAI vers le commerce agentique dans ChatGPT, avec Instant Checkout et l'Agentic Commerce Protocol comme points d'entrée.

  1. OpenAI News62

    OpenAI lance en aperçu ChatGPT Pulse pour les utilisateurs Pro sur mobile

    OpenAI publie un aperçu de ChatGPT Pulse destiné aux utilisateurs Pro sur mobile. Pulse est une nouvelle expérience dans laquelle ChatGPT mène des recherches de manière proactive pour fournir des mises à jour personnalisées à partir des conversations, des retours et des applications connectées comme le calendrier.

    Motif de la recommandation :OpenAI expose une nouvelle expérience où ChatGPT effectue des recherches proactives et livre des mises à jour personnalisées, ce qui éclaire l'évolution des usages mobiles.