Aller au contenu
  1. Hugging Face Blog62

    ServiceNow présente AutoSynthData, un pipeline de génération de données d'entraînement pour agents d'entreprise

    ServiceNow CoreAI présente AutoSynthData, un pipeline qui transforme les échecs d'un modèle cible et les succès d'un enseignant plus fort en nouvelles tâches d'entraînement validées dans l'environnement. Le système génère des tâches composées d'une spécification système, d'un prompt utilisateur et d'un vérificateur, avec des contrôles de faisabilité, de réalisme et de difficulté, puis une vérification positive et négative et une phase de réparation. Sur EnterpriseOps Gym Hybrid, avec Gemma-4-26B-A4B-it comme cible et Qwen3.8-27B comme enseignant, 2 000 échantillons générés en environ 18 heures améliorent le Pass@1 moyen de 7,2 points, soit une hausse relative de 35 %, et le taux de succès du vérificateur passe de 63,01 % à 68,55 %. Sur ITSM, avec DeepSeek-V4.1-Flash comme enseignant, 1 994 échantillons générés en 66 heures font passer le Pass@1 moyen de 18,77 % à 27,18 %.

    Motif de la recommandation :L'article détaille un pipeline de génération de données d'entraînement pour agents d'entreprise, avec les critères de qualité et les résultats chiffrés sur deux domaines.

  1. Google DeepMind88

    Google DeepMind annonce Gemini 4 Argon, son nouveau modèle frontière

    Google DeepMind annonce Gemini 4 Argon, un modèle frontière conçu pour maintenir un raisonnement profond sur des workflows complexes et longs.

    Motif de la recommandation :L'annonce détaille les capacités d'Argon en codage, travail de connaissance et cybersécurité, ainsi que son prix et son déploiement progressif.

  1. NVIDIA Blog62

    NVIDIA et CoreWeave mettent en production Vera Rubin NVL72 et la CPU Vera pour l'IA agentique

    CoreWeave annonce la disponibilité des systèmes NVIDIA Vera Rubin NVL72 avec réseau Spectrum-X 102.4T Ethernet.

    Motif de la recommandation :L'annonce détaille la disponibilité en production de Vera Rubin NVL72 et de la CPU Vera, avec des chiffres de débit et de démarrage de sandbox qui aident à évaluer les charges agentiques.

  1. OpenAI News85

    OpenAI lance GPT-6.1 Sol

    OpenAI lance GPT-6.1 Sol, présenté comme offrant une intelligence proche d'Astra pour le codage。

    Motif de la recommandation :L'annonce donne le positionnement du modèle et un écart de prix par rapport à Astra, utile pour évaluer le coût d'un changement de modèle.

  1. GitHub Blog · AI & ML62

    GitHub Security Lab Taskflow Agent : un pipeline de fuzzing autonome pour les projets C/C++

    GitHub Security Lab publie le Fuzzing Taskflow, un pipeline de fuzzing autonome pour les projets C/C++ construit sur son framework Taskflow Agent. Il suffit d'indiquer un dépôt GitHub pour que l'agent identifie les points d'entrée, analyse le système de build, écrit les harnesses, lance AFL++, lit les rapports de couverture, améliore les harnesses, trie les crashs et rédige un rapport de vulnérabilité par bug unique. Le pipeline sépare les décisions de l'agent des outils MCP qui exécutent réellement les opérations, stocke l'état dans une base SQLite et utilise Claude Sonnet 5 par défaut. L'auteur prévient que le taskflow exécute afl-fuzz, clang et des commandes de build choisies par le LLM directement sur l'hôte, et recommande de ne le lancer que dans un environnement jetable sans privilèges élevés.

    Motif de la recommandation :Le pipeline détaille la répartition des tâches entre l'agent et les outils MCP, ainsi que la boucle de rétroaction sur la couverture, une méthode directement transposable à d'autres automatisations de sécurité.

  1. GitHub Blog · AI & ML83

    GitHub Copilot migre son runtime d'agent vers Rust avec l'aide de Copilot

    GitHub a réécrit le runtime de l'agent Copilot, initialement en TypeScript sur Node.js.

    Motif de la recommandation :Le récit détaillé d'une migration de runtime de 430 000 lignes de TypeScript vers Rust menée par des agents, avec les chiffres de cache, de compaction et de répartition des rôles.

  1. Mistral AI62

    Mistral AI : moderniser un code legacy complexe avec des agents IA

    Mistral AI a migré 40 000 lignes de Fortran 77 vers C++ pour un opérateur énergétique européen.

    Motif de la recommandation :L'article détaille un workflow d'agents structuré avec harnais de parité et documentation préalable, directement transposable à d'autres migrations de code legacy.

  1. OpenAI News78

    GPT-5.6 : comment concilier intelligence de pointe et efficacité

    OpenAI présente GPT-5.6, qui améliore l'efficacité de l'IA au niveau des modèles, de l'inférence et des workflows d'agents, afin d'offrir davantage d'intelligence utile par dollar dépensé.

    Motif de la recommandation :L'original indique que GPT-5.6 améliore l'efficacité au niveau du modèle, de l'inférence et des workflows d'agents, ce qui permet de juger de l'évolution du rapport coût-performance.

  1. OpenAI News67

    OpenAI présente ChatGPT Work, un agent pour les projets ambitieux

    OpenAI présente ChatGPT Work, un agent capable d'agir dans vos applications et fichiers, de rester sur un projet pendant des heures si nécessaire et de transformer un objectif en travail achevé.

    Motif de la recommandation :Présentation de ChatGPT Work comme agent capable d'agir sur les applications et fichiers et de mener un projet sur plusieurs heures.

  1. OpenAI News62

    OpenAI propose ses modèles, Codex et Managed Agents sur AWS

    OpenAI annonce que ses modèles GPT, Codex et Managed Agents sont désormais disponibles sur AWS. Les entreprises peuvent ainsi développer des solutions d'IA sécurisées directement dans leur environnement AWS.

    Motif de la recommandation :Les modèles OpenAI, Codex et Managed Agents sont désormais disponibles sur AWS, ce qui permet aux entreprises de déployer l'IA dans leur environnement cloud existant.

  1. OpenAI News62

    OpenAI lance les agents d'espace de travail dans ChatGPT

    OpenAI lance les agents d'espace de travail dans ChatGPT, des agents propulsés par Codex qui automatisent des flux de travail complexes。

    Motif de la recommandation :Présente les agents d'espace de travail de ChatGPT et leur exécution cloud sécurisée, utile pour évaluer l'automatisation des flux d'équipe.

  1. OpenAI News62

    OpenAI met à jour le SDK Agents avec exécution sandbox native et harness natif du modèle

    OpenAI met à jour le SDK Agents en y intégrant l'exécution sandbox native et un harness natif du modèle. Ces changements visent à aider les développeurs à construire des agents sécurisés et de longue durée capables d'opérer sur des fichiers et des outils.

    Motif de la recommandation :L'original expose les deux changements clés du SDK Agents, exécution sandbox native et harness natif du modèle, ce qui permet de juger comment les agents longs et sécurisés modifient les flux de développement existants.

  1. OpenAI News60

    ChatGPT enrichit la découverte de produits avec l'Agentic Commerce Protocol

    ChatGPT introduit une expérience d'achat plus riche et visuellement immersive, propulsée par l'Agentic Commerce Protocol. Elle permet la découverte de produits。

    Motif de la recommandation :ChatGPT ajoute une découverte produit visuelle et comparative via l'Agentic Commerce Protocol, avec intégration marchande.

  1. OpenAI News78

    OpenAI lance GPT-5.4 mini et nano

    OpenAI lance GPT-5.4 mini et nano, deux versions plus petites et plus rapides de GPT-5.4。

    Motif de la recommandation :L'original indique les scénarios ciblés par les deux petites versions de GPT-5.4, utile pour évaluer le choix de modèle pour les charges API à haut volume.