Aller au contenu
  1. Hugging Face Blog62

    ServiceNow présente AutoSynthData, un pipeline de génération de données d'entraînement pour agents d'entreprise

    ServiceNow CoreAI présente AutoSynthData, un pipeline qui transforme les échecs d'un modèle cible et les succès d'un enseignant plus fort en nouvelles tâches d'entraînement validées dans l'environnement. Le système génère des tâches composées d'une spécification système, d'un prompt utilisateur et d'un vérificateur, avec des contrôles de faisabilité, de réalisme et de difficulté, puis une vérification positive et négative et une phase de réparation. Sur EnterpriseOps Gym Hybrid, avec Gemma-4-26B-A4B-it comme cible et Qwen3.8-27B comme enseignant, 2 000 échantillons générés en environ 18 heures améliorent le Pass@1 moyen de 7,2 points, soit une hausse relative de 35 %, et le taux de succès du vérificateur passe de 63,01 % à 68,55 %. Sur ITSM, avec DeepSeek-V4.1-Flash comme enseignant, 1 994 échantillons générés en 66 heures font passer le Pass@1 moyen de 18,77 % à 27,18 %.

    Motif de la recommandation :L'article détaille un pipeline de génération de données d'entraînement pour agents d'entreprise, avec les critères de qualité et les résultats chiffrés sur deux domaines.

  1. Google DeepMind73

    Google DeepMind présente SynthID Bio, une technologie de filigrane pour les protéines générées par IA

    Google DeepMind présente SynthID Bio, une famille de méthodes de filigrane destinée à la biologie de synthèse.

    Motif de la recommandation :Le filigrane s'étend des médias numériques aux séquences protéiques, avec des données de laboratoire humide et une ouverture du code, ce qui permet de comprendre la vérification de la provenance des protéines générées par IA.

  1. Microsoft Research62

    Microsoft Research présente Quine, un système de recherche IA pour la biologie

    Microsoft Research présente Quine, un effort de recherche combinant un modèle mondial multimodal de biologie et un harnais interactif reliant modèles.

    Motif de la recommandation :Microsoft Research présente Quine, un modèle mondial multimodal de biologie couplé à un harnais, avec une validation en laboratoire humide sur le cancer du pancréas.

  1. NVIDIA Blog62

    NVIDIA et Google DeepMind publient des structures protéiques de plus de 2800 virus

    NVIDIA rejoint une coalition incluant Google DeepMind et EMBL-EBI pour publier en accès libre les structures 3D prédites des complexes protéiques de plus de 2800 virus via la base AlphaFold. Les structures ont été inférées avec AlphaFold2 optimisé par NVIDIA BioNeMo Inference Runtime, et NVIDIA publie aussi le BioNeMo Structure Prediction Pipeline utilisé pour générer le jeu de données. Environ 30 % des interactions protéiques ajoutées sont totalement nouvelles pour la science, selon l'annonce.

    Motif de la recommandation :NVIDIA et Google DeepMind ouvrent des structures protéiques virales prédites, un cas concret de données scientifiques partagées pour la préparation pandémique.

  1. Microsoft Research60

    Microsoft Research publie RetroChimera dans Nature pour améliorer la prédiction de synthèse des petites molécules

    Microsoft Research annonce la publication dans Nature de RetroChimera, un modèle de rétrosynthèse qui combine R-SMILES 2.

    Motif de la recommandation :L'article détaille l'architecture d'ensemble et le ré-ordonnancement appris de RetroChimera, ainsi que ses résultats en tests à l'aveugle, ce qui permet de juger de l'apport de la combinaison de deux modèles complémentaires.

  1. OpenAI News62

    OpenAI publie un cadre de signalement du désalignement des modèles et six rapports de comportements anormaux

    OpenAI présente un cadre pour suivre, enquêter et divulguer le désalignement des modèles, accompagné de six rapports portant sur des comportements de modèle inattendus ou préoccupants.

    Motif de la recommandation :Un cadre de suivi et de divulgation du désalignement des modèles, accompagné de six rapports de comportements inattendus, utile pour comprendre les pratiques de sécurité des modèles.

  1. Google DeepMind88

    Google DeepMind lance AlphaGenome Atlas, une carte prédictive des 9 milliards de variants du génome humain

    Google DeepMind présente AlphaGenome Atlas, une plateforme contenant les prédictions des effets de 9 milliards de variants mononucléotidiques.

    Motif de la recommandation :Le texte détaille une ressource de 1 pétaoctet couvrant 9 milliards de variants et un score AVI unifié, ce qui permet de situer la portée pratique pour la recherche génomique.

  1. Google Research62

    Google Research publie la carte complète du cerveau de la drosophile mâle

    Google Research, en partenariat avec le HHMI Janelia Research Campus et des collaborateurs de Cambridge。

    Motif de la recommandation :Le texte détaille la méthode de reconstruction assistée par IA et la mise à disposition d'une carte cérébrale ouverte, utile pour comprendre l'état de la connectomique.

  1. OpenAI News88

    Un modèle d'OpenAI réfute une conjecture centrale en géométrie discrète

    Un modèle d'OpenAI a résolu le problème des distances unitaires, vieux de 80 ans。

    Motif de la recommandation :Un modèle d'OpenAI résout le problème des distances unitaires vieux de 80 ans et réfute une conjecture centrale en géométrie discrète, un cas concret de raisonnement mathématique par IA.