Aller au contenu
3mois23jourlundi
3mois19jourjeudi
3mois17jourmardi
3mois16jourlundi
3mois12jourjeudi
  1. Google Research78

    Google Research publie une étude clinique sur l'IA de diagnostic conversationnel AMIE

    Google Research publie les résultats d'une étude de faisabilité prospective menée avec le Beth Israel Deaconess Medical Center。

    Motif de la recommandation :L'étude détaille le déploiement réel d'AMIE en soins primaires, avec des chiffres de sécurité et de précision diagnostique qui éclairent les limites d'un agent conversationnel médical.

3mois11jourmercredi
3mois10jourmardi
3mois9jourlundi
  1. OpenAI News62

    OpenAI annonce l'acquisition de Promptfoo

    OpenAI annonce l'acquisition de Promptfoo, une plateforme de sécurité IA qui aide les entreprises à identifier et corriger les vulnérabilités de leurs systèmes d'IA pendant le développement.

    Motif de la recommandation :Une acquisition d'OpenAI dans la sécurité des systèmes d'IA, qui éclaire le positionnement des plateformes de test de vulnérabilités.

3mois6jourvendredi
3mois5jourjeudi
2mois28joursamedi
  1. OpenAI News62

    OpenAI annonce un accord avec le ministère de la Guerre

    OpenAI a conclu un contrat avec le ministère de la Guerre, dont les détails portent sur les lignes rouges de sécurité。

    Motif de la recommandation :L'accord entre OpenAI et le ministère de la Guerre précise les lignes rouges de sécurité et les protections juridiques encadrant le déploiement de l'IA en environnement classifié.

2mois27jourvendredi
2mois19jourjeudi
2mois18jourmercredi
2mois13jourvendredi
2mois5jourjeudi
2mois4jourmercredi
  1. Google Research62

    Google Research et Included Health lancent une étude randomisée nationale sur l'IA en soins virtuels

    Google Research annonce, en partenariat avec Included Health, le lancement d'une étude randomisée nationale prospective avec consentement。

    Motif de la recommandation :L'original expose le passage de la simulation à un essai randomisé national en soins virtuels réels, avec les étapes de recherche qui le précèdent.

2mois1jourdimanche
1mois28jourmercredi
1mois20jourmardi
1mois14jourmercredi
12mois23jourmardi
  1. Hugging Face Blog62

    ServiceNow-AI publie AprielGuard, un modèle de garde-fou de 8B paramètres pour la sécurité des systèmes LLM

    ServiceNow-AI publie AprielGuard, un modèle de garde-fou de 8B paramètres conçu pour détecter 16 catégories de risques de sécurité ainsi que diverses attaques adversariales。

    Motif de la recommandation :Un modèle de garde-fou de 8B paramètres couvrant 16 catégories de risques et les attaques adversariales des workflows agentiques, avec les résultats d'évaluation détaillés.

12mois22jourlundi
  1. OpenAI News60

    OpenAI renforce ChatGPT Atlas contre l'injection de prompt

    OpenAI renforce ChatGPT Atlas contre les attaques d'injection de prompt en s'appuyant sur un red teaming automatisé entraîné par apprentissage par renforcement. Cette boucle proactive de découverte et de correction vise à identifier en amont de nouveaux exploits et à durcir les défenses de l'agent navigateur à mesure que l'IA devient plus agentique.

    Motif de la recommandation :L'original expose la boucle automatique de red teaming et de correction d'Atlas, ce qui permet de comprendre comment les défenses d'un agent navigateur sont renforcées.

12mois19jourvendredi
12mois18jourjeudi
  1. OpenAI News38

    OpenAI met à jour son Model Spec avec des protections pour les adolescents

    OpenAI met à jour son Model Spec en y intégrant de nouveaux principes Under-18 qui définissent la manière dont ChatGPT doit accompagner les adolescents avec des conseils sûrs et adaptés à leur âge, fondés sur la science du développement. Cette mise à jour renforce les garde-fous et clarifie le comportement attendu du modèle dans les situations à risque élevé. Elle s'inscrit dans les efforts plus larges d'OpenAI pour améliorer la sécurité des adolescents sur ChatGPT.

12mois16jourmardi
  1. Google DeepMind62

    Google DeepMind publie Gemma Scope 2, une suite d'outils d'interprétabilité pour toute la famille Gemma 3

    Google DeepMind annonce Gemma Scope 2, une suite ouverte d'outils d'interprétabilité couvrant toutes les tailles de la famille Gemma 3。

    Motif de la recommandation :L'original expose la couverture complète de Gemma Scope 2 sur la famille Gemma 3 et les techniques d'entraînement employées, ce qui permet de situer les outils d'interprétabilité disponibles pour l'audit des modèles.

  2. OpenAI News38

    OpenAI mesure la capacité de l'IA à accélérer la recherche biologique

    OpenAI présente un cadre d'évaluation en conditions réelles pour mesurer comment l'IA peut accélérer la recherche biologique en laboratoire humide. GPT-5 a été utilisé pour optimiser un protocole de clonage moléculaire, explorant à la fois les promesses et les risques de l'expérimentation assistée par IA.

12mois11jourjeudi
  1. Google DeepMind22

    Google DeepMind élargit son partenariat avec l'UK AI Security Institute

    Google DeepMind élargit son partenariat avec l'UK AI Security Institute (AISI) via un nouveau Memorandum of Understanding portant sur la recherche fondamentale en sécurité et sûreté. Le partenariat, qui s'appuie sur une collaboration entamée depuis la création de l'AISI en novembre 2023, inclut le partage d'accès aux modèles propriétaires, des rapports conjoints et des recherches collaboratives. Les axes clés couvrent la surveillance des processus de raisonnement (chain-of-thought), l'étude des impacts sociaux et émotionnels du désalignement socioaffectif, et l'évaluation de l'impact économique de l'IA par simulation de tâches réelles.

  2. Google Research38

    Google présente Urania, un framework de confidentialité différentielle pour analyser l'usage des chatbots IA

    Google Research présente Urania, un framework de confidentialité différentielle (DP) qui génère des insights sur les conversations avec les chatbots LLM avec des garanties mathématiques de bout en bout, présenté à COLM 2025. Le pipeline combine clustering DP, extraction de mots-clés par histogramme DP et summarization par LLM sur les seuls mots-clés anonymisés, sans jamais exposer les conversations originales. Face au baseline non privé Simple-CLIO, les résumés DP ont été préférés jusqu'à 70 % du temps par les évaluateurs LLM, malgré une couverture thématique réduite lorsque le budget de confidentialité ε diminue.

12mois10jourmercredi
  1. Google DeepMind62

    Google DeepMind renforce son partenariat avec le gouvernement britannique pour l'IA dans la science et l'éducation

    Google DeepMind annonce un partenariat renforcé avec le gouvernement britannique pour accélérer l'usage de l'IA dans la science。

    Motif de la recommandation :Le partenariat détaille des accès prioritaires à des modèles scientifiques et un laboratoire automatisé, ce qui éclaire la trajectoire de l'IA appliquée à la recherche publique.