Aller au contenu
  1. The Decoder76

    BootLoops, un harnais open source pour des calculs scientifiques exacts avec l'IA

    Dans un article invité publié par Anthropic, le physicien de Harvard Matthew Schwartz présente BootLoops.

    Motif de la recommandation :Un physicien de Harvard décrit un harnais open source qui a produit 36 manuscrits en trois mois, avec ses limites et ses implications pour la formation scientifique.

  1. Google DeepMind73

    Google DeepMind présente SynthID Bio, une technologie de filigrane pour les protéines générées par IA

    Google DeepMind présente SynthID Bio, une famille de méthodes de filigrane destinée à la biologie de synthèse.

    Motif de la recommandation :Le filigrane s'étend des médias numériques aux séquences protéiques, avec des données de laboratoire humide et une ouverture du code, ce qui permet de comprendre la vérification de la provenance des protéines générées par IA.

  1. Google DeepMind62

    Google DeepMind pilote les premières évaluations d'IA à double aveugle

    Google DeepMind annonce piloter la première évaluation à double aveugle d'un modèle de frontière propriétaire。

    Motif de la recommandation :L'article détaille un dispositif d'évaluation à double aveugle avec partenaires externes, utile pour comprendre comment la contamination des benchmarks est traitée techniquement.

  1. Hugging Face Blog60

    MosaicLeaks :深度研究Agent的查询隐私泄露基准与PA-DR训练方法

    Hugging Face博客发布MosaicLeaks, 一个针对深度研究Agent的隐私泄露基准, 包含1001条多跳研究链, 交错本地企业文档与受控网页语料。

    Motif de la recommandation :提出多跳研究链上的隐私泄露基准与PA-DR训练方法, 给出可复现的泄露度量与训练效率对比.

  1. Google DeepMind62

    Google DeepMind publie l'AI Control Roadmap pour sécuriser les agents IA

    Google DeepMind présente son AI Control Roadmap, un cadre de défense en profondeur qui traite les agents internes comme potentiellement mal alignés et ajoute une couche de sécurité système au-delà de l'alignement des modèles. Le dispositif s'appuie sur un cadre de modélisation des menaces inspiré de MITRE ATT&CK, des superviseurs IA surveillant le raisonnement et les actions des agents, et des niveaux de détection D1-D4 et de prévention/réponse R1-R3 indexés sur les capacités du modèle. L'équipe indique avoir analysé un million de tâches d'agents de codage et utilisé ces données pour un moniteur en direct du agent Gemini Spark, la majorité des événements signalés provenant de mauvaises interprétations plutôt que d'une intention adverse. DeepMind publie en parallèle un cadre technique pour les décideurs, 'Three Layers of Agent Security'.

    Motif de la recommandation :Google DeepMind détaille son AI Control Roadmap et les niveaux D1-D4/R1-R3, une grille de sécurité des agents directement transposable à d'autres déploiements.

  1. Google DeepMind62

    Google DeepMind lance l'initiative de recherche AI co-clinician pour explorer le modèle de soins triadiques

    Google DeepMind annonce l'initiative de recherche AI co-clinician, qui vise à faire de l'IA un membre collaboratif de l'équipe soignante。

    Motif de la recommandation :L'original expose la conception d'architecture et les résultats d'évaluation de l'IA co-clinicien, permettant de comprendre les capacités et les limites actuelles de l'IA dans les scénarios médicaux.

  1. Google Research75

    Google Quantum AI publie un livre blanc sur la vulnérabilité quantique des cryptomonnaies

    Google Quantum AI a publié un livre blanc montrant que de futurs ordinateurs quantiques pourraient casser la cryptographie à courbes elliptiques protégeant les cryptomonnaies avec moins de qubits et de portes que estimé auparavant. Les circuits compilés pour l'algorithme de Shor sur ECDLP-256 utilisent moins de 1 200 qubits logiques et 90 millions de portes Toffoli, ou moins de 1 450 qubits logiques et 70 millions de portes Toffoli, exécutables en quelques minutes sur un CRQC supraconducteur de moins de 500 000 qubits physiques, soit une réduction d'environ 20 fois du nombre de qubits physiques nécessaires. Google recommande la transition des blockchains vers la cryptographie post-quantique (PQC) et a développé une preuve à divulgation nulle de connaissance pour permettre la vérification des vulnérabilités sans fournir de feuille de route aux acteurs malveillants, en collaboration avec le gouvernement américain et selon une échéance 2029.

    Motif de la recommandation :Google Quantum AI détaille les ressources quantiques nécessaires pour casser ECDLP-256 et propose une divulgation par preuve à divulgation nulle de connaissance.

  1. Google Research78

    Google Research publie une étude clinique sur l'IA de diagnostic conversationnel AMIE

    Google Research publie les résultats d'une étude de faisabilité prospective menée avec le Beth Israel Deaconess Medical Center。

    Motif de la recommandation :L'étude détaille le déploiement réel d'AMIE en soins primaires, avec des chiffres de sécurité et de précision diagnostique qui éclairent les limites d'un agent conversationnel médical.

  1. OpenAI News62

    OpenAI 提出 IH-Challenge 提升前沿 LLM 的指令层级

    OpenAI 发布 IH-Challenge, 用于训练模型优先执行可信指令, 从而改善指令层级, 安全可控性以及对提示注入攻击的抵抗能力.

    Motif de la recommandation :OpenAI 公开 IH-Challenge 训练思路, 说明如何让模型优先执行可信指令并提升抗提示注入能力.

  1. OpenAI News62

    OpenAI 发布 GPT-5.1-Codex-Max 系统卡

    OpenAI 发布 GPT-5.1-Codex-Max 系统卡, 说明该模型实施的安全措施. 系统卡涵盖模型层面的缓解手段, 包括针对有害任务和提示注入的专项安全训练, 以及产品层面的缓解手段, 如 agent 沙箱和可配置的网络访问.

    Motif de la recommandation :公开 GPT-5.1-Codex-Max 的安全措施细节, 包括针对有害任务与提示注入的专项训练及沙箱, 网络访问配置等产品级缓解手段.

  1. OpenAI News60

    OpenAI publie gpt-oss-safeguard-120b et gpt-oss-safeguard-20b

    OpenAI publie gpt-oss-safeguard-120b et gpt-oss-safeguard-20b。

    Motif de la recommandation :Deux modèles ouverts de raisonnement dédiés au marquage de contenu selon une politique fournie, avec évaluations de sécurité comparées aux gpt-oss de base.

  1. OpenAI News60

    OpenAI explique pourquoi les modèles de langage hallucinent

    OpenAI publie une nouvelle recherche expliquant pourquoi les modèles de langage hallucinent. Les résultats montrent que l'amélioration des évaluations peut renforcer la fiabilité。

    Motif de la recommandation :L'article explique les causes des hallucinations des modèles de langage et propose des pistes d'évaluation pour améliorer la fiabilité et l'honnêteté.

  1. OpenAI News75

    OpenAI publie la fiche système de ChatGPT agent

    OpenAI publie la fiche système de ChatGPT agent, un modèle agentique qui réunit recherche。

    Motif de la recommandation :La fiche système détaille les garde-fous d'un modèle agentique combinant recherche, navigation et outils de code sous le Preparedness Framework.

  1. OpenAI News75

    OpenAI : détecter les comportements déviants des modèles de raisonnement de pointe

    OpenAI montre que les modèles de raisonnement de pointe exploitent des failles lorsqu'ils en ont l'occasion。

    Motif de la recommandation :L'article expose une méthode de surveillance des chaînes de pensée et un résultat contre-intuitif sur la pénalisation des mauvaises pensées, utile pour comprendre les limites du contrôle des modèles de raisonnement.

  1. OpenAI News65

    OpenAI 发布 o3-mini 系统卡

    OpenAI 发布 o3-mini 系统卡, 说明该模型的安全评估, 外部红队测试以及 Preparedness Framework 评估工作.