Aller au contenu
  1. OpenAI News62

    OpenAI 提出 IH-Challenge 提升前沿 LLM 的指令层级

    OpenAI 发布 IH-Challenge, 用于训练模型优先执行可信指令, 从而改善指令层级, 安全可控性以及对提示注入攻击的抵抗能力.

    Motif de la recommandation :OpenAI 公开 IH-Challenge 训练思路, 说明如何让模型优先执行可信指令并提升抗提示注入能力.

  1. OpenAI News65

    GPT-5 réduit le coût de la synthèse de protéines sans cellules

    Un laboratoire autonome combinant GPT-5 d'OpenAI avec l'automatisation cloud de Ginkgo Bioworks a réduit de 40 % le coût de la synthèse de protéines sans cellules grâce à une expérimentation en boucle fermée.

    Motif de la recommandation :Un laboratoire autonome combinant GPT-5 et l'automatisation cloud de Ginkgo Bioworks réduit de 40 % le coût de la synthèse de protéines sans cellules.

  1. OpenAI News62

    OpenAI 发布 GPT-5.1-Codex-Max 系统卡

    OpenAI 发布 GPT-5.1-Codex-Max 系统卡, 说明该模型实施的安全措施. 系统卡涵盖模型层面的缓解手段, 包括针对有害任务和提示注入的专项安全训练, 以及产品层面的缓解手段, 如 agent 沙箱和可配置的网络访问.

    Motif de la recommandation :公开 GPT-5.1-Codex-Max 的安全措施细节, 包括针对有害任务与提示注入的专项训练及沙箱, 网络访问配置等产品级缓解手段.

  1. OpenAI News60

    OpenAI publie gpt-oss-safeguard-120b et gpt-oss-safeguard-20b

    OpenAI publie gpt-oss-safeguard-120b et gpt-oss-safeguard-20b。

    Motif de la recommandation :Deux modèles ouverts de raisonnement dédiés au marquage de contenu selon une politique fournie, avec évaluations de sécurité comparées aux gpt-oss de base.

  1. OpenAI News62

    OpenAI 推出 GDPval 评估, 衡量模型在真实工作任务上的表现

    OpenAI 推出 GDPval, 一项新的评估, 用于衡量模型在 44 种职业中具有真实经济价值的任务上的表现.

    Motif de la recommandation :OpenAI 公布 GDPval 评估, 覆盖 44 种职业的真实经济价值任务, 可用于对照模型在现实工作场景中的表现.

  1. OpenAI News60

    OpenAI explique pourquoi les modèles de langage hallucinent

    OpenAI publie une nouvelle recherche expliquant pourquoi les modèles de langage hallucinent. Les résultats montrent que l'amélioration des évaluations peut renforcer la fiabilité。

    Motif de la recommandation :L'article explique les causes des hallucinations des modèles de langage et propose des pistes d'évaluation pour améliorer la fiabilité et l'honnêteté.

  1. OpenAI News75

    OpenAI publie la fiche système de ChatGPT agent

    OpenAI publie la fiche système de ChatGPT agent, un modèle agentique qui réunit recherche。

    Motif de la recommandation :La fiche système détaille les garde-fous d'un modèle agentique combinant recherche, navigation et outils de code sous le Preparedness Framework.

  1. OpenAI News75

    OpenAI : détecter les comportements déviants des modèles de raisonnement de pointe

    OpenAI montre que les modèles de raisonnement de pointe exploitent des failles lorsqu'ils en ont l'occasion。

    Motif de la recommandation :L'article expose une méthode de surveillance des chaînes de pensée et un résultat contre-intuitif sur la pénalisation des mauvaises pensées, utile pour comprendre les limites du contrôle des modèles de raisonnement.

  1. OpenAI News60

    OpenAI 发布 SWE-Lancer 基准

    OpenAI 发布 SWE-Lancer 基准, 用于评估前沿 LLM 能否完成真实自由职业软件工程任务并赚取 100 万美元.

  1. OpenAI News65

    OpenAI 发布 o3-mini 系统卡

    OpenAI 发布 o3-mini 系统卡, 说明该模型的安全评估, 外部红队测试以及 Preparedness Framework 评估工作.

  1. OpenAI News62

    OpenAI présente l'alignement délibératif : le raisonnement au service de modèles de langage plus sûrs

    OpenAI présente une nouvelle stratégie d'alignement destinée aux modèles o1, qui consiste à leur enseigner directement des spécifications de sécurité et la manière de raisonner à partir de celles-ci.

    Motif de la recommandation :Présente une stratégie d'alignement pour les modèles o1, utile pour comprendre comment le raisonnement est mobilisé au service de la sécurité.

  1. OpenAI News70

    OpenAI 发布 o1 系统卡

    OpenAI 发布 o1 系统卡, 说明在发布 o1 和 o1-mini 之前开展的安全工作, 包括外部红队测试以及依据 Preparedness Framework 进行的前沿风险评测.

    Motif de la recommandation :公开 o1 与 o1-mini 发布前的安全评估流程, 包括外部红队与前沿风险评测, 便于了解模型发布前的安全审查做法.