OpenAI 就第三方网络安全评估事件作出说明并推出新保障措施
OpenAI 针对近期涉及 OpenAI 模型的第三方网络安全评估事件作出说明, 并公布了旨在加强 AI 模型测试与评估的新保障措施. 该说明围绕第三方网络安全评估中出现的相关事件展开, 同时提出了新的防护机制以强化模型测试与评估流程.
OpenAI 针对近期涉及 OpenAI 模型的第三方网络安全评估事件作出说明, 并公布了旨在加强 AI 模型测试与评估的新保障措施. 该说明围绕第三方网络安全评估中出现的相关事件展开, 同时提出了新的防护机制以强化模型测试与评估流程.
OpenAI a démantelé une opération d'escroquerie basée au Cambodge qui utilisait ChatGPT pour appuyer des schémas d'investissement, d'arnaque sentimentale, de jeu et d'usurpation d'identité.
OpenAI et Hugging Face partagent les premières conclusions d'un incident de sécurité survenu lors de l'évaluation de modèles d'IA。
OpenAI partage les enseignements du déploiement de modèles IA à exécution longue。
OpenAI détaille comment ChatGPT est rendu plus sûr pour les adolescents, via des protections adaptées à l'âge。
OpenAI présente GPT-Red, un système de red teaming automatisé qui utilise le self-play pour améliorer la sécurité, l'alignement et la robustesse face aux injections de prompt.
OpenAI dévoile un aperçu de GPT-5.6 Sol, un modèle de nouvelle génération aux capacités renforcées en codage。
Motif de la recommandation :L'aperçu de GPT-5.6 Sol et de sa pile de sécurité permet de suivre l'orientation des capacités en codage, science et cybersécurité.
OpenAI apporte son soutien à la Appia Foundation pour l'élaboration de standards partagés dédiés à l'IA avancée。
OpenAI présente les nouveaux outils Daybreak, dont Codex Security et GPT-5.5-Cyber, destinés à aider les organisations à trouver, valider et corriger les vulnérabilités à grande échelle.
Motif de la recommandation :Présentation des nouveaux outils de sécurité d'OpenAI et de leur objectif de détection et de correction des vulnérabilités à grande échelle.
OpenAI lance Patch the Planet, une initiative Daybreak qui aide les mainteneurs open source à trouver。
OpenAI 推出 Deployment Simulation, 一种在部署前预测 AI 模型行为的方法, 使用真实对话数据来提升安全性和评估准确性.
Motif de la recommandation :OpenAI 提出用真实对话数据在发布前模拟部署以预测模型行为, 为安全评估提供可迁移的方法思路.
OpenAI publie un nouveau rapport détaillant des opérations d'influence liées à la RPC qui utilisent l'IA pour cibler les débats technologiques américains。
OpenAI 公布了一项名为"Built to benefit everyone: our plan"的规划, 围绕可及性, 安全与共享繁荣, 旨在确保 AGI 惠及所有人. 该规划阐述了 OpenAI 对未来 AI 的愿景, 将 access, safety 与 shared prosperity 作为核心方向.
OpenAI publie « Biodefense in the Intelligence Age »。
OpenAI appelle à une action mondiale sur la sécurité des jeunes face à l'IA et propose la création d'un institut international pour renforcer les garde-fous。
OpenAI a banni des comptes probablement originaires de Chine qui utilisaient l'IA pour générer des commentaires et des caricatures sur la politique technologique américaine。
OpenAI封禁了一个疑似源自中国的账号集群, 该集群利用AI生成社交媒体内容, 批评美国数据中心和AI基础设施.
OpenAI lance Rosalind Biodefense, élargissant l'accès de confiance à GPT-Rosalind pour les développeurs vérifiés et les partenaires du gouvernement américain engagés dans la défense biologique, la santé publique et la préparation aux pandémies via l'IA de pointe.
OpenAI publie des recommandations pour les évaluations tierces des systèmes d'IA de pointe。
OpenAI publie son Frontier Governance Framework, qui décrit l'alignement de ses pratiques de sûreté。
OpenAI présente son dispositif pour les élections de 2026, articulé autour de l'accès à une information fiable。
OpenAI annonce des avancées sur la provenance des contenus générés par IA, en s'appuyant sur Content Credentials。
OpenAI déploie de nouvelles mises à jour de sécurité pour ChatGPT afin d'améliorer la détection du risque dans les conversations sensibles. Ces améliorations permettent au modèle de mieux percevoir le contexte au fil du temps et de répondre de manière plus sûre.
OpenAI détaille sa réponse à l'attaque de la chaîne d'approvisionnement TanStack « Mini Shai-Hulud »。
OpenAI détaille comment il exécute Codex de manière sécurisée, en s'appuyant sur le sandboxing。
OpenAI étend Trusted Access for Cyber avec GPT-5.5 et GPT-5.5-Cyber, afin d'aider les défenseurs vérifiés à accélérer la recherche de vulnérabilités et à protéger les infrastructures critiques.
Motif de la recommandation :L'original présente l'extension de l'accès vérifié pour la cyberdéfense et les modèles concernés, ce qui permet de suivre l'évolution des capacités et des conditions d'accès.
OpenAI introduit Trusted Contact dans ChatGPT, une fonctionnalité de sécurité optionnelle qui prévient une personne de confiance si de sérieuses inquiétudes d'automutilation sont détectées.
OpenAI dévoile un plan européen pour la sécurité des jeunes (European Youth Safety Blueprint) ainsi que les subventions EMEA Youth & Wellbeing Grants。
OpenAI 推出 Advanced Account Security, 提供抗钓鱼登录, 更强的账户恢复机制以及增强保护, 用于保护敏感数据并防止账户被接管. 该功能面向账户安全场景, 重点在于抵御钓鱼攻击和降低账户被盗风险.
OpenAI公布了一份面向智能时代的网络安全五部分行动计划, 核心是推动AI驱动的网络防御民主化并保护关键系统. 该计划由OpenAI提出, 旨在强化智能时代的网络安全防护.
OpenAI 通过模型防护, 滥用检测, 政策执行以及与安全专家合作, 保障 ChatGPT 的社区安全. 该说明涵盖模型层面的安全措施, 对违规使用的识别机制, 以及依据政策采取的执行手段. OpenAI 同时强调与安全专家协作, 以持续完善上述安全体系.
OpenAI publie la fiche système de GPT-5.5.
OpenAI publie Privacy Filter, un modèle à poids ouverts destiné à détecter et masquer les informations personnelles identifiables (PII) dans du texte, avec une précision annoncée comme état de l'art.
Motif de la recommandation :Un modèle à poids ouverts d'OpenAI dédié à la détection et à la suppression des données personnelles, avec un point d'entrée concret pour les flux de traitement de texte.
OpenAI lance Trusted Access for Cyber, un programme auquel se joignent des entreprises et sociétés de sécurité de premier plan。
OpenAI annonce l'extension de son programme Trusted Access for Cyber et l'introduction de GPT-5.4-Cyber pour les défenseurs vérifiés. L'entreprise indique renforcer les garde-fous à mesure que les capacités de cybersécurité de l'IA progressent.
Motif de la recommandation :L'original expose l'extension du programme Trusted Access for Cyber et l'ouverture de GPT-5.4-Cyber aux défenseurs vérifiés, ce qui permet de suivre l'usage de l'IA en cybersécurité.
OpenAI a réagi à l'attaque de la chaîne d'approvisionnement visant Axios en renouvelant les certificats de signature de code macOS et en mettant à jour ses applications。
OpenAI publie un guide sur l'usage responsable et sûr de l'IA, destiné aux utilisateurs d'outils comme ChatGPT. Le document met en avant des bonnes pratiques axées sur la sécurité。
OpenAI publie le Child Safety Blueprint, une feuille de route pour concevoir l'IA de manière responsable avec des garde-fous et une conception adaptée à l'âge. Le document mise sur la collaboration pour protéger et autonomiser les jeunes en ligne.
OpenAI lance l'OpenAI Safety Fellowship, un programme pilote destiné à soutenir la recherche indépendante en sécurité et alignement et à former la prochaine génération de talents. Le programme vise à financer des travaux de recherche indépendants dans ces domaines et à développer les compétences des futurs chercheurs.
OpenAI 的 Model Spec 是一套公开的模型行为框架, 旨在随着 AI 系统演进, 在安全, 用户自由与责任之间取得平衡. 该框架面向公众开放, 用于规范模型行为.