OpenAI 发布 o1 系统卡
OpenAI 发布 o1 系统卡, 说明在发布 o1 和 o1-mini 之前开展的安全工作, 包括外部红队测试以及依据 Preparedness Framework 进行的前沿风险评测.
Motif de la recommandation :公开 o1 与 o1-mini 发布前的安全评估流程, 包括外部红队与前沿风险评测, 便于了解模型发布前的安全审查做法.
OpenAI 发布 o1 系统卡, 说明在发布 o1 和 o1-mini 之前开展的安全工作, 包括外部红队测试以及依据 Preparedness Framework 进行的前沿风险评测.
Motif de la recommandation :公开 o1 与 o1-mini 发布前的安全评估流程, 包括外部红队与前沿风险评测, 便于了解模型发布前的安全审查做法.
OpenAI fait progresser le red teaming en combinant intervention humaine et IA.
Mistral AI publie une API de modération de contenu, la même qui alimente le service de modération de Le Chat。
OpenAI a analysé comment ChatGPT répond aux utilisateurs selon leur nom。
OpenAI a banni des comptes « Stop News » d'origine russe qui utilisaient l'IA pour générer des articles et des publications multilingues ciblant l'Ukraine et l'Occident.
OpenAI封禁了一批疑似属于CyberAv3ngers的账号, 该组织被指与伊朗有关联. 这些账号利用AI研究工业控制系统, 默认凭据及潜在目标.
OpenAI a banni des comptes utilisant l'IA pour rédiger des signalements et plaintes abusifs visant des personnalités publiques et des plateformes vietnamiennes.
OpenAI封禁了一批利用AI生成批评俄罗斯反腐基金会及相关人物评论的账号. 该行动针对的是借助AI批量生产此类评论内容的账户.
OpenAI封禁了名为“A2Z”的账号网络, 这些账号利用AI生成有关选举, 乌克兰和政治的多语言影响力内容, 并跨平台发布.
OpenAI a banni les comptes d'un réseau de spam qui accédaient à ses modèles via une startup israélienne pour générer des conversations et diffuser des liens vers des sites de paris sur X. Le réseau, baptisé « Bet Bot », utilisait les modèles d'OpenAI pour produire des messages automatisés avant de les publier sur la plateforme X.
OpenAI 封禁了与伊朗关联的 STORM-0817 账号, 这些账号利用 AI 调试 Android 恶意软件, 抓取社交平台内容并翻译工具. 该活动涉及滥用 AI 辅助恶意软件开发与信息收集.
OpenAI 封禁了一个很可能源自美国的账号, 该账号利用 AI 伪造 ChatGPT 报错信息, 谎称检测到“俄罗斯水军”活动.
OpenAI封禁了一批源自卢旺达的账号, 这些账号在该国选举前使用AI生成党派性评论. 该网络利用AI批量生产政治评论内容, 属于选举干预行为.
OpenAI a banni des comptes liés à l'opération STORM-2035 d'origine iranienne。
Motif de la recommandation :OpenAI expose les détails de son interdiction de comptes liés à une opération d'influence iranienne, ce qui éclaire les modalités concrètes de la modération des usages abusifs.
OpenAI a banni des comptes appartenant probablement à un adversaire présumé basé en Chine。
Motif de la recommandation :L'original expose les usages malveillants constatés et la réponse d'OpenAI, ce qui éclaire la manière dont les plateformes traitent ce type d'activité.
OpenAI publie une mise à jour sur ses pratiques en matière de sûreté et de sécurité. Le contenu détaillé de cette mise à jour n'est pas précisé dans le texte source.
Zico Kolter rejoint le conseil d'administration d'OpenAI et siègera également au Safety & Security Committee。
OpenAI 发布 GPT-4o 系统卡. 原文正文未能获取, 仅可确认标题与发布来源.
OpenAI a développé et appliqué une nouvelle méthode, les Rule-Based Rewards (RBRs)。
OpenAI présente les Prover-Verifier Games, une méthode qui améliore la lisibilité des sorties des modèles de langage en les rendant plus claires et plus faciles à vérifier pour les humains comme pour les machines. Cette approche vise à renforcer la confiance dans les solutions d'IA en s'appuyant sur un jeu entre un prouveur et un vérificateur.
OpenAI et le Los Alamos National Laboratory ont annoncé un partenariat de recherche visant à développer des évaluations de sûreté pour mesurer les capacités et risques biologiques associés aux modèles de frontière.
OpenAI 发布 CriticGPT, 这是一个基于 GPT-4 的模型, 用于对 ChatGPT 的回答撰写批评意见, 帮助人类训练师在 RLHF 过程中发现错误.
OpenAI met en avant la recherche innovante et l'intégration de l'IA dans la cybersécurité à travers son Cybersecurity Grant Program. Le programme soutient des travaux de recherche destinés à renforcer les défenses face aux menaces numériques.
OpenAI présente une approche holistique pour construire un système de classification en langage naturel robuste et utile destiné à la modération de contenus dans le monde réel. Cette méthode vise à détecter les contenus indésirables en conditions réelles.
OpenAI nomme le général à la retraite de l'armée américaine Paul M. Nakasone à son conseil d'administration。
OpenAI détaille le fonctionnement de Voice Engine, son modèle de synthèse vocale, et les recherches de sécurité associées. Le contenu explore la technologie sous-jacente à ce modèle text-to-speech.
OpenAI a identifié automatiquement 16 millions de motifs dans les calculs de GPT-4 en utilisant de nouvelles techniques de mise à l'échelle des autoencodeurs parcimonieux. Cette méthode permet d'extraire des concepts du modèle.
OpenAI a résilié des comptes liés à des opérations d'influence clandestines。
OpenAI 阐述了其安全实践, 强调通用人工智能有潜力造福生活的几乎所有方面, 因此必须以负责任的方式开发和部署.
OpenAI présente le Model Spec.
OpenAI annonce de nouvelles technologies destinées à aider les chercheurs à identifier les contenus générés par ses outils et rejoint le comité directeur de la Coalition for Content Provenance and Authenticity (C2PA) afin de promouvoir des standards industriels.
OpenAI a banni des comptes liés à l'opération d'origine russe « Doppelganger », qui utilisait l'IA pour générer des commentaires anti-Ukraine sur les réseaux sociaux。
OpenAI a banni des comptes associés à l'opération « Spamouflage » d'origine chinoise。
OpenAI a banni des comptes liés à l'opération d'origine iranienne « IUVM », qui utilisait l'IA pour générer et traduire des contenus pro-iraniens。
OpenAI封禁了一批与代号"Zero Zeno"的以色列来源影响力行动相关的账号, 该行动此前未被报道. 这些账号利用AI生成反哈马斯, 反卡塔尔, 亲以色列, 反BJP以及亲Histadrut的内容.
OpenAI 封禁了一批与代号« Bad Grammar »的俄罗斯来源行动相关的账号, 该行动利用 AI 在 Telegram 上生成英语和俄语评论, 涉及乌克兰, 摩尔多瓦, 波罗的海国家及美国政治话题. 这是此前未被报道过的俄罗斯来源影响力行动.
OpenAI 发布« The Instruction Hierarchy: Training LLMs to Prioritize Privileged Instructions », 指出当前 LLM 容易受到 prompt injection, jailbreak 等攻击, 攻击者可用恶意 prompt 覆盖模型原有指令. 该研究提出通过指令层级训练, 让模型优先执行高权限指令.
OpenAI publie un article intitulé « Disrupting malicious uses of AI by state-affiliated threat actors »。
OpenAI développe un cadre d'évaluation du risque qu'un grand modèle de langage (LLM) aide une personne à créer une menace biologique. Dans une évaluation menée avec des experts en biologie et des étudiants, GPT-4 n'apporte au plus qu'une légère amélioration de la précision en matière de création de menaces biologiques. OpenAI précise que cette amélioration n'est pas assez importante pour être concluante, mais que ce résultat constitue un point de départ pour poursuivre la recherche et la réflexion communautaire.
Motif de la recommandation :OpenAI expose un cadre d'évaluation du risque biologique lié aux LLM et publie les résultats préliminaires sur GPT-4, utiles pour situer les travaux de sécurité.
OpenAI a financé 10 équipes dans le monde pour concevoir des idées et des outils de gouvernance collective de l'IA。