OpenAI 封禁利用 AI 伪造 ChatGPT 报错信息的账号
OpenAI 封禁了一个很可能源自美国的账号, 该账号利用 AI 伪造 ChatGPT 报错信息, 谎称检测到“俄罗斯水军”活动.
OpenAI 封禁了一个很可能源自美国的账号, 该账号利用 AI 伪造 ChatGPT 报错信息, 谎称检测到“俄罗斯水军”活动.
OpenAI封禁了一批源自卢旺达的账号, 这些账号在该国选举前使用AI生成党派性评论. 该网络利用AI批量生产政治评论内容, 属于选举干预行为.
OpenAI a banni des comptes liés à l'opération STORM-2035 d'origine iranienne。
Motif de la recommandation :OpenAI expose les détails de son interdiction de comptes liés à une opération d'influence iranienne, ce qui éclaire les modalités concrètes de la modération des usages abusifs.
OpenAI a banni des comptes appartenant probablement à un adversaire présumé basé en Chine。
Motif de la recommandation :L'original expose les usages malveillants constatés et la réponse d'OpenAI, ce qui éclaire la manière dont les plateformes traitent ce type d'activité.
OpenAI publie une mise à jour sur ses pratiques en matière de sûreté et de sécurité. Le contenu détaillé de cette mise à jour n'est pas précisé dans le texte source.
Zico Kolter rejoint le conseil d'administration d'OpenAI et siègera également au Safety & Security Committee。
OpenAI 发布 GPT-4o 系统卡. 原文正文未能获取, 仅可确认标题与发布来源.
OpenAI a développé et appliqué une nouvelle méthode, les Rule-Based Rewards (RBRs)。
OpenAI présente les Prover-Verifier Games, une méthode qui améliore la lisibilité des sorties des modèles de langage en les rendant plus claires et plus faciles à vérifier pour les humains comme pour les machines. Cette approche vise à renforcer la confiance dans les solutions d'IA en s'appuyant sur un jeu entre un prouveur et un vérificateur.
OpenAI et le Los Alamos National Laboratory ont annoncé un partenariat de recherche visant à développer des évaluations de sûreté pour mesurer les capacités et risques biologiques associés aux modèles de frontière.
OpenAI 发布 CriticGPT, 这是一个基于 GPT-4 的模型, 用于对 ChatGPT 的回答撰写批评意见, 帮助人类训练师在 RLHF 过程中发现错误.
OpenAI met en avant la recherche innovante et l'intégration de l'IA dans la cybersécurité à travers son Cybersecurity Grant Program. Le programme soutient des travaux de recherche destinés à renforcer les défenses face aux menaces numériques.
OpenAI présente une approche holistique pour construire un système de classification en langage naturel robuste et utile destiné à la modération de contenus dans le monde réel. Cette méthode vise à détecter les contenus indésirables en conditions réelles.
OpenAI nomme le général à la retraite de l'armée américaine Paul M. Nakasone à son conseil d'administration。
OpenAI détaille le fonctionnement de Voice Engine, son modèle de synthèse vocale, et les recherches de sécurité associées. Le contenu explore la technologie sous-jacente à ce modèle text-to-speech.
OpenAI a identifié automatiquement 16 millions de motifs dans les calculs de GPT-4 en utilisant de nouvelles techniques de mise à l'échelle des autoencodeurs parcimonieux. Cette méthode permet d'extraire des concepts du modèle.
OpenAI a résilié des comptes liés à des opérations d'influence clandestines。
OpenAI 阐述了其安全实践, 强调通用人工智能有潜力造福生活的几乎所有方面, 因此必须以负责任的方式开发和部署.
OpenAI présente le Model Spec.
OpenAI annonce de nouvelles technologies destinées à aider les chercheurs à identifier les contenus générés par ses outils et rejoint le comité directeur de la Coalition for Content Provenance and Authenticity (C2PA) afin de promouvoir des standards industriels.
OpenAI a banni des comptes liés à l'opération d'origine russe « Doppelganger », qui utilisait l'IA pour générer des commentaires anti-Ukraine sur les réseaux sociaux。
OpenAI a banni des comptes associés à l'opération « Spamouflage » d'origine chinoise。
OpenAI a banni des comptes liés à l'opération d'origine iranienne « IUVM », qui utilisait l'IA pour générer et traduire des contenus pro-iraniens。
OpenAI封禁了一批与代号"Zero Zeno"的以色列来源影响力行动相关的账号, 该行动此前未被报道. 这些账号利用AI生成反哈马斯, 反卡塔尔, 亲以色列, 反BJP以及亲Histadrut的内容.
OpenAI 封禁了一批与代号« Bad Grammar »的俄罗斯来源行动相关的账号, 该行动利用 AI 在 Telegram 上生成英语和俄语评论, 涉及乌克兰, 摩尔多瓦, 波罗的海国家及美国政治话题. 这是此前未被报道过的俄罗斯来源影响力行动.
OpenAI 发布« The Instruction Hierarchy: Training LLMs to Prioritize Privileged Instructions », 指出当前 LLM 容易受到 prompt injection, jailbreak 等攻击, 攻击者可用恶意 prompt 覆盖模型原有指令. 该研究提出通过指令层级训练, 让模型优先执行高权限指令.
OpenAI publie un article intitulé « Disrupting malicious uses of AI by state-affiliated threat actors »。
OpenAI développe un cadre d'évaluation du risque qu'un grand modèle de langage (LLM) aide une personne à créer une menace biologique. Dans une évaluation menée avec des experts en biologie et des étudiants, GPT-4 n'apporte au plus qu'une légère amélioration de la précision en matière de création de menaces biologiques. OpenAI précise que cette amélioration n'est pas assez importante pour être concluante, mais que ce résultat constitue un point de départ pour poursuivre la recherche et la réflexion communautaire.
Motif de la recommandation :OpenAI expose un cadre d'évaluation du risque biologique lié aux LLM et publie les résultats préliminaires sur GPT-4, utiles pour situer les travaux de sécurité.
OpenAI a financé 10 équipes dans le monde pour concevoir des idées et des outils de gouvernance collective de l'IA。
OpenAI annonce le lancement de Superalignment Fast Grants。
OpenAI提出一个面向超级对齐的新研究方向, 并给出初步结果 :能否利用深度学习的泛化特性, 用较弱的监督者去控制更强的模型. 该方向将弱到强泛化作为实现超级对齐的潜在路径.
Motif de la recommandation :OpenAI提出弱监督强模型的对齐研究方向, 并给出初步结果, 可供关注超级对齐路径的读者了解其问题设定.
OpenAI développe son approche de préparation aux risques catastrophiques liés aux systèmes d'IA hautement capables。
OpenAI, Anthropic, Google et Microsoft annoncent ensemble un nouveau directeur exécutif pour le Frontier Model Forum ainsi qu'un nouveau fonds de 10 M$ dédié à la sécurité de l'IA.
OpenAI publie la fiche système de DALL·E 3.
Hugging Face a porté ses positions sur l'éthique de l'IA auprès des législateurs de l'UE。
OpenAI publie la fiche système de GPT-4V(ision).
OpenAI annonce un appel ouvert pour rejoindre son Red Teaming Network, invitant les experts de domaine intéressés par l'amélioration de la sécurité de ses modèles à participer.
OpenAI utilise GPT-4 pour l'élaboration des politiques de contenu et les décisions de modération。
Motif de la recommandation :L'article explique comment GPT-4 est utilisé pour l'élaboration des politiques de contenu et les décisions de modération, avec des bénéfices concrets sur la cohérence et la rapidité.
Zama démontre qu'il est possible d'exécuter une partie de l'inférence d'un LLM sur des données chiffrées grâce au chiffrement homomorphe complet (FHE)。
OpenAI annonce la création d'une nouvelle instance sectorielle, le Frontier Model Forum。
Motif de la recommandation :L'original expose la création d'une instance sectorielle et ses missions, ce qui permet de situer les orientations de gouvernance de l'IA de pointe.