OpenAI modélise la transition des emplois face à l'IA
OpenAI présente un cadre d'analyse couvrant 921 métiers et 148 millions d'emplois aux États-Unis pour identifier ceux exposés au risque d'automatisation。
OpenAI présente un cadre d'analyse couvrant 921 métiers et 148 millions d'emplois aux États-Unis pour identifier ceux exposés au risque d'automatisation。
OpenAI publie Privacy Filter, un modèle à poids ouverts destiné à détecter et masquer les informations personnelles identifiables (PII) dans du texte, avec une précision annoncée comme état de l'art.
Motif de la recommandation :Un modèle à poids ouverts d'OpenAI dédié à la détection et à la suppression des données personnelles, avec un point d'entrée concret pour les flux de traitement de texte.
OpenAI présente GPT-Rosalind, un modèle de raisonnement de pointe conçu pour accélérer la découverte de médicaments。
Motif de la recommandation :Un nouveau modèle de raisonnement d'OpenAI orienté sciences de la vie, dont les capacités annoncées couvrent la découverte de médicaments et l'analyse génomique.
ChatGPT permet d'explorer des jeux de données, de générer des insights, de créer des visualisations et de transformer les résultats en décisions exploitables.
Près de 3 millions de messages par jour sont envoyés à ChatGPT pour poser des questions sur la rémunération et les revenus。
Berkeley AI Research présente SPEX et ProxySPEX, des algorithmes d'attribution capables d'identifier les interactions influentes dans les LLM à une échelle bien supérieure aux méthodes antérieures. SPEX exploite la parcimonie et le faible degré des interactions pour reformuler la recherche exhaustive en un problème de recouvrement parcimonieux résolu via des outils de traitement du signal et de théorie du codage. ProxySPEX tire parti de la propriété de hiérarchie des modèles et atteint les performances de SPEX avec environ 10x moins d'ablations. Sur une tâche d'analyse de sentiment, SPEX conserve une fidélité élevée lorsque le contexte atteint des milliers de features, là où LIME et Banzhaf affichent une fidélité nettement inférieure.
OpenAI 发布 IH-Challenge, 用于训练模型优先执行可信指令, 从而改善指令层级, 安全可控性以及对提示注入攻击的抵抗能力.
Motif de la recommandation :OpenAI 公开 IH-Challenge 训练思路, 说明如何让模型优先执行可信指令并提升抗提示注入能力.
OpenAI lance la Learning Outcomes Measurement Suite。
OpenAI 发布预印本, 展示 GPT-5.2 为胶子振幅提出一个新公式, 随后由 OpenAI 与学术合作者正式证明并验证.
OpenAI publie GABRIEL, une nouvelle boîte à outils open source qui s'appuie sur GPT pour transformer des textes et des images qualitatifs en données quantitatives. Elle vise à aider les chercheurs en sciences sociales à analyser leurs corpus à grande échelle.
Un laboratoire autonome combinant GPT-5 d'OpenAI avec l'automatisation cloud de Ginkgo Bioworks a réduit de 40 % le coût de la synthèse de protéines sans cellules grâce à une expérimentation en boucle fermée.
Motif de la recommandation :Un laboratoire autonome combinant GPT-5 et l'automatisation cloud de Ginkgo Bioworks réduit de 40 % le coût de la synthèse de protéines sans cellules.
OpenAI 构建了一个内部 AI 数据 agent, 结合 GPT-5, Codex 和记忆能力对海量数据集进行推理, 并在数分钟内输出可靠洞察. 该 agent 面向内部数据场景, 核心机制是模型推理与记忆协同, 而非单次查询. 其价值在于把原本耗时的数据分析压缩到分钟级, 为内部数据工作流提供可复用的自动化路径.
OpenAI publie un rapport sur l'usage de ChatGPT par les travailleurs de divers secteurs。
OpenAI publie un nouveau rapport qui révèle de fortes disparités entre les pays dans l'adoption de l'IA avancée et présente de nouvelles initiatives destinées à aider les nations à tirer des gains de productivité de l'IA. Le rapport met en évidence un décalage entre les capacités disponibles des modèles et leur utilisation effective selon les pays.
OpenAI et la Gates Foundation lancent Horizon 1000。
Berkeley AI Research propose un cadre qui évalue et optimise directement les systèmes d'imagerie selon leur contenu informationnel.
OpenAI发布FrontierScience, 一个测试AI在物理, 化学和生物学领域推理能力的基准, 用于衡量AI在真实科学研究方面的进展.
OpenAI présente un cadre d'évaluation en conditions réelles pour mesurer comment l'IA peut accélérer la recherche biologique en laboratoire humide. GPT-5 a été utilisé pour optimiser un protocole de clonage moléculaire, explorant à la fois les promesses et les risques de l'expérimentation assistée par IA.
OpenAI annonce l'acquisition de Neptune afin de mieux observer le comportement des modèles et de renforcer les outils utilisés par les chercheurs pour suivre les expériences et surveiller l'entraînement.
Motif de la recommandation :L'acquisition vise à renforcer le suivi des expériences et la surveillance de l'entraînement, un point d'observation de l'outillage des laboratoires de modèles.
OpenAI présente les premiers cas de recherche montrant comment GPT-5 accélère les progrès scientifiques en mathématiques。
OpenAI présente IndQA, un nouveau benchmark destiné à évaluer les systèmes d'IA dans les langues indiennes. Conçu avec des experts du domaine。
OpenAI publie gpt-oss-safeguard-120b et gpt-oss-safeguard-20b。
Motif de la recommandation :Deux modèles ouverts de raisonnement dédiés au marquage de contenu selon une politique fournie, avec évaluations de sécurité comparées aux gpt-oss de base.
Apollo Research et OpenAI ont développé des évaluations pour la mauvaise alignement cachée。
Motif de la recommandation :OpenAI et Apollo Research présentent des évaluations du comportement de dissimulation et une méthode précoce pour le réduire, ce qui éclaire les risques d'alignement des modèles de pointe.
OpenAI et Retro Bio ont utilisé un modèle d'IA spécialisé, GPT-4b micro, pour concevoir des protéines plus efficaces destinées à la thérapie par cellules souches et à la recherche sur la longévité.
OpenAI a étudié les risques de frontière en pire cas liés à la publication de gpt-oss via une méthode de fine-tuning malveillant (MFT)。
OpenAI publie une analyse économique sur l'impact de ChatGPT et lance une nouvelle collaboration de recherche consacrée aux effets plus larges de l'IA sur le marché du travail et la productivité. L'analyse fournit des éclairages sur les retombées économiques de ChatGPT. La collaboration de recherche vise à étudier les effets de l'IA sur le marché du travail et la productivité.
OpenAI研究发现, 在错误回答上训练语言模型会导致更广泛的misalignment行为, 并识别出一个驱动该行为的内部特征, 通过极少量fine-tuning即可将其逆转. 该研究聚焦于错误训练数据引发misalignment泛化的机制, 为理解和预防此类问题提供了可操作的干预方向.
OpenAI发布HealthBench, 一个面向医疗领域AI模型的评估基准, 用于在贴近真实的场景中评测模型表现. 该基准在250余名医生的参与下构建, 目标是提供模型在健康领域性能与安全性的统一标准.
OpenAI 发布 MLE-bench, 一个用于衡量 AI agent 在机器学习工程任务中表现的基准. 该基准的评估对象是 AI agent 的机器学习工程能力, 而非单纯的模型推理或编码能力.
OpenAI 在其 API 平台上线模型蒸馏功能, 开发者可用大型前沿模型的输出微调出高性价比的小模型. 该功能面向 API 用户, 旨在以更低成本获得接近前沿模型的性能表现.
OpenAI présente des techniques d'entraînement améliorées pour les Consistency Models。
OpenAI a identifié automatiquement 16 millions de motifs dans les calculs de GPT-4 en utilisant de nouvelles techniques de mise à l'échelle des autoencodeurs parcimonieux. Cette méthode permet d'extraire des concepts du modèle.
ChatGPT enrichit son analyse de données : il est désormais possible d'interagir directement avec les tableaux et les graphiques。
OpenAI 在 ChatGPT 发布一年多后阐述了其数据与 AI 方法, 并推出面向创作者和内容所有者的新工具 Media Manager. 该工具旨在回应 AI 时代关于数据使用的讨论, 同时 OpenAI 也说明了其后续发展方向.
OpenAI ajoute de nouvelles fonctionnalités à son API de fine-tuning pour donner aux développeurs davantage de contrôle。
OpenAI annonce de nouveaux modèles d'embedding et des mises à jour d'API.
Digital Green utilise OpenAI pour accroître les revenus des agriculteurs. L'organisation s'appuie sur l'IA d'OpenAI pour bâtir une base de données agricole destinée aux agriculteurs.
OpenAI annonce des Data Partnerships visant à créer des datasets open source et privés pour l'entraînement de l'IA. L'initiative repose sur une collaboration avec des partenaires pour constituer ces jeux de données destinés à l'entraînement des modèles.
OpenAI s'associe à Scale pour permettre aux entreprises de fine-tuner ses modèles les plus avancés, les clients d'OpenAI pouvant s'appuyer sur l'expertise IA de Scale pour personnaliser ces modèles.
Viable exploite GPT-4 pour analyser des données qualitatives à une échelle révolutionnaire avec une précision inégalée. L'outil s'appuie sur le modèle d'OpenAI pour traiter de grands volumes de données qualitatives.