Aller au contenu
2mois24jourvendredi
2mois16jourjeudi
1mois31jourmardi
1mois24jourmardi
1mois11jourmercredi
  1. OpenAI News38

    OpenAI与乔治城大学等合作研究语言模型被用于虚假信息活动的潜在风险及缓解框架

    OpenAI研究人员与乔治城大学安全与新兴技术中心及斯坦福互联网观察站合作, 研究了大型语言模型可能被滥用于虚假信息活动的风险. 该合作包括2021年10月汇集30名虚假信息研究者, 机器学习专家和政策分析师的工作坊, 并最终形成一份基于一年多研究的联合报告. 报告概述了语言模型若被用于增强虚假信息活动对信息环境构成的威胁, 并提出了分析潜在缓解措施的框架.

12mois15jourjeudi
10mois24jourlundi
9mois22jourjeudi
8mois31jourmercredi
8mois24jourmercredi
7mois18jourlundi
6mois28jourmardi
6mois13jourlundi
  1. OpenAI News62

    OpenAI entraîne des modèles de rédaction de critiques pour aider les humains à repérer les défauts des résumés

    OpenAI indique avoir entraîné des modèles de rédaction de critiques chargés de décrire les défauts dans les résumés. Les évaluateurs humains repèrent beaucoup plus souvent ces défauts lorsqu'on leur montre les critiques du modèle. Les modèles plus grands sont meilleurs pour s'autocritiquer, et l'augmentation d'échelle améliore davantage la rédaction de critiques que la rédaction de résumés. Cela ouvre une piste pour que des systèmes d'IA assistent la supervision humaine d'autres systèmes d'IA sur des tâches difficiles.

    Motif de la recommandation :Un modèle de rédaction de critiques aide les évaluateurs humains à repérer davantage de défauts dans les résumés, et l'échelle améliore davantage la critique que la rédaction.

5mois19jourjeudi
5mois17jourmardi
5mois13jourvendredi
4mois13jourmercredi
3mois23jourmercredi
3mois3jourjeudi
1mois27jourjeudi
9mois8jourmercredi
6mois10jourjeudi
4mois16jourjeudi
11mois21jourjeudi
11mois5jourmardi
9mois19jourjeudi
  1. OpenAI News62

    OpenAI ajuste GPT-2 774M par les préférences humaines

    OpenAI a ajusté le modèle de langage GPT-2 de 774M paramètres à l'aide de retours humains pour diverses tâches。

    Motif de la recommandation :L'original expose les préférences humaines et le nombre d'annotations nécessaires pour différentes tâches, ce qui permet de comprendre le coût et les limites du fine-tuning par retour humain.

8mois22jourjeudi
8mois20jourmardi
  1. OpenAI News83

    OpenAI publie GPT-2 774M et un accord juridique open source

    OpenAI publie le modèle de langage GPT-2 de 774 millions de paramètres, après la sortie du petit modèle 124M en février et la publication échelonnée du modèle moyen 355M en mai。

    Motif de la recommandation :L'article retrace le calendrier de publication par étapes de GPT-2 et expose un accord juridique open source pour les partenariats de partage de modèles.

7mois10jourmercredi
2mois19jourmardi
  1. OpenAI News32

    La sécurité de l'IA a besoin des spécialistes des sciences sociales

    OpenAI publie un article affirmant que la recherche sur la sécurité à long terme de l'IA nécessite la collaboration de spécialistes des sciences sociales pour garantir le succès des algorithmes d'alignement lorsque de véritables humains sont impliqués. L'alignement des systèmes d'IA avancés sur les valeurs humaines exige de lever de nombreuses incertitudes liées à la psychologie de la rationalité, des émotions et des biais humains. OpenAI prévoit de recruter des spécialistes des sciences sociales pour travailler à plein temps sur ce sujet et entend stimuler la collaboration entre chercheurs en machine learning et en sciences sociales.

10mois22jourlundi
5mois3jourjeudi
2mois20jourmardi
8mois3jourjeudi
  1. OpenAI News52

    OpenAI publie RL-Teacher, une implémentation open source pour entraîner les IA via des retours humains

    OpenAI a publié RL-Teacher, une implémentation open source de son interface permettant d'entraîner des IA via des retours humains occasionnels plutôt que des fonctions de récompense écrites à la main. La technique sous-jacente a été développée comme une étape vers des systèmes d'IA sûrs, et s'applique aussi aux problèmes d'apprentissage par renforcement dont les récompenses sont difficiles à spécifier.

7mois17jourlundi
6mois13jourmardi
  1. OpenAI News0

    OpenAI与DeepMind合作开发从人类偏好中学习的算法

    OpenAI与DeepMind安全团队合作开发出一种算法, 通过让人类在两种候选行为中指出哪个更好, 来推断人类的目标, 从而避免手工编写目标函数. 该方法旨在消除人工编写目标函数的需求, 因为用简单代理替代复杂目标或目标设定稍有偏差, 都可能导致不良甚至危险的行为. 这是构建安全AI系统方向上的一步.

2mois24jourvendredi
12mois21jourmercredi
6mois21jourmardi
6mois20jourlundi