Aller au contenu
7mois22jourlundi
  1. OpenAI News85

    Microsoft investit 1 milliard de dollars dans OpenAI et devient son fournisseur cloud exclusif

    Microsoft investit 1 milliard de dollars dans OpenAI pour soutenir la construction d'une intelligence artificielle générale (AGI) aux bénéfices économiques largement distribués. Les deux entreprises s'associent pour développer sur Microsoft Azure une plateforme matérielle et logicielle évolutive vers l'AGI, et développeront conjointement de nouvelles technologies de supercalcul Azure AI. Microsoft devient le fournisseur cloud exclusif d'OpenAI.

7mois10jourmercredi
6mois5jourmercredi
5mois23jourjeudi
5mois17jourvendredi
4mois25jourjeudi
  1. OpenAI News70

    OpenAI présente MuseNet, un réseau neuronal profond capable de générer des compositions musicales

    OpenAI a créé MuseNet, un réseau neuronal profond capable de générer des compositions musicales de 4 minutes avec 10 instruments différents et de combiner des styles allant de la country à Mozart en passant par les Beatles. MuseNet n'a pas été programmé explicitement avec une compréhension musicale, mais a découvert des motifs d'harmonie, de rythme et de style en apprenant à prédire le token suivant dans des centaines de milliers de fichiers MIDI. Il utilise la même technologie non supervisée généraliste que GPT-2, un grand modèle Transformer entraîné à prédire le token suivant dans une séquence, qu'il s'agisse d'audio ou de texte.

    Motif de la recommandation :MuseNet montre comment une architecture Transformer généraliste, celle de GPT-2, peut être réutilisée pour générer de la musique sur des fichiers MIDI.

4mois23jourmardi
4mois15jourlundi
3mois21jourjeudi
  1. OpenAI News22

    OpenAI 提出基于能量的模型隐式生成与泛化方法

    OpenAI 在基于能量的模型 (EBM)的稳定, 可扩展训练上取得进展, 其样本质量和泛化能力优于现有模型. EBM 的生成过程会消耗更多算力持续精炼答案, 在低温下可生成与 GAN 媲美的样本, 同时具备基于似然模型的模式覆盖保证. OpenAI 希望这些发现能推动对这一类模型的研究.

3mois13jourmercredi
3mois11jourlundi
3mois6jourmercredi
3mois4jourlundi
  1. OpenAI News50

    Neural MMO : un environnement de jeu massivement multi-agents pour l'apprentissage par renforcement

    OpenAI publie Neural MMO, un environnement de jeu massivement multi-agents destiné aux agents d'apprentissage par renforcement. La plateforme prend en charge un nombre important et variable d'agents dans une tâche persistante et ouverte. La présence de nombreux agents et espèces favorise une meilleure exploration, la formation de niches divergentes et une compétence globale accrue.

2mois26jourmardi
2mois19jourmardi
  1. OpenAI News32

    La sécurité de l'IA a besoin des spécialistes des sciences sociales

    OpenAI publie un article affirmant que la recherche sur la sécurité à long terme de l'IA nécessite la collaboration de spécialistes des sciences sociales pour garantir le succès des algorithmes d'alignement lorsque de véritables humains sont impliqués. L'alignement des systèmes d'IA avancés sur les valeurs humaines exige de lever de nombreuses incertitudes liées à la psychologie de la rationalité, des émotions et des biais humains. OpenAI prévoit de recruter des spécialistes des sciences sociales pour travailler à plein temps sur ce sujet et entend stimuler la collaboration entre chercheurs en machine learning et en sciences sociales.

2mois14jourjeudi
12mois19jourmercredi
12mois14jourvendredi
12mois6jourjeudi
  1. OpenAI News33

    OpenAI publie CoinRun pour quantifier la généralisation en apprentissage par renforcement

    OpenAI publie CoinRun, un environnement d'entraînement qui fournit une métrique pour la capacité d'un agent à transférer son expérience vers des situations nouvelles. CoinRun a déjà aidé à clarifier un puzzle de longue date en apprentissage par renforcement. L'environnement se situe à un niveau de complexité intermédiaire : plus simple que les jeux de plateforme traditionnels comme Sonic the Hedgehog, mais il reste un défi de généralisation sérieux pour les algorithmes de pointe.

11mois8jourjeudi
11mois7jourmercredi
10mois31jourmercredi
10mois22jourlundi
10mois11jourjeudi
10mois9jourmardi
9mois10jourlundi
8mois23jourjeudi
8mois6jourlundi
7mois30jourlundi
7mois25jourmercredi
7mois18jourmercredi
7mois9jourlundi
  1. OpenAI News58

    Glow : de meilleurs modèles génératifs réversibles

    OpenAI présente Glow, un modèle génératif réversible qui utilise des convolutions 1x1 inversibles. Il étend les travaux antérieurs sur les modèles génératifs réversibles et simplifie l'architecture. Le modèle peut générer des images réalistes à haute résolution, prend en charge un échantillonnage efficace et découvre des caractéristiques permettant de manipuler les attributs des données. Le code du modèle et un outil de visualisation en ligne sont publiés.

7mois4jourmercredi
  1. OpenAI News78

    OpenAI apprend Montezuma's Revenge à un agent à partir d'une seule démonstration

    OpenAI a entraîné un agent à atteindre un score élevé de 74 500 sur Montezuma's Revenge à partir d'une seule démonstration humaine。

    Motif de la recommandation :L'article explique comment un agent atteint 74 500 points sur Montezuma's Revenge à partir d'une seule démonstration, avec un algorithme simple fondé sur PPO.

6mois25jourlundi
6mois22jourvendredi
6mois11jourlundi
5mois30jourmercredi
5mois25jourvendredi
  1. OpenAI News62

    OpenAI publie la version complète de Gym Retro

    OpenAI publie la version complète de Gym Retro, une plateforme de recherche en apprentissage par renforcement sur les jeux. Le nombre de jeux publics passe d'environ 70 jeux Atari et 30 jeux Sega à plus de 1000 jeux couvrant plusieurs émulateurs sous-jacents. OpenAI publie également l'outil utilisé pour ajouter de nouveaux jeux à la plateforme.

    Motif de la recommandation :OpenAI ouvre une plateforme d'apprentissage par renforcement sur plus de 1000 jeux et publie l'outil d'ajout de jeux, ce qui permet de mesurer l'évolution de l'échelle des environnements disponibles.

5mois16jourmercredi
  1. OpenAI News85

    OpenAI analyse la croissance exponentielle du calcul d'entraînement en IA

    OpenAI publie une analyse montrant que depuis 2012, la quantité de calcul utilisée dans les plus grands entraînements d'IA croît de façon exponentielle avec un temps de doublement de 3。

    Motif de la recommandation :L'analyse quantifie la croissance exponentielle du calcul d'entraînement depuis 2012 et son rythme de doublement, un repère pour situer les capacités des futurs systèmes.

5mois3jourjeudi