Aller au contenu
13 marsmer.
11 marslun.
6 marsmer.
4 marslun.
  1. OpenAI News50

    Neural MMO : un environnement de jeu massivement multiagent pour l'apprentissage par renforcement

    OpenAI publie Neural MMO, un environnement de jeu massivement multiagent destiné aux agents d'apprentissage par renforcement. La plateforme prend en charge un nombre important et variable d'agents dans une tâche persistante et ouverte, et l'inclusion de nombreux agents et espèces favorise une meilleure exploration, la formation de niches divergentes et une compétence globale accrue.

26 févriermar.
19 févriermar.
  1. OpenAI News32

    OpenAI : la sécurité de l'IA a besoin des sciences sociales

    OpenAI publie un article affirmant que la recherche sur la sécurité à long terme de l'IA a besoin des sciences sociales pour garantir le succès des algorithmes d'alignement lorsque de vrais humains sont impliqués. L'alignement des systèmes d'IA avancés sur les valeurs humaines exige de lever de nombreuses incertitudes liées à la psychologie de la rationalité, aux émotions et aux biais humains. OpenAI prévoit de recruter des chercheurs en sciences sociales pour travailler à plein temps sur ce sujet.

19 décembremer.
14 décembreven.
6 décembrejeu.
  1. OpenAI News33

    OpenAI publie CoinRun pour quantifier la généralisation en apprentissage par renforcement

    OpenAI publie CoinRun, un environnement d'entraînement qui fournit une métrique pour mesurer la capacité d'un agent à transférer son expérience vers des situations nouvelles. CoinRun a déjà contribué à clarifier un puzzle de longue date en apprentissage par renforcement. L'environnement se situe à un niveau de complexité intermédiaire : plus simple que des jeux de plateforme traditionnels comme Sonic the Hedgehog, mais suffisamment exigeant pour constituer un défi de généralisation pour les algorithmes de pointe.

8 novembrejeu.
7 novembremer.
22 octobrelun.
11 octobrejeu.
10 septembrelun.
23 aoûtjeu.
6 aoûtlun.
30 juilletlun.
25 juilletmer.
18 juilletmer.
9 juilletlun.
  1. OpenAI News58

    Glow : de meilleurs modèles génératifs réversibles

    OpenAI présente Glow, un modèle génératif réversible qui utilise des convolutions 1x1 inversibles. Il étend les travaux antérieurs sur les modèles génératifs réversibles et simplifie l'architecture. Le modèle peut générer des images réalistes à haute résolution, prend en charge un échantillonnage efficace et découvre des caractéristiques permettant de manipuler les attributs des données. Le code du modèle et un outil de visualisation en ligne sont publiés.

4 juilletmer.
25 juinlun.
22 juinven.
11 juinlun.
30 maimer.
25 maiven.
  1. OpenAI News62

    OpenAI publie la version complète de Gym Retro

    OpenAI publie la version complète de Gym Retro, une plateforme de recherche en apprentissage par renforcement sur les jeux. Le nombre de jeux publics passe d'environ 70 jeux Atari et 30 jeux Sega à plus de 1000 jeux couvrant plusieurs émulateurs sous-jacents. OpenAI publie également l'outil utilisé pour ajouter de nouveaux jeux à la plateforme.

    Motif de la recommandation :OpenAI ouvre une plateforme d'apprentissage par renforcement sur plus de 1000 jeux et publie l'outil d'ajout de jeux, ce qui permet de mesurer l'évolution de l'échelle des environnements disponibles.

16 maimer.
  1. OpenAI News85

    OpenAI analyse la croissance exponentielle du calcul d'entraînement en IA

    OpenAI publie une analyse montrant que depuis 2012, la quantité de calcul utilisée dans les plus grands entraînements d'IA croît de façon exponentielle avec un temps de doublement de 3.

    Motif de la recommandation :L'analyse quantifie la croissance exponentielle du calcul d'entraînement depuis 2012 et son rythme de doublement, un repère pour situer les capacités des futurs systèmes.

3 maijeu.
5 avriljeu.
15 marsjeu.
7 marsmer.
6 marsmar.
26 févrierlun.
22 févrierjeu.
20 févriermar.
15 févrierjeu.
  1. OpenAI News22

    OpenAI : l'apprentissage automatique interprétable par l'enseignement

    OpenAI a conçu une méthode qui encourage les IA à s'enseigner mutuellement à l'aide d'exemples compréhensibles pour les humains. L'approche sélectionne automatiquement les exemples les plus informatifs pour enseigner un concept, comme les meilleures images pour décrire la notion de chien. Les expériences menées montrent que cette méthode est efficace pour enseigner aussi bien aux IA qu'aux humains.

7 févriermer.
26 octobrejeu.
19 octobrejeu.