Aller au contenu
30 maimer.
25 maiven.
  1. OpenAI News62

    OpenAI publie la version complète de Gym Retro

    OpenAI publie la version complète de Gym Retro, une plateforme de recherche en apprentissage par renforcement sur les jeux. Le nombre de jeux publics passe d'environ 70 jeux Atari et 30 jeux Sega à plus de 1000 jeux couvrant plusieurs émulateurs sous-jacents. OpenAI publie également l'outil utilisé pour ajouter de nouveaux jeux à la plateforme.

    Motif de la recommandation :OpenAI ouvre une plateforme d'apprentissage par renforcement sur plus de 1000 jeux et publie l'outil d'ajout de jeux, ce qui permet de mesurer l'évolution de l'échelle des environnements disponibles.

16 maimer.
  1. OpenAI News85

    OpenAI analyse la croissance exponentielle du calcul d'entraînement en IA

    OpenAI publie une analyse montrant que depuis 2012, la quantité de calcul utilisée dans les plus grands entraînements d'IA croît de façon exponentielle avec un temps de doublement de 3.

    Motif de la recommandation :L'analyse quantifie la croissance exponentielle du calcul d'entraînement depuis 2012 et son rythme de doublement, un repère pour situer les capacités des futurs systèmes.

3 maijeu.
5 avriljeu.
15 marsjeu.
7 marsmer.
6 marsmar.
26 févrierlun.
22 févrierjeu.
20 févriermar.
15 févrierjeu.
  1. OpenAI News22

    OpenAI : l'apprentissage automatique interprétable par l'enseignement

    OpenAI a conçu une méthode qui encourage les IA à s'enseigner mutuellement à l'aide d'exemples compréhensibles pour les humains. L'approche sélectionne automatiquement les exemples les plus informatifs pour enseigner un concept, comme les meilleures images pour décrire la notion de chien. Les expériences menées montrent que cette méthode est efficace pour enseigner aussi bien aux IA qu'aux humains.

7 févriermer.
26 octobrejeu.
19 octobrejeu.
11 octobremer.
14 septembrejeu.
18 aoûtven.
11 aoûtven.
  1. OpenAI News88

    OpenAI crée un bot qui bat les meilleurs joueurs professionnels de Dota 2 en 1v1

    OpenAI a créé un bot qui bat les meilleurs joueurs professionnels du monde lors de matchs 1v1 de Dota 2 selon les règles standard des tournois. Le bot a appris le jeu à partir de zéro par auto-apprentissage, sans utiliser d'apprentissage par imitation ni de recherche arborescente. OpenAI présente cette avancée comme une étape vers la construction de systèmes d'IA capables d'accomplir des objectifs bien définis dans des situations complexes et désordonnées impliquant de vrais humains.

    Motif de la recommandation :L'article explique comment un bot a appris Dota 2 par auto-apprentissage et a battu des joueurs professionnels, ce qui permet de comprendre les capacités et les limites de l'apprentissage autonome dans des environnements complexes.

3 aoûtjeu.
  1. OpenAI News52

    OpenAI publie RL-Teacher, une implémentation open source pour entraîner les IA via des retours humains

    OpenAI a publié RL-Teacher, une implémentation open source de son interface permettant d'entraîner des IA via des retours humains occasionnels plutôt que des fonctions de récompense écrites à la main. La technique sous-jacente a été développée comme une étape vers des systèmes d'IA sûrs, et s'applique aussi aux problèmes d'apprentissage par renforcement dont les récompenses sont difficiles à spécifier.

27 juilletjeu.
28 juinmer.
8 juinjeu.
24 maimer.
  1. OpenAI News62

    OpenAI Baselines : DQN

    OpenAI annonce l'open source d'OpenAI Baselines, son effort interne pour reproduire des algorithmes d'apprentissage par renforcement avec des performances comparables aux résultats publiés. Les algorithmes seront publiés au cours des prochains mois ; la version du jour inclut DQN et trois de ses variantes.

    Motif de la recommandation :OpenAI ouvre le code de ses implémentations d'algorithmes d'apprentissage par renforcement, avec des performances alignées sur les résultats publiés.

16 maimar.
15 mailun.
1 avrilsam.
24 marsven.
20 marslun.
21 décembremer.
5 décembrelun.
15 novembremar.
29 aoûtlun.
18 aoûtjeu.
20 juinlun.
25 maimer.
27 avrilmer.
  1. OpenAI News70

    OpenAI Gym entre en bêta publique

    OpenAI publie la bêta publique d'OpenAI Gym, une boîte à outils pour développer et comparer des algorithmes d'apprentissage par renforcement. Elle comprend une suite croissante d'environnements, allant de robots simulés à des jeux Atari, ainsi qu'un site pour comparer et reproduire les résultats.

    Motif de la recommandation :OpenAI Gym passe en bêta publique avec une suite d'environnements et un site de comparaison, ce qui donne un point de départ concret pour l'apprentissage par renforcement.

26 avrilmar.
11 décembreven.
  1. OpenAI News39

    OpenAI : présentation de la société de recherche en intelligence artificielle à but non lucratif

    OpenAI se présente comme une société de recherche en intelligence artificielle à but non lucratif dont l'objectif est de faire progresser l'intelligence numérique de la manière la plus susceptible de bénéficier à l'humanité tout entière, sans être contrainte par la nécessité de générer un retour financier. Parce que ses recherches sont libres de toute obligation financière, l'organisation peut se concentrer davantage sur un impact humain positif.