Aller au contenu
9mois30jourmercredi
4mois21jourmardi
4mois10jourvendredi
12mois16jourmardi
12mois1jourlundi
4mois24jourjeudi
3mois25jourmardi
  1. OpenAI News80

    OpenAI publie un addendum à la fiche système de GPT-4o sur la génération d'images

    OpenAI publie un addendum à la fiche système de GPT-4o consacré à la génération d'images 4o. Cette approche est présentée comme nettement plus performante que la série DALL·E 3。

    Motif de la recommandation :L'addendum présente la génération d'images 4o comme plus performante que DALL·E 3 et capable de produire des images photoréalistes à partir d'entrées visuelles.

10mois23jourmercredi
6mois20jourjeudi
5mois16jourjeudi
2mois15jourjeudi
  1. OpenAI News91

    Les modèles de génération vidéo comme simulateurs du monde

    OpenAI explore l'entraînement à grande échelle de modèles génératifs sur des données vidéo. L'équipe entraîne conjointement des modèles de diffusion conditionnés par texte sur des vidéos et des images de durées, résolutions et formats variables, en s'appuyant sur une architecture Transformer opérant sur des patchs spatio-temporels de codes latents vidéo et image. Le plus grand modèle, Sora, peut générer une minute de vidéo haute fidélité, et les résultats suggèrent que le passage à l'échelle des modèles de génération vidéo est une voie prometteuse vers des simulateurs généralistes du monde physique.

    Motif de la recommandation :L'article expose l'entraînement conjoint de modèles de diffusion sur vidéos et images et présente Sora capable de générer une minute de vidéo, ce qui éclaire la voie vers des simulateurs du monde physique.

10mois19jourjeudi
10mois3jourmardi
12mois16jourvendredi
11mois3jourjeudi
9mois28jourmercredi
8mois31jourmercredi
7mois20jourmercredi
  1. OpenAI News88

    DALL·E entre en version bêta et ouvre les invitations

    OpenAI annonce que DALL·E est disponible en version bêta et invite progressivement 1 million de personnes de la liste d'attente au cours des prochaines semaines. Les utilisateurs peuvent créer avec des crédits gratuits renouvelés chaque mois, et acheter des crédits supplémentaires par tranches de 115 générations pour 15 dollars.

    Motif de la recommandation :L'original précise le quota d'invitations, le crédit mensuel gratuit et le prix des crédits supplémentaires, ce qui permet de juger du coût d'usage de DALL·E en version bêta.

7mois18jourlundi
7mois14jourjeudi
6mois28jourmardi
5mois18jourmercredi
4mois13jourmercredi
1mois5jourmardi
  1. OpenAI News88

    OpenAI présente DALL·E, un réseau neuronal qui génère des images à partir de texte

    OpenAI annonce avoir entraîné un réseau neuronal nommé DALL·E qui crée des images à partir de légendes textuelles, pour une large gamme de concepts exprimables en langage naturel.

    Motif de la recommandation :Un réseau neuronal nommé DALL·E génère des images à partir de légendes textuelles, ce qui permet de situer le jalon de la génération texte-image.

6mois17jourmercredi
  1. OpenAI News70

    OpenAI 发布 Image GPT :用 Transformer 生成图像

    OpenAI 发现, 正如在大规模语言上训练的 Transformer 模型能够生成连贯文本, 同一模型在像素序列上训练后也能生成连贯的图像补全与样本. 通过建立样本质量与图像分类准确率之间的相关性, OpenAI 表明其最佳生成模型在无监督设置下也包含可与顶级卷积网络媲美的特征.

    Motif de la recommandation :OpenAI 展示同一 Transformer 架构在像素序列上也能生成连贯图像, 并给出生成质量与分类精度的关联.

4mois25jourjeudi
  1. OpenAI News70

    OpenAI présente MuseNet, un réseau neuronal profond capable de générer des compositions musicales

    OpenAI a créé MuseNet, un réseau neuronal profond capable de générer des compositions musicales de 4 minutes avec 10 instruments différents et de combiner des styles allant de la country à Mozart en passant par les Beatles. MuseNet n'a pas été programmé explicitement avec une compréhension musicale, mais a découvert des motifs d'harmonie, de rythme et de style en apprenant à prédire le token suivant dans des centaines de milliers de fichiers MIDI. Il utilise la même technologie non supervisée généraliste que GPT-2, un grand modèle Transformer entraîné à prédire le token suivant dans une séquence, qu'il s'agisse d'audio ou de texte.

    Motif de la recommandation :MuseNet montre comment une architecture Transformer généraliste, celle de GPT-2, peut être réutilisée pour générer de la musique sur des fichiers MIDI.

7mois9jourlundi
  1. OpenAI News58

    Glow : de meilleurs modèles génératifs réversibles

    OpenAI présente Glow, un modèle génératif réversible qui utilise des convolutions 1x1 inversibles. Il étend les travaux antérieurs sur les modèles génératifs réversibles et simplifie l'architecture. Le modèle peut générer des images réalistes à haute résolution, prend en charge un échantillonnage efficace et découvre des caractéristiques permettant de manipuler les attributs des données. Le code du modèle et un outil de visualisation en ligne sont publiés.