Motif de la recommandation :L'article détaille quatre cadres multi-agents pour la génération vidéo longue, avec les problèmes de dérive visuelle et de propagation d'erreurs qu'ils traitent.
Motif de la recommandation :L'original détaille les capacités visuelles temps réel, l'exécution asynchrone d'outils et la prise en charge de 97 langues, ce qui aide à évaluer l'usage en entreprise.
Massimo Banzi et Andrea Richetta montreront comment construire une sonnette intelligente basée sur un modèle de vision par ordinateur exécuté localement sur la carte Arduino UNO Q.
Higgsfield permet aux créateurs de produire des vidéos sociales au rendu cinématographique à partir d'entrées simples, en s'appuyant sur OpenAI GPT-4.1, GPT-5 et Sora 2.
Motif de la recommandation :L'accord couvre plus de 200 personnages Disney et l'adoption de ChatGPT Enterprise, ce qui éclaire l'usage de l'IA générative dans le divertissement.
OpenAI annonce Sora 2, un modèle de génération vidéo capable de produire des dialogues et des effets sonores synchronisés. Le produit Sora n'est plus disponible.
Motif de la recommandation :L'original présente les capacités de génération vidéo et audio de Sora 2, permettant de situer les changements par rapport à la version précédente.
Motif de la recommandation :L'article expose les mesures de sécurité de Sora 2 et de l'application Sora, permettant de comprendre comment OpenAI encadre un modèle vidéo et une plateforme sociale de création.
Invideo AI s'appuie sur GPT-4.1, gpt-image-1 et les modèles de synthèse vocale d'OpenAI pour transformer des idées créatives en vidéos professionnelles en quelques minutes。
OpenAI annonce que son modèle de génération vidéo Sora est désormais utilisable sur sora.com. Les utilisateurs peuvent générer des vidéos jusqu'à 1080p。
Motif de la recommandation :Sora est accessible via sora.com avec des vidéos jusqu'à 1080p et 20 secondes, ce qui permet de mesurer les capacités réelles du modèle.
Le cinéaste Lyndon Barrois utilise Sora d'OpenAI comme outil de narration pour créer de nouveaux mondes. Il décrit comment ce modèle de génération vidéo lui permet de donner vie à ses récits.
OpenAI explore l'entraînement à grande échelle de modèles génératifs sur des données vidéo. L'équipe entraîne conjointement des modèles de diffusion conditionnés par texte sur des vidéos et des images de durées, résolutions et formats variables, en s'appuyant sur une architecture Transformer opérant sur des patchs spatio-temporels de codes latents vidéo et image. Le plus grand modèle, Sora, peut générer une minute de vidéo haute fidélité, et les résultats suggèrent que le passage à l'échelle des modèles de génération vidéo est une voie prometteuse vers des simulateurs généralistes du monde physique.
Motif de la recommandation :L'article expose l'entraînement conjoint de modèles de diffusion sur vidéos et images et présente Sora capable de générer une minute de vidéo, ce qui éclaire la voie vers des simulateurs du monde physique.
OpenAI présente le fine-tuning de GPT-3 appliqué à la création vidéo clé en main. Le modèle ajusté alimente et permet de passer à l'échelle une production vidéo automatisée.