Aller au contenu
  1. Google DeepMind78

    Google DeepMind lance Gemini 3.8 Flash TTS et Flash-Lite TTS

    Google DeepMind annonce Gemini 3.8 Flash TTS et Gemini 3.8 Flash-Lite TTS, deux modèles de synthèse vocale générative disponibles dans Google AI Studio.

    Motif de la recommandation :Google DeepMind détaille les capacités vocales et les garde-fous des deux modèles TTS, utile pour évaluer les usages en doublage et agents vocaux.

  1. Google DeepMind88

    Google DeepMind lance Gemini 3.8 Live et 3.8 Live Extended Thinking

    Google DeepMind lance Gemini 3.8 Live et Gemini 3.8 Live Extended Thinking.

    Motif de la recommandation :Les deux modèles de dialogue en temps réel de Google DeepMind sont présentés avec leurs scores sur plusieurs benchmarks vocaux et agentiques, ce qui permet de situer leurs capacités et leur positionnement prix.

  1. OpenAI News78

    OpenAI lance GPT-5.4 mini et nano

    OpenAI lance GPT-5.4 mini et nano, deux versions plus petites et plus rapides de GPT-5.4。

    Motif de la recommandation :L'original indique les scénarios ciblés par les deux petites versions de GPT-5.4, utile pour évaluer le choix de modèle pour les charges API à haut volume.

  1. OpenAI News78

    OpenAI publie gpt-realtime et met à jour la Realtime API

    OpenAI publie gpt-realtime, un modèle speech-to-speech plus avancé, accompagné de nouvelles capacités de la Realtime API 。

    Motif de la recommandation :OpenAI publie un modèle vocal speech-to-speech plus avancé et étend la Realtime API au support MCP, à l'entrée d'images et à la téléphonie SIP.

  1. OpenAI News90

    OpenAI présente GPT-5

    OpenAI présente GPT-5, son meilleur système d'IA à ce jour. Selon OpenAI, GPT-5 marque un bond important en intelligence par rapport à tous ses modèles précédents。

  1. OpenAI News88

    OpenAI 发布 o3 与 o4-mini

    OpenAI 发布 o3 和 o4-mini, 称其为迄今最智能, 能力最强的模型, 并具备完整的工具调用能力.

  2. OpenAI News82

    OpenAI publie la fiche système d'o3 et o4-mini

    OpenAI publie la fiche système d'o3 et o4-mini. Selon la présentation, ces deux modèles combinent un raisonnement de pointe avec l'ensemble des capacités d'outils 。

    Motif de la recommandation :La fiche système d'o3 et o4-mini expose l'intégration du raisonnement et des outils, un point de repère pour évaluer les capacités des modèles.

  1. OpenAI News80

    OpenAI 在 GPT-4o 中引入原生图像生成

    OpenAI 于 2025 年推出 GPT-4o 的原生图像生成功能, 具备更强的文本渲染和指令遵循能力. 文中还提及可探索 ChatGPT Images 2.5.

  1. OpenAI News90

    OpenAI annonce GPT-4o

    OpenAI annonce GPT-4 Omni, son nouveau modèle phare capable de raisonner en temps réel sur l'audio, la vision et le texte.

    Motif de la recommandation :Présentation du nouveau modèle phare d'OpenAI, capable de raisonner en temps réel sur l'audio, la vision et le texte.

  1. OpenAI News93

    OpenAI annonce de nouveaux modèles et produits pour développeurs au DevDay

    OpenAI annonce au DevDay GPT-4 Turbo avec une fenêtre de contexte de 128K et des prix réduits, la nouvelle Assistants API, GPT-4 Turbo with Vision et l'API DALL·E 3, entre autres.

    Motif de la recommandation :Récapitulatif des nouveautés annoncées au DevDay, utile pour situer les changements de modèles et d'API destinés aux développeurs.

  1. OpenAI News92

    OpenAI publie GPT-4, un grand modèle multimodal

    OpenAI a créé GPT-4, un grand modèle multimodal qui accepte les entrées d'images et de texte et produit des sorties textuelles. OpenAI indique qu'il est moins capable que les humains dans de nombreux scénarios réels, mais qu'il atteint des performances de niveau humain sur divers benchmarks professionnels et académiques.

    Motif de la recommandation :L'annonce présente les entrées multimodales de GPT-4 et ses performances de niveau humain sur plusieurs benchmarks professionnels et académiques.

  2. OpenAI News92

    OpenAI publie GPT-4

    OpenAI publie GPT-4, capable de générer, modifier et itérer avec les utilisateurs sur des tâches d'écriture créative et technique。

  1. OpenAI News85

    OpenAI présente CLIP, un réseau de neurones qui associe texte et images

    OpenAI présente CLIP, un réseau de neurones qui apprend efficacement des concepts visuels à partir d'une supervision en langage naturel. CLIP peut être appliqué à n'importe quel benchmark de classification visuelle en fournissant simplement les noms des catégories à reconnaître, à la manière des capacités zero-shot de GPT-2 et GPT-3.

Fin de la liste