Aller au contenu
  1. Microsoft Research62

    Microsoft Research présente Quine, un système de recherche IA pour la biologie

    Microsoft Research présente Quine, un effort de recherche combinant un modèle mondial multimodal de biologie et un harnais interactif reliant modèles.

    Motif de la recommandation :Microsoft Research présente Quine, un modèle mondial multimodal de biologie couplé à un harnais, avec une validation en laboratoire humide sur le cancer du pancréas.

  1. Google DeepMind74

    Google DeepMind lance Gemini 3.8 Live avec Live Avatar

    Google DeepMind lance Gemini 3.8 Live with Live Avatar.

    Motif de la recommandation :L'original détaille les capacités visuelles temps réel, l'exécution asynchrone d'outils et la prise en charge de 97 langues, ce qui aide à évaluer l'usage en entreprise.

  1. Google DeepMind78

    Google DeepMind lance Gemini 3.8 Flash TTS et Flash-Lite TTS

    Google DeepMind annonce Gemini 3.8 Flash TTS et Gemini 3.8 Flash-Lite TTS, deux modèles de synthèse vocale générative disponibles dans Google AI Studio.

    Motif de la recommandation :Google DeepMind détaille les capacités vocales et les garde-fous des deux modèles TTS, utile pour évaluer les usages en doublage et agents vocaux.

  1. Google DeepMind88

    Google DeepMind lance Gemini 3.8 Live et 3.8 Live Extended Thinking

    Google DeepMind lance Gemini 3.8 Live et Gemini 3.8 Live Extended Thinking.

    Motif de la recommandation :Les deux modèles de dialogue en temps réel de Google DeepMind sont présentés avec leurs scores sur plusieurs benchmarks vocaux et agentiques, ce qui permet de situer leurs capacités et leur positionnement prix.

  1. OpenAI News78

    OpenAI lance GPT-5.4 mini et nano

    OpenAI lance GPT-5.4 mini et nano, deux versions plus petites et plus rapides de GPT-5.4。

    Motif de la recommandation :L'original indique les scénarios ciblés par les deux petites versions de GPT-5.4, utile pour évaluer le choix de modèle pour les charges API à haut volume.

  1. OpenAI News78

    OpenAI publie gpt-realtime et met à jour la Realtime API

    OpenAI publie gpt-realtime, un modèle speech-to-speech plus avancé, accompagné de nouvelles capacités de la Realtime API 。

    Motif de la recommandation :OpenAI publie un modèle vocal speech-to-speech plus avancé et étend la Realtime API au support MCP, à l'entrée d'images et à la téléphonie SIP.

  1. OpenAI News90

    OpenAI présente GPT-5

    OpenAI présente GPT-5, son meilleur système d'IA à ce jour. Selon OpenAI, GPT-5 marque un bond important en intelligence par rapport à tous ses modèles précédents。

  1. OpenAI News88

    OpenAI 发布 o3 与 o4-mini

    OpenAI 发布 o3 和 o4-mini, 称其为迄今最智能, 能力最强的模型, 并具备完整的工具调用能力.

  2. OpenAI News82

    OpenAI publie la fiche système d'o3 et o4-mini

    OpenAI publie la fiche système d'o3 et o4-mini. Selon la présentation, ces deux modèles combinent un raisonnement de pointe avec l'ensemble des capacités d'outils 。

    Motif de la recommandation :La fiche système d'o3 et o4-mini expose l'intégration du raisonnement et des outils, un point de repère pour évaluer les capacités des modèles.

  1. OpenAI News80

    OpenAI 在 GPT-4o 中引入原生图像生成

    OpenAI 于 2025 年推出 GPT-4o 的原生图像生成功能, 具备更强的文本渲染和指令遵循能力. 文中还提及可探索 ChatGPT Images 2.5.

  1. OpenAI News62

    OpenAI introduit la vision dans l'API de fine-tuning

    OpenAI annonce que les développeurs peuvent désormais fine-tuner GPT-4o avec des images et du texte afin d'améliorer les capacités de vision.

    Motif de la recommandation :L'API de fine-tuning de GPT-4o prend désormais en charge les images et le texte, ce qui permet aux développeurs d'ajuster directement les capacités de vision.

  1. OpenAI News90

    OpenAI annonce GPT-4o

    OpenAI annonce GPT-4 Omni, son nouveau modèle phare capable de raisonner en temps réel sur l'audio, la vision et le texte.

    Motif de la recommandation :Présentation du nouveau modèle phare d'OpenAI, capable de raisonner en temps réel sur l'audio, la vision et le texte.

  1. OpenAI News93

    OpenAI annonce de nouveaux modèles et produits pour développeurs au DevDay

    OpenAI annonce au DevDay GPT-4 Turbo avec une fenêtre de contexte de 128K et des prix réduits, la nouvelle Assistants API, GPT-4 Turbo with Vision et l'API DALL·E 3, entre autres.

    Motif de la recommandation :Récapitulatif des nouveautés annoncées au DevDay, utile pour situer les changements de modèles et d'API destinés aux développeurs.

  1. OpenAI News92

    OpenAI publie GPT-4, un grand modèle multimodal

    OpenAI a créé GPT-4, un grand modèle multimodal qui accepte les entrées d'images et de texte et produit des sorties textuelles. OpenAI indique qu'il est moins capable que les humains dans de nombreux scénarios réels, mais qu'il atteint des performances de niveau humain sur divers benchmarks professionnels et académiques.

    Motif de la recommandation :L'annonce présente les entrées multimodales de GPT-4 et ses performances de niveau humain sur plusieurs benchmarks professionnels et académiques.