Aller au contenu
  1. Google DeepMind88

    Google DeepMind annonce Gemini 4 Argon, son nouveau modèle frontière

    Google DeepMind annonce Gemini 4 Argon, un modèle frontière conçu pour maintenir un raisonnement profond sur des workflows complexes et longs.

    Motif de la recommandation :L'annonce détaille les capacités d'Argon en codage, travail de connaissance et cybersécurité, ainsi que son prix et son déploiement progressif.

  1. OpenAI News85

    OpenAI lance GPT-6.1 Sol

    OpenAI lance GPT-6.1 Sol, présenté comme offrant une intelligence proche d'Astra pour le codage。

    Motif de la recommandation :L'annonce donne le positionnement du modèle et un écart de prix par rapport à Astra, utile pour évaluer le coût d'un changement de modèle.

  1. Google DeepMind88

    Google DeepMind lance Gemini 3.8 Flash et 3.8 Flash Cyber

    Google DeepMind annonce Gemini 3.8, son meilleur modèle de raisonnement et de codage à ce jour。

    Motif de la recommandation :Présentation officielle des capacités de Gemini 3.8 Flash en codage long horizon et en cybersécurité, avec tarifs et variantes Cyber.

  1. Google DeepMind82

    Google DeepMind lance Gemini 3.7 Flash pour le codage et les agents

    Google DeepMind annonce Gemini 3.7 Flash, présenté comme son modèle polyvalent le plus intelligent pour le codage et les agents。

    Motif de la recommandation :Le tarif de lancement et les écarts chiffrés sur plusieurs benchmarks permettent de situer le gain par rapport à 3.6 Flash pour les charges de codage et d'agents.

  1. Google DeepMind73

    Google DeepMind lance Gemini 3.5 Flash Cyber, un modèle de cybersécurité léger

    Google DeepMind présente Gemini 3.5 Flash Cyber, un modèle de cybersécurité léger construit sur 3.5 Flash et affiné pour trouver。

    Motif de la recommandation :Un modèle de cybersécurité léger et spécialisé, avec des résultats sur CyberGym et un déploiement en accès restreint.

  1. Hugging Face Blog88

    Z.ai publie GLM-5.2, modèle phare pour les tâches longue durée avec contexte de 1M tokens

    Z.ai présente GLM-5.2, son nouveau modèle phare pour les tâches longue durée, qui succède à GLM-5.1 et prend en charge un contexte solide de 1M tokens. Il introduit IndexShare。

    Motif de la recommandation :Le modèle phare GLM-5.2 est publié avec un contexte de 1M tokens et des benchmarks de codage longue durée, ce qui permet de comparer les performances des modèles ouverts et fermés.

  1. Mistral AI83

    Mistral AI lance Mistral Medium 3.5 et des agents distants dans Vibe

    Mistral AI lance Mistral Medium 3.5 en aperçu public, un modèle dense de 128B à fenêtre de contexte de 256k fusionnant suivi d'instructions。

    Motif de la recommandation :Mistral Medium 3.5 est publié en open weights et devient le modèle par défaut de Vibe et Le Chat, avec des agents cloud asynchrones et un mode Work.

  1. Google DeepMind88

    Google DeepMind 发布 Gemini 3.5 Flash, 主打 Agent 与编程能力

    Google DeepMind 推出 Gemini 3.5 系列首个模型 3.5 Flash, 定位为面向 Agent 与编程的前沿模型, 即日起通过 Gemini 应用。

    Motif de la recommandation :梳理 Gemini 3.5 Flash 在编程与 Agent 基准上的成绩, 开放渠道与定价线索, 便于判断其能否替换现有工作流.

  1. OpenAI News78

    OpenAI lance GPT-5.4 mini et nano

    OpenAI lance GPT-5.4 mini et nano, deux versions plus petites et plus rapides de GPT-5.4。

    Motif de la recommandation :L'original indique les scénarios ciblés par les deux petites versions de GPT-5.4, utile pour évaluer le choix de modèle pour les charges API à haut volume.

  1. OpenAI News80

    OpenAI publie la fiche système de GPT-5.3-Codex

    OpenAI publie la fiche système de GPT-5.3-Codex, présenté comme le modèle de codage agentique le plus capable à ce jour. Il combine les performances de codage de pointe de GPT-5.2-Codex avec les capacités de raisonnement et de connaissances professionnelles de GPT-5.2.

    Motif de la recommandation :La fiche système présente les capacités de codage agentique et de raisonnement du modèle, utile pour situer les cas d'usage de développement.

  2. OpenAI News82

    OpenAI présente GPT-5.3-Codex

    OpenAI présente GPT-5.3-Codex, un agent natif Codex qui associe des performances de codage de pointe à un raisonnement général pour prendre en charge des travaux techniques réels de longue durée.

    Motif de la recommandation :L'annonce présente GPT-5.3-Codex comme un agent natif Codex alliant performance de codage et raisonnement général pour les tâches techniques longues.

  1. OpenAI News82

    OpenAI lance GPT-5.2-Codex

    OpenAI a lancé GPT-5.2-Codex, présenté comme son modèle de codage le plus avancé, avec raisonnement longue durée, transformations de code à grande échelle et capacités de cybersécurité renforcées.

    Motif de la recommandation :Présente les capacités de codage et de raisonnement long du nouveau modèle, utile pour évaluer les scénarios de développement concernés.

  1. Google DeepMind88

    Google DeepMind publie Gemini 3 Flash, un modèle rapide et moins coûteux

    Google DeepMind publie Gemini 3 Flash, un modèle de la famille Gemini 3 conçu pour la vitesse et proposé à un coût réduit. Il atteint 90。

    Motif de la recommandation :L'original expose les scores de Gemini 3 Flash sur GPQA Diamond, SWE-bench Verified et MMMU Pro ainsi que son prix, ce qui permet de situer le compromis vitesse-coût par rapport à Gemini 3 Pro.

  1. Mistral AI82

    Mistral lance Devstral 2 et Devstral Small 2 ainsi que le CLI Mistral Vibe

    Mistral AI publie la famille de modèles de codage Devstral 2, composée de Devstral 2 (123B。

    Motif de la recommandation :Mistral publie deux modèles de codage open source et un CLI agent, avec les scores SWE-bench Verified et les prix API pour situer le compromis performance-coût.

  1. OpenAI News78

    OpenAI lance GPT-5.1-Codex-Max, un modèle de codage agentique plus rapide et plus intelligent

    OpenAI lance GPT-5.1-Codex-Max, un modèle de codage agentique plus rapide et plus intelligent destiné à Codex. Le modèle est conçu pour des tâches de longue durée à l'échelle d'un projet。

    Motif de la recommandation :L'original présente les caractéristiques de GPT-5.1-Codex-Max pour le codage agentique, utile pour évaluer l'impact sur les flux de travail de développement existants.

  2. Google DeepMind93

    Google DeepMind 发布 Gemini 3 Pro 预览版, 同步推出 Deep Think 模式与 Antigravity 开发平台

    Google DeepMind 发布 Gemini 3 Pro 预览版, 称其为目前多模态理解最强, 智能体与 vibe coding 能力最强的模型, 并同步推出增强推理模式 Gemini 3 Deep Think 与智能体开发平台 Google Antigravity. Gemini 3 Pro 在 LMArena 以 1501 Elo 登顶。

    Motif de la recommandation :Gemini 3 Pro 在 LMArena, HLE, GPQA 等基准上的具体分数与首发接入 Search, Gemini App 的节奏, 可供读者判断前沿模型的当前水位.

  1. OpenAI News82

    OpenAI met à disposition GPT-5.1 dans l'API pour les développeurs

    GPT-5.1 est désormais disponible dans l'API. OpenAI indique qu'il apporte une inférence adaptative plus rapide。

    Motif de la recommandation :L'annonce précise les axes d'évolution de GPT-5.1 dans l'API, ce qui aide les développeurs à évaluer l'impact sur leurs intégrations existantes.

  1. OpenAI News72

    OpenAI publie GPT-5-Codex, un modèle optimisé pour le codage agentique dans Codex

    OpenAI a publié l'addendum de la fiche système de GPT-5, présentant GPT-5-Codex。

    Motif de la recommandation :L'addendum présente les ajustements de GPT-5-Codex en matière de codage agentique et d'allocation dynamique de la puissance de calcul, ce qui permet de juger de son intérêt pour les scénarios de codage long.