Aller au contenu
  1. NVIDIA Blog75

    NVIDIA Vera Rubin NVL72 débute dans MLPerf Inference v6.1 avec des performances de pointe

    NVIDIA publie les résultats MLPerf Inference v6.1 : le système Vera Rubin NVL72。

    Motif de la recommandation :Les résultats MLPerf v6.1 chiffrent le gain de débit du système Vera Rubin NVL72 face à GB300 NVL72 et l'efficacité de mise à l'échelle, utiles pour comparer les options d'infrastructure d'inférence.

  1. Mistral AI74

    Mistral AI publie Leanstral 1.5, modèle de vérification formelle Lean 4

    Mistral AI publie Leanstral 1.5, un modèle gratuit sous licence Apache-2.0 de 119B de paramètres totaux et 6B actifs。

    Motif de la recommandation :Leanstral 1.5 est publié sous licence Apache-2.0 avec 6B de paramètres actifs, des scores sur miniF2F, PutnamBench et FATE, et la découverte de bugs inédits.

  1. Mistral AI70

    Mistral lance OCR 4 avec boîtes englobantes et classification de blocs

    Mistral publie OCR 4, un modèle d'extraction documentaire qui renvoie, outre le texte。

    Motif de la recommandation :Mistral OCR 4 ajoute boîtes englobantes, classification de blocs et scores de confiance, avec auto-hébergement en un conteneur et tarification à la page.

  1. Hugging Face Blog88

    Google DeepMind publie la famille Gemma 4 de modèles multimodaux ouverts sur Hugging Face

    Google DeepMind publie sur Hugging Face la famille Gemma 4, des modèles multimodaux sous licence Apache 2.0 capables de traiter texte。

    Motif de la recommandation :L'article détaille l'architecture, les tailles et les benchmarks de Gemma 4, ainsi que son intégration dans les principaux moteurs d'inférence et outils de fine-tuning.

  1. Google DeepMind83

    Google DeepMind publie une mise à niveau majeure de Gemini 3 Deep Think

    Google DeepMind annonce une mise à niveau majeure de Gemini 3 Deep Think, son mode de raisonnement spécialisé。

    Motif de la recommandation :L'original expose les scores de Deep Think sur HLE, ARC-AGI-2 et Codeforces, ainsi que son ouverture via l'API Gemini, ce qui permet de situer le mode de raisonnement spécialisé de Gemini 3.

  1. Mistral AI62

    Mistral AI lance Mistral OCR 3

    Mistral AI lance Mistral OCR 3, un modèle d'extraction de texte et d'images intégrées dans les documents。

    Motif de la recommandation :Mistral OCR 3 détaille ses performances sur formulaires, écriture manuscrite et tableaux complexes, avec un prix de 2 dollars pour 1 000 pages et une compatibilité descendante.

  1. Mistral AI88

    Mistral AI lance Mistral 3 et la série Ministral 3 sous licence Apache 2.0

    Mistral AI annonce Mistral 3, composé de Mistral Large 3 et de trois modèles denses Ministral 3 de 14B。

    Motif de la recommandation :Mistral 3 publie les poids et les formats compressés, ce qui permet de comparer les tailles, les licences et les chemins de déploiement.

  1. OpenAI News82

    OpenAI met à disposition GPT-5.1 dans l'API pour les développeurs

    GPT-5.1 est désormais disponible dans l'API. OpenAI indique qu'il apporte une inférence adaptative plus rapide。

    Motif de la recommandation :L'annonce précise les axes d'évolution de GPT-5.1 dans l'API, ce qui aide les développeurs à évaluer l'impact sur leurs intégrations existantes.

  1. OpenAI News88

    OpenAI lance GPT-5 pour les développeurs dans son API

    OpenAI met GPT-5 à disposition sur sa plateforme API, avec de hautes performances de raisonnement。

    Motif de la recommandation :L'annonce expose les performances de raisonnement et les nouveaux contrôles destinés aux développeurs, ce qui aide à juger de l'impact sur les flux de travail de codage.

  1. Mistral AI78

    Mistral AI lance Mistral Medium 3, un modèle intermédiaire au coût réduit

    Mistral AI annonce Mistral Medium 3, un modèle qui atteint selon l'entreprise au moins 90 % des performances de Claude Sonnet 3.7 sur les benchmarks pour un coût de 0。

    Motif de la recommandation :Mistral Medium 3 revendique des performances proches de Claude Sonnet 3.7 pour un coût bien inférieur, avec un déploiement possible sur quatre GPU ou plus.

  1. Mistral AI78

    Mistral AI 发布 Mistral Large 2, 123B 参数支持 128k 上下文

    Mistral AI 发布新一代模型 Mistral Large 2, 拥有 1230 亿参数和 128k 上下文窗口, 支持包括中文, 法语, 德语在内的数十种语言以及 80 多种编程语言。

    Motif de la recommandation :Mistral Large 2 的 123B 参数, 128k 上下文与单节点推理定位, 为关注开源模型部署成本与多语言能力的读者提供具体参照.

  1. Mistral AI78

    Mistral AI publie Mistral NeMo, un modèle 12B avec une fenêtre de contexte de 128k

    Mistral AI publie Mistral NeMo, un modèle 12B développé en collaboration avec NVIDIA。

    Motif de la recommandation :Mistral NeMo est un modèle 12B à fenêtre de 128k, sous licence Apache 2.0, avec un tokenizer Tekken plus efficace et une quantification FP8, ce qui permet d'évaluer les compromis entre taille, contexte et coût d'inférence.

  1. Hugging Face Blog88

    Code Llama : Llama 2 apprend à coder

    Hugging Face annonce l'intégration de Code Llama, une famille de modèles ouverts dérivés de Llama 2 spécialisés sur le code。

    Motif de la recommandation :Présente les trois tailles de Code Llama, la fenêtre de contexte étendue et l'intégration complète dans l'écosystème Hugging Face.

  1. Hugging Face Blog88

    Llama 2 est disponible sur Hugging Face

    Meta publie Llama 2, une famille de grands modèles de langage open access de 7B à 70B paramètres。

    Motif de la recommandation :Présente l'intégration complète de Llama 2 dans Hugging Face, avec les modèles, l'inférence et le fine-tuning, utile pour évaluer les options de déploiement.

Fin de la liste