Aller au contenu
Aujourd'hui10mois3joursamedi2 entrées
  1. The Decoder70

    Cloudflare publie Clef et Clef-flash, des modèles de décision pour agents IA

    Cloudflare publie Clef et Clef-flash, deux modèles de décision destinés aux agents IA qui renvoient une classification courte avec des probabilités plutôt qu'une longue réponse textuelle. Clef est basé sur Qwen3.8-27B et Clef-flash sur Qwen3.5-9B, avec des latences médianes annoncées d'environ 39 ms pour Clef-flash et 209 ms pour Clef, contre un peu plus de 524 ms pour Jev de TypeSafe AI, dont l'API reste compatible. Les deux modèles sont disponibles sur Workers AI et sur Hugging Face sous licence Apache-2.0, et Cloudflare prévoit un service d'apprentissage par renforcement pour le fine-tuning client.

10mois2jourvendredi
10mois1jourjeudi
9mois29jourmardi
  1. Hugging Face Blog70

    NVIDIA publie Kumo Tabular, un modèle de fondation open source pour les données tabulaires

    NVIDIA publie Kumo Tabular, un modèle de fondation open source pour la classification et la régression sur données tabulaires.

    Motif de la recommandation :NVIDIA ouvre un modèle de fondation tabulaire pré-entraîné uniquement sur des données synthétiques, avec poids et bibliothèque d'inférence, ce qui permet de mesurer le passage des arbres boostés à l'apprentissage en contexte.

  2. OpenAI News85

    OpenAI lance GPT-6.1 Sol

    OpenAI lance GPT-6.1 Sol, présenté comme offrant une intelligence proche d'Astra pour le codage。

    Motif de la recommandation :L'annonce donne le positionnement du modèle et un écart de prix par rapport à Astra, utile pour évaluer le coût d'un changement de modèle.

9mois28jourlundi
  1. Hugging Face Blog78

    H Company publie Holo4, une série de modèles agentiques pour l'usage informatique généraliste

    H Company publie la série Holo4, des modèles agentiques en deux tailles : 27B dense et 35B-A3B Mixture of Experts.

    Motif de la recommandation :Holo4 couvre GUI, code, MCP et API avec un même modèle, et les trajectoires des benchmarks sont ouvertes, ce qui permet de comparer le coût et les performances des agents computer-use.

9mois23jourmercredi
9mois16jourmercredi
9mois3jourjeudi
9mois1jourmardi
  1. Microsoft Research62

    Microsoft Research publie GigaPath-Flash et GigaTIME-Flash, des modèles de fondation en pathologie plus efficaces

    Microsoft Research présente GigaPath-Flash et GigaTIME-Flash, deux modèles de fondation en pathologie dérivés de GigaPath et GigaTIME.

    Motif de la recommandation :L'original expose les compromis efficacité-performance et les estimations de temps GPU, ce qui permet de juger si l'analyse à grande échelle devient réalisable.

8mois21jourvendredi
8mois10jourlundi
8mois6jourjeudi
7mois30jourjeudi
7mois29jourmercredi
  1. OpenAI News78

    GPT-5.6 : comment concilier intelligence de pointe et efficacité

    OpenAI présente GPT-5.6, qui améliore l'efficacité de l'IA au niveau des modèles, de l'inférence et des workflows d'agents, afin d'offrir davantage d'intelligence utile par dollar dépensé.

    Motif de la recommandation :L'original indique que GPT-5.6 améliore l'efficacité au niveau du modèle, de l'inférence et des workflows d'agents, ce qui permet de juger de l'évolution du rapport coût-performance.

5mois20jourmercredi
5mois5jourmardi
3mois17jourmardi
  1. OpenAI News78

    OpenAI lance GPT-5.4 mini et nano

    OpenAI lance GPT-5.4 mini et nano, deux versions plus petites et plus rapides de GPT-5.4。

    Motif de la recommandation :L'original indique les scénarios ciblés par les deux petites versions de GPT-5.4, utile pour évaluer le choix de modèle pour les charges API à haut volume.

3mois3jourmardi
11mois19jourmercredi
  1. OpenAI News78

    OpenAI lance GPT-5.1-Codex-Max, un modèle de codage agentique plus rapide et plus intelligent

    OpenAI lance GPT-5.1-Codex-Max, un modèle de codage agentique plus rapide et plus intelligent destiné à Codex. Le modèle est conçu pour des tâches de longue durée à l'échelle d'un projet。

    Motif de la recommandation :L'original présente les caractéristiques de GPT-5.1-Codex-Max pour le codage agentique, utile pour évaluer l'impact sur les flux de travail de développement existants.

11mois12jourmercredi
9mois30jourmardi
9mois15jourlundi
8mois7jourjeudi
8mois5jourmardi
4mois16jourmercredi
  1. OpenAI News82

    OpenAI publie la fiche système d'o3 et o4-mini

    OpenAI publie la fiche système d'o3 et o4-mini. Selon la présentation, ces deux modèles combinent un raisonnement de pointe avec l'ensemble des capacités d'outils 。

    Motif de la recommandation :La fiche système d'o3 et o4-mini expose l'intégration du raisonnement et des outils, un point de repère pour évaluer les capacités des modèles.

4mois14jourlundi
3mois25jourmardi
  1. OpenAI News80

    OpenAI publie un addendum à la fiche système de GPT-4o sur la génération d'images

    OpenAI publie un addendum à la fiche système de GPT-4o consacré à la génération d'images 4o. Cette approche est présentée comme nettement plus performante que la série DALL·E 3。

    Motif de la recommandation :L'addendum présente la génération d'images 4o comme plus performante que DALL·E 3 et capable de produire des images photoréalistes à partir d'entrées visuelles.

2mois27jourjeudi
9mois12jourjeudi
7mois18jourjeudi
5mois13jourlundi
  1. OpenAI News90

    OpenAI annonce GPT-4o

    OpenAI annonce GPT-4 Omni, son nouveau modèle phare capable de raisonner en temps réel sur l'audio, la vision et le texte.

    Motif de la recommandation :Présentation du nouveau modèle phare d'OpenAI, capable de raisonner en temps réel sur l'audio, la vision et le texte.