Aller au contenu
3 octobresam.
2 octobreven.
1 octobrejeu.
10 septembrejeu.
25 aoûtmar.
13 aoûtjeu.
  1. OpenAI News78

    OpenAI présente le mode Ultrafast : GPT-5.6 Sol jusqu'à 14 fois plus rapide

    OpenAI présente Ultrafast, un nouveau palier de service de l'API OpenAI qui exécute GPT-5.6 Sol jusqu'à 14 fois plus vite. Propulsé par Cerebras, il atteint jusqu'à 750 tokens de sortie par seconde.

    Motif de la recommandation :OpenAI présente un nouveau palier d'API propulsé par Cerebras, avec un débit de sortie allant jusqu'à 750 tokens par seconde, ce qui permet d'évaluer l'impact sur les scénarios à faible latence.

3 aoûtlun.
29 juilletmer.
  1. OpenAI News78

    GPT-5.6 : comment concilier intelligence de pointe et efficacité

    OpenAI présente GPT-5.6, qui améliore l'efficacité de l'IA au niveau des modèles, de l'inférence et des workflows d'agents, afin d'offrir davantage d'intelligence utile par dollar dépensé.

    Motif de la recommandation :L'original indique que GPT-5.6 améliore l'efficacité au niveau du modèle, de l'inférence et des workflows d'agents, ce qui permet de juger de l'évolution du rapport coût-performance.

24 juinmer.
  1. OpenAI News62

    OpenAI et Broadcom dévoilent la puce d'inférence LLM Jalapeño

    OpenAI et Broadcom présentent Jalapeño, une puce IA personnalisée conçue pour l'inférence LLM, afin d'améliorer les performances, l'efficacité et la mise à l'échelle des systèmes d'IA.

    Motif de la recommandation :OpenAI et Broadcom dévoilent une puce d'inférence LLM dédiée, un jalon dans l'optimisation matérielle pour les charges de travail IA.

7 maijeu.
5 marsjeu.
  1. OpenAI News88

    OpenAI lance GPT-5.4, modèle frontière pour le travail professionnel

    OpenAI lance GPT-5.4, présenté comme son modèle frontière le plus capable et le plus efficace pour le travail professionnel. Il met en avant des capacités de pointe en codage.

    Motif de la recommandation :Le résumé officiel expose les capacités de codage, d'usage informatique et de recherche d'outils ainsi que la fenêtre de contexte de 1M tokens, ce qui permet de situer les changements de ce modèle frontière.

12 févrierjeu.
  1. OpenAI News78

    OpenAI lance GPT-5.3-Codex-Spark, son premier modèle de codage en temps réel

    OpenAI annonce GPT-5.3-Codex-Spark, présenté comme son premier modèle de codage en temps réel.

    Motif de la recommandation :OpenAI dévoile son premier modèle de codage en temps réel, avec un débit annoncé 15 fois supérieur et une fenêtre de 128k, ce qui éclaire l'évolution des outils de développement assisté.

14 janviermer.
5 aoûtmar.
  1. OpenAI News85

    OpenAI publie gpt-oss-120b et gpt-oss-20b, deux modèles de raisonnement à poids ouverts

    OpenAI présente gpt-oss-120b et gpt-oss-20b, deux modèles de raisonnement à poids ouverts disponibles sous licence Apache 2.0 et selon la politique d'usage gpt-oss.

    Motif de la recommandation :Deux modèles de raisonnement à poids ouverts sous licence Apache 2.0, avec leurs tailles et leur politique d'usage précisées.

31 janvierven.
22 janviermer.
1 octobremar.
12 septembrejeu.