Le PDG de Futurum affirme que les agents IA utilisent 5 fois plus de tokens que les humains, avec un cap vers 10 fois
Le PDG de Futurum Group, Daniel Newman, s'appuyant sur un graphique d'a16z issu des données d'OpenRouter.
Le PDG de Futurum Group, Daniel Newman, s'appuyant sur un graphique d'a16z issu des données d'OpenRouter.
OVHcloud juge « trop risqué de ne pas investir » dans l’intelligence artificielle et mise sur des acquisitions pour entraîner des modèles from scratch.
OpenAI a mis en ligne GPT-6.1 Sol le 29 septembre lors de son DevDay, avec les mêmes tarifs que GPT-6 Sol.
Lors du DevDay d'OpenAI, l'équipe a présenté Dots, un assistant personnel dont chaque instance dispose de son propre ordinateur Linux virtuel dans le cloud.
Gemini 3.6 à 3.8 affiche 0,75 dollar par million de tokens en entrée et 3,75 dollars en sortie via l'API.
OpenAI a publié le 22 septembre 2026 GPT-6 Sol et GPT-6 Luna, avec des tarifs API divisés par deux par rapport aux prix promotionnels de GPT-5.6.
TypeSafe AI a dévoilé Jev, un modèle qui accepte du texte en entrée mais renvoie des nombres à virgule flottante correspondant à des catégories.
Motif de la recommandation :L'original détaille le format d'entrée-sortie et la tarification de Jev, ce qui aide le lecteur à juger si ce type de modèle convient à des tâches de classification ou de tri.
OpenAI dévoile les premiers résultats de Jalapeño, sa puce d'inférence personnalisée.
OpenAI présente Ultrafast, un nouveau palier de service de l'API OpenAI qui exécute GPT-5.6 Sol jusqu'à 14 fois plus vite. Propulsé par Cerebras, il atteint jusqu'à 750 tokens de sortie par seconde.
Motif de la recommandation :OpenAI présente un nouveau palier d'API propulsé par Cerebras, avec un débit de sortie allant jusqu'à 750 tokens par seconde, ce qui permet d'évaluer l'impact sur les scénarios à faible latence.
OpenAI détaille GPT-Live, un système permettant une interaction vocale continue avec l'IA grâce à un modèle vocal sans tours de parole et une architecture à faible latence. Ce modèle « turnless » vise des conversations plus rapides et plus naturelles, le tout développé en six mois.
Deux réglages de l'API ont permis à GPT-5.6 de tripler ses scores sur le benchmark ARC-AGI-3.
OpenAI présente GPT-5.6, qui améliore l'efficacité de l'IA au niveau des modèles, de l'inférence et des workflows d'agents, afin d'offrir davantage d'intelligence utile par dollar dépensé.
Motif de la recommandation :L'original indique que GPT-5.6 améliore l'efficacité au niveau du modèle, de l'inférence et des workflows d'agents, ce qui permet de juger de l'évolution du rapport coût-performance.
OpenAI a publié de nouveaux modèles vocaux en temps réel dans l'API, capables de raisonner.
Motif de la recommandation :L'original présente les nouvelles capacités des modèles vocaux en temps réel dans l'API OpenAI, ce qui permet de juger de leur impact sur les applications vocales existantes.
OpenAI lance GPT-5.4, présenté comme son modèle frontière le plus capable et le plus efficace pour le travail professionnel. Il met en avant des capacités de pointe en codage.
Motif de la recommandation :Le résumé officiel expose les capacités de codage, d'usage informatique et de recherche d'outils ainsi que la fenêtre de contexte de 1M tokens, ce qui permet de situer les changements de ce modèle frontière.
OpenAI annonce GPT-5.3-Codex-Spark, présenté comme son premier modèle de codage en temps réel.
Motif de la recommandation :OpenAI dévoile son premier modèle de codage en temps réel, avec un débit annoncé 15 fois supérieur et une fenêtre de 128k, ce qui éclaire l'évolution des outils de développement assisté.
OpenAI annonce un partenariat avec Cerebras portant sur l'ajout de 750MW de calcul IA haute vitesse. Selon OpenAI.
Motif de la recommandation :L'ajout de 750MW de calcul dédié à l'inférence chez Cerebras éclaire l'évolution de la capacité de service de ChatGPT.
OpenAI présente gpt-oss-120b et gpt-oss-20b, deux modèles de raisonnement à poids ouverts disponibles sous licence Apache 2.0 et selon la politique d'usage gpt-oss.
Motif de la recommandation :Deux modèles de raisonnement à poids ouverts sous licence Apache 2.0, avec leurs tailles et leur politique d'usage précisées.
OpenAI o3-mini
OpenAI explore l'échange de compute d'inférence contre la robustesse adversariale. Le titre original ne fournit ni modèle.
OpenAI annonce la mise en cache des prompts dans l'API, offrant des réductions automatiques sur les entrées que le modèle a récemment vues.
OpenAI présente o1-mini, un modèle de raisonnement axé sur la réduction des coûts.