Le PDG de Futurum affirme que les agents IA utilisent 5 fois plus de tokens que les humains, avec un cap vers 10 fois
Le PDG de Futurum Group, Daniel Newman, s'appuyant sur un graphique d'a16z issu des données d'OpenRouter.
Le PDG de Futurum Group, Daniel Newman, s'appuyant sur un graphique d'a16z issu des données d'OpenRouter.
Le département de la Justice américain a arrêté Greg Lui, PDG d'Earthmade Computer.
Lors d'AutoSens et InCabin Europe 2026 à Barcelone.
Aetina lance les systèmes d'IA embarqués AIE-KT78 et AIE-KT68 pour la robotique et les machines autonomes.
Broadcom a annoncé BroadPeak, un SoC DFE (BCM85021) intégrant 32 émetteurs-récepteurs différentiels.
Lors du DevDay d'OpenAI, l'équipe a présenté Dots, un assistant personnel dont chaque instance dispose de son propre ordinateur Linux virtuel dans le cloud.
RoadScape AI est un concept de mémoire visuelle automobile qui enregistre en continu les images de trois caméras fixes (avant.
OpenAI dévoile les premiers résultats de Jalapeño, sa puce d'inférence personnalisée.
OpenAI présente Ultrafast, un nouveau palier de service de l'API OpenAI qui exécute GPT-5.6 Sol jusqu'à 14 fois plus vite. Propulsé par Cerebras, il atteint jusqu'à 750 tokens de sortie par seconde.
Motif de la recommandation :OpenAI présente un nouveau palier d'API propulsé par Cerebras, avec un débit de sortie allant jusqu'à 750 tokens par seconde, ce qui permet d'évaluer l'impact sur les scénarios à faible latence.
OpenAI détaille GPT-Live, un système permettant une interaction vocale continue avec l'IA grâce à un modèle vocal sans tours de parole et une architecture à faible latence. Ce modèle « turnless » vise des conversations plus rapides et plus naturelles, le tout développé en six mois.
Deux réglages de l'API ont permis à GPT-5.6 de tripler ses scores sur le benchmark ARC-AGI-3.
OpenAI présente GPT-5.6, qui améliore l'efficacité de l'IA au niveau des modèles, de l'inférence et des workflows d'agents, afin d'offrir davantage d'intelligence utile par dollar dépensé.
Motif de la recommandation :L'original indique que GPT-5.6 améliore l'efficacité au niveau du modèle, de l'inférence et des workflows d'agents, ce qui permet de juger de l'évolution du rapport coût-performance.
OpenAI et Broadcom présentent Jalapeño, une puce IA personnalisée conçue pour l'inférence LLM, afin d'améliorer les performances, l'efficacité et la mise à l'échelle des systèmes d'IA.
Motif de la recommandation :OpenAI et Broadcom dévoilent une puce d'inférence LLM dédiée, un jalon dans l'optimisation matérielle pour les charges de travail IA.
OpenAI a publié de nouveaux modèles vocaux en temps réel dans l'API, capables de raisonner.
Motif de la recommandation :L'original présente les nouvelles capacités des modèles vocaux en temps réel dans l'API OpenAI, ce qui permet de juger de leur impact sur les applications vocales existantes.
OpenAI lance GPT-5.4, présenté comme son modèle frontière le plus capable et le plus efficace pour le travail professionnel. Il met en avant des capacités de pointe en codage.
Motif de la recommandation :Le résumé officiel expose les capacités de codage, d'usage informatique et de recherche d'outils ainsi que la fenêtre de contexte de 1M tokens, ce qui permet de situer les changements de ce modèle frontière.
OpenAI annonce GPT-5.3-Codex-Spark, présenté comme son premier modèle de codage en temps réel.
Motif de la recommandation :OpenAI dévoile son premier modèle de codage en temps réel, avec un débit annoncé 15 fois supérieur et une fenêtre de 128k, ce qui éclaire l'évolution des outils de développement assisté.
OpenAI annonce un partenariat avec Cerebras portant sur l'ajout de 750MW de calcul IA haute vitesse. Selon OpenAI.
Motif de la recommandation :L'ajout de 750MW de calcul dédié à l'inférence chez Cerebras éclaire l'évolution de la capacité de service de ChatGPT.
OpenAI présente gpt-oss-120b et gpt-oss-20b, deux modèles de raisonnement à poids ouverts disponibles sous licence Apache 2.0 et selon la politique d'usage gpt-oss.
Motif de la recommandation :Deux modèles de raisonnement à poids ouverts sous licence Apache 2.0, avec leurs tailles et leur politique d'usage précisées.
OpenAI o3-mini
OpenAI explore l'échange de compute d'inférence contre la robustesse adversariale. Le titre original ne fournit ni modèle.
OpenAI annonce la mise en cache des prompts dans l'API, offrant des réductions automatiques sur les entrées que le modèle a récemment vues.
OpenAI présente o1-mini, un modèle de raisonnement axé sur la réduction des coûts.