Stampli réduit de 68 % le temps de lancement grâce à ChatGPT Work
Stampli a réduit de 68 % les heures consacrées au lancement en s'appuyant sur Codex et ChatGPT Work. Face à une échéance fixe et des ressources de design mobilisées ailleurs。
Stampli a réduit de 68 % les heures consacrées au lancement en s'appuyant sur Codex et ChatGPT Work. Face à une échéance fixe et des ressources de design mobilisées ailleurs。
OpenAI confirme la rétention zéro des données (Zero Data Retention) pour les clients API éligibles et préfigure le Private Safety Processing。
Asana a remplacé en deux semaines un système de test obsolète grâce à OpenAI Codex。
Les équipes de NVIDIA utilisent ChatGPT Work pour réduire les tâches manuelles。
Sentence Transformers v6.0 ajoute un quatrième type de modèle, MultiVectorEncoder。
Motif de la recommandation :Sentence Transformers v6.0 ajoute un quatrième type de modèle pour la recherche à interaction tardive, avec prise en charge des checkpoints PyLate et ColBERT et des modèles de documents visuels.
Un allocateur GPU sensible aux contraintes, comparé à un ordonnanceur FIFO sur sept scénarios de benchmark。
AWS publie Strands Robots, un SDK open source (Apache 2.0) qui expose les abstractions robotiques。
RingCentral s'appuie sur ChatGPT Work et Codex pour accélérer le développement de produits IA et centraliser l'intelligence opérationnelle entre ingénierie et opérations. L'entreprise utilise ces outils pour unifier ses flux de travail, de l'ingénierie aux opérations.
ALTK-Evolve, le système de mémoire agentique de Hugging Face, atteint 89,3 de TGC sur AppWorld avec DeepSeek-V3.2 contre 80。
Mistral annonce trois avancées pour l'IA souveraine : la disponibilité générale des Mistral Regional Endpoints.
Motif de la recommandation :Mistral détaille ses endpoints régionaux et son Priority Tier, ce qui aide à évaluer les options de conformité et de résidence des données pour l'inférence.
Les modèles Daybreak d'OpenAI sont désormais accessibles via Amazon Bedrock, en collaboration avec AWS。
La CFO d'OpenAI, Sarah Friar, tire cinq leçons de la construction d'une fonction finance AI-native。
Model ML s'appuie sur GPT-5.6 Sol pour prendre en charge l'ensemble du travail financier。
Multiverse Computing 发布论文« Efficient Knowledge Distillation for LLMs: Offline Top-K Logits and a Fused Chunked KL Loss »。
Motif de la recommandation :提出离线 top-K logits 缓存与融合分块 KL 损失两项系统改动, 把长上下文蒸馏显存从数百 GB 降到单卡可跑.
Microsoft Research présente Orchard, un cadre open source pour l'IA agentique à grande échelle。
Motif de la recommandation :Le cadre open source et les recettes d'entraînement par domaine montrent comment de petits modèles ouverts atteignent des scores élevés sur SWE-bench Verified et des benchmarks web.
OpenAI a construit en six mois un système temps réel pour la voix IA, GPT-Live。
Circles utilise l'API OpenAI et Codex pour alimenter des expériences télécom natives de l'IA。
avatarin s'appuie sur GPT-Realtime d'OpenAI pour offrir aux clients de Yamada Denki un support multilingue 24h/24 et 7j/7. En deux semaines。
IBM Research et le Berkeley Sky Lab étendent K-Search, un framework de recherche évolutive de kernels piloté par LLM.
Motif de la recommandation :L'article détaille une couche de traduction CUDA vers MLX et les gains mesurés sur les kernels Attention et Mamba, utile pour évaluer la portabilité des optimisations GPU.
OpenAI annonce le projet Camellia dans le comté d'Effingham, en Géorgie, avec des engagements en matière d'énergie responsable, d'investissement communautaire, d'emplois et d'accès à Codex.
NTT DATA Group utilise ChatGPT Enterprise et Codex pour automatiser le travail de 9 000 employés et ramener l'analyse d'incidents à 30 minutes. Le groupe s'appuie sur ces outils pour généraliser une adoption de l'IA sécurisée à grande échelle.
OpenAI partage les enseignements du déploiement de modèles IA à exécution longue。
L'équipe créative d'OpenAI utilise Codex pour créer des outils créatifs sur mesure。
Cars24 s'appuie sur les agents vocaux et de chat propulsés par OpenAI pour traiter plus de 1M de minutes de conversation par mois et récupérer 12 % des leads perdus. Le spécialiste indien de la voiture d'occasion déploie ces workflows agentiques auprès de ses équipes à travers l'entreprise.
Le routage de modèles dans les systèmes agentiques n'est pas un problème de classification mais d'optimisation système。
OpenAI explique comment les entreprises peuvent piloter leurs investissements IA à l'ère agentique en mesurant le « travail utile par dollar »。
ChatGPT Work propose des workflows pratiques pour les équipes commerciales, couvrant les briefs de pipeline。
Google DeepMind lance un pilote en direct d'ATL Saathi。
Deutsche Telekom devient une telco AI-native avec OpenAI, en transformant le service client。
Hugging Face 博客发布« Profiling in PyTorch »系列第三部分, 用 profiler 剖析 attention 的五步原始操作 (matmul。
Mistral Studio propose désormais un système d'enregistrement centralisé pour les prompts et skills。
Le backend de modélisation transformers pour vLLM atteint désormais une vitesse égale ou supérieure aux implémentations natives de vLLM pour de nombreuses architectures LLM。
Motif de la recommandation :L'article détaille comment le backend transformers atteint la vitesse native de vLLM et ce que cela change pour le déploiement des modèles.
Hugging Face et Amazon SageMaker AI lancent une intégration par deep-link permettant de passer d'un modèle sur Hugging Face à SageMaker Studio en une seule sélection. Les boutons « Customize on SageMaker AI » et « Deploy on SageMaker AI » ouvrent directement les pages de fine-tuning ou de déploiement avec le modèle préchargé, et SageMaker AI provisionne automatiquement un domaine avec les permissions préconfigurées via la nouvelle politique AmazonSageMakerModelCustomizationCoreAccess (SFT, DPO, RLVR, RLAIF). L'interface affiche aussi la disponibilité des quotas GPU (G5, G6) lors du choix des instances.
Microsoft a annoncé à Build 2026 Foundry Managed Compute et les modèles Hugging Face sur Foundry。
Motif de la recommandation :Présente le catalogue Hugging Face sur Foundry Managed Compute et le pipeline de curation, utile pour évaluer le déploiement de modèles open-weight en entreprise.
Aditya G. Parameswaran (UC Berkeley) et ses collaborateurs identifient trois défis pour les data systems à l'ère de l'inférence quasi gratuite.
LeRobot v0.6.0 introduit des politiques à modèle du monde (VLA-JEPA, FastWAM, LingBot-VA)。
Motif de la recommandation :LeRobot v0.6.0 expose en détail les nouveaux modèles, benchmarks et outils de déploiement, ce qui permet de juger l'évolution de la boucle d'apprentissage robotique open source.
Hugging Face et SkyPilot lancent une intégration qui monte un Bucket Hugging Face ou tout dépôt du Hub dans une tâche SkyPilot via une URL hf。
Motif de la recommandation :Le montage hf:// et l'absence de frais de sortie permettent de lancer l'entraînement sur n'importe quel cloud sans copier les données.
Australian Payments Plus (AP+) utilise ChatGPT Enterprise et Codex pour accélérer le traitement de la complexité des paiements. L'entreprise gagne du temps et améliore la qualité。
PRX détaille dans son Part 4 la stratégie de données derrière son modèle de 7B 。
Hugging Face a publié une mise à jour majeure de son projet Kernels, qui standardise l'empaquetage。
Motif de la recommandation :Le billet détaille le nouveau type de dépôt kernel, la signature de code et les CLI repensées, ce qui aide à juger comment distribuer et sécuriser des kernels personnalisés.