Hugging Face et Dell lancent Dell Enterprise Hub, une expérience sur Hugging Face permettant d'entraîner et de déployer des modèles ouverts en local sur les plateformes Dell.
OpenAI et Stack Overflow annoncent un partenariat API associant la plateforme de connaissances techniques de Stack Overflow aux modèles LLM d'OpenAI pour l'IA. L'objectif affiché est de doter les développeurs des forces combinées de la principale plateforme de contenus hautement techniques et des modèles LLM les plus populaires pour le développement d'IA.
Motif de la recommandation :L'article détaille les spécifications de Llama 3, les intégrations dans l'écosystème Hugging Face et les méthodes de déploiement, ce qui permet de comprendre les capacités du modèle et les options d'utilisation.
Hugging Face publie un guide sur les vision language models (VLM), des modèles multimodaux qui prennent en entrée images et texte pour générer du texte.
Hugging Face lance Deploy on Google Cloud, une intégration du Hub permettant de déployer des milliers de modèles ouverts sur Google Cloud via Vertex AI ou GKE.
Klarna utilise l'IA pour transformer le shopping personnalisé, le service client et la productivité des employés, son assistant IA réalisant le travail de 700 agents à temps plein.
OpenAI ajoute de nouvelles fonctionnalités à son API de fine-tuning pour donner aux développeurs plus de contrôle, et annonce de nouveaux moyens de construire des modèles personnalisés avec OpenAI.
Harvey s'associe à OpenAI pour construire un modèle entraîné sur mesure destiné aux professionnels du droit. Ce partenariat vise à adapter les capacités du modèle aux besoins spécifiques du secteur juridique.
Oscar applique l'IA à l'assurance santé pour réduire les coûts et améliorer la prise en charge des patients. L'entreprise vise ainsi à la fois des économies pour l'assureur et une meilleure qualité de soins pour les assurés.
Hugging Face présente la quantification des embeddings comme une étape de post-traitement qui réduit la mémoire et le stockage sans réduire la dimensionnalité. La quantification binaire convertit les valeurs float32 en 1 bit, soit une réduction de 32x, et permet de conserver environ 96 % des performances de retrieval grâce à une étape de rescoring avec l'embedding de requête float32 ; la quantification scalaire en int8 réduit la taille de 4x et atteint environ 99 % des performances avec un rescore_multiplier de 4 à 5. Sur un benchmark MTEB Retrieval, la quantification binaire offre un gain de vitesse moyen de 24,76x et la quantification int8 de 3,66x. Une démo combine recherche binaire et rescoring int8 sur 41 millions de textes Wikipédia, avec 5,2 Go de mémoire et 52 Go d'espace disque contre 200 Go pour un retrieval float32 classique. Le code est disponible via Sentence Transformers et des scripts d'exemple.
Motif de la recommandation :L'article détaille les principes et le code de la quantification binaire et scalaire des embeddings, avec des gains de vitesse et de coût mesurés sur 41 millions de textes.
JetBrains s'appuie sur l'API OpenAI pour construire le produit à la croissance la plus rapide de son histoire. Le contenu détaillé de ce produit et les fonctionnalités associées ne sont pas précisés dans le texte source.
Hugging Face montre comment exécuter le modèle Phi-2 (2,7 milliards de paramètres) quantifié en 4 bits sur un laptop équipé d'un CPU Intel Core Ultra 7 155H.
Le blog Hugging Face présente GaLore, une méthode qui projette les gradients dans un sous-espace de bas rang pour réduire la mémoire des états d'optimiseur de plus de 82.
Motif de la recommandation :L'article détaille la réduction de plus de 82,5 % de la mémoire des états d'optimiseur et fournit un exemple exécutable avec transformers, utile pour l'entraînement sur GPU grand public.
Salesforce intègre les LLM prêts pour l'entreprise d'OpenAI afin de transformer ses applications clients. Cette intégration s'appuie sur les capacités de fiabilité et de sécurité conçues pour les déploiements en entreprise.
Superhuman dévoile une nouvelle génération d'expérience email intégrant l'IA d'OpenAI. Le produit vise à transformer la gestion des emails en s'appuyant sur les modèles OpenAI.
Healthify collabore avec OpenAI pour proposer un coaching santé par IA destiné à améliorer la perte de poids durable de millions de personnes. Le partenariat s'appuie sur les modèles d'OpenAI pour accompagner les utilisateurs dans leurs objectifs de santé.
Match Group utilise ChatGPT Enterprise pour stimuler la créativité et l'impact au sein de l'entreprise. Le déploiement de ChatGPT Enterprise permet à Match Group d'améliorer la productivité de ses équipes.
Lifespan utilise GPT-4 pour améliorer radicalement la littératie en santé et les résultats des patients. L'initiative vise à renforcer la compréhension des informations médicales et le bien-être des patients grâce au modèle de langage d'OpenAI.