Aller au contenu
4mois9jourjeudi
4mois8jourmercredi
4mois1jourmercredi
  1. Hugging Face Blog62

    Hugging Face lance gradio.Server pour associer n'importe quel frontend au backend Gradio

    Hugging Face présente gradio.Server, une extension de FastAPI qui ajoute le moteur d'API de Gradio (file d'attente。

    Motif de la recommandation :gradio.Server permet de conserver la file d'attente et le support ZeroGPU de Gradio tout en apportant son propre frontend, ce qui change la façon de construire sur Spaces.

3mois31jourmardi
3mois27jourvendredi
3mois21joursamedi
  1. Hugging Face Blog78

    Construire un modèle d'embedding spécialisé en moins d'une journée

    NVIDIA détaille un pipeline en six étapes pour transformer un modèle d'embedding généraliste (Llama-Nemotron-Embed-1B-v2) en modèle spécialisé à un domaine。

    Motif de la recommandation :Présente un pipeline complet de fine-tuning d'embedding pour RAG, avec commandes, hyperparamètres et résultats mesurés sur un GPU unique.

3mois18jourmercredi
3mois17jourmardi
3mois13jourvendredi
  1. Berkeley AI Research36

    SPEX et ProxySPEX : identifier les interactions à grande échelle pour les LLM

    Berkeley AI Research présente SPEX et ProxySPEX, des algorithmes d'attribution capables d'identifier les interactions influentes dans les LLM à une échelle bien supérieure aux méthodes antérieures. SPEX exploite la parcimonie et le faible degré des interactions pour reformuler la recherche exhaustive en un problème de recouvrement parcimonieux résolu via des outils de traitement du signal et de théorie du codage. ProxySPEX tire parti de la propriété de hiérarchie des modèles et atteint les performances de SPEX avec environ 10x moins d'ablations. Sur une tâche d'analyse de sentiment, SPEX conserve une fidélité élevée lorsque le contexte atteint des milliers de features, là où LIME et Banzhaf affichent une fidélité nettement inférieure.

3mois11jourmercredi
3mois10jourmardi
3mois7joursamedi
  1. Google Research62

    Google Research publie WAXAL, un corpus vocal ouvert pour 27 langues africaines

    Google Research présente WAXAL, un corpus vocal ouvert couvrant 27 langues d'Afrique subsaharienne parlées par plus de 100 millions de locuteurs dans plus de 26 pays. La publication inclut environ 1 846 heures d'audio transcrit pour la reconnaissance automatique de la parole (ASR) et plus de 565 heures d'enregistrements haute fidélité pour la synthèse vocale (TTS), sous licence CC-BY-4.0. Le projet, mené depuis 2021 avec des universités et organisations communautaires africaines, vise à soutenir la recherche et le développement de technologies vocales inclusives.

    Motif de la recommandation :L'article détaille la composition et les licences d'un corpus vocal multilingue, utile pour évaluer la couverture des langues à faibles ressources.

3mois5jourjeudi
  1. Hugging Face Blog62

    Hugging Face lance Modular Diffusers, des blocs composables pour les pipelines de diffusion

    Hugging Face présente Modular Diffusers, une nouvelle façon de construire des pipelines de diffusion en composant des blocs réutilisables。

    Motif de la recommandation :L'article détaille la composition par blocs des pipelines de diffusion et l'intégration avec Mellon, ce qui permet de juger de la flexibilité offerte pour construire des workflows personnalisés.

2mois26jourjeudi
  1. Hugging Face Blog60

    Hugging Face transformers : prise en charge des architectures MoE, du chargement des poids à l'entraînement

    Hugging Face détaille dans un article de blog les évolutions de la bibliothèque transformers pour prendre en charge les modèles Mixture of Experts (MoE)。

    Motif de la recommandation :L'article détaille les modifications d'ingénierie de transformers pour les MoE, avec des benchmarks de chargement et des API concrètes pour le déploiement.

2mois20jourvendredi
2mois17jourmardi
2mois13jourvendredi
  1. Hugging Face Blog62

    Hugging Face publie un skill d'agent pour écrire des kernels CUDA

    Hugging Face a construit un skill d'agent qui apprend aux agents de codage à écrire des kernels CUDA de production。

    Motif de la recommandation :L'article détaille un skill d'agent qui génère des kernels CUDA intégrés à transformers et diffusers, avec benchmarks et procédure de publication sur le Hub.

2mois12jourjeudi
  1. Hugging Face Blog60

    OpenEnv en pratique : évaluer les agents utilisant des outils dans des environnements réels

    Hugging Face et Meta présentent OpenEnv, un framework open source qui évalue les agents IA contre de vrais systèmes plutôt que des simulations。

    Motif de la recommandation :L'article détaille le framework OpenEnv et le benchmark Calendar Gym, avec des chiffres concrets sur les limites des agents et des cas d'erreur d'appel d'outils réutilisables.

2mois9jourlundi
  1. Hugging Face Blog78

    Transformers.js v4 disponible sur NPM avec un nouveau runtime WebGPU

    Transformers.js v4 est disponible sur NPM après un an de développement. La version adopte un nouveau runtime WebGPU réécrit en C++ avec l'équipe ONNX Runtime。

    Motif de la recommandation :Transformers.js v4 détaille le nouveau runtime WebGPU en C++, les gains de performance et la restructuration du dépôt, utile pour évaluer le déploiement d'inférence dans le navigateur.

2mois4jourmercredi
  1. Hugging Face Blog65

    Hugging Face lance Community Evals pour des évaluations ouvertes sur le Hub

    Hugging Face lance Community Evals, un système d'évaluation décentralisé sur le Hub 。

    Motif de la recommandation :Hugging Face ouvre l'évaluation aux contributions communautaires et relie scores, modèles et benchmarks sur le Hub, ce qui change la façon de consulter et de reproduire les résultats.

2mois3jourmardi
1mois28jourmercredi
1mois27jourmardi
1mois22jourjeudi
1mois20jourmardi
  1. Hugging Face Blog78

    Overworld publie Waypoint-1, un modèle de diffusion vidéo interactif en temps réel

    Overworld publie Waypoint-1, un modèle de diffusion vidéo interactif en temps réel contrôlable à la souris。

    Motif de la recommandation :L'original expose l'architecture et les optimisations d'inférence d'un modèle de diffusion vidéo interactif, utile pour comprendre les compromis des world models temps réel.

1mois15jourjeudi
  1. Hugging Face Blog72

    Hugging Face présente Open Responses, un standard ouvert d'inférence pour les agents

    Open Responses est un nouveau standard ouvert d'inférence initié par OpenAI, construit par la communauté open source et soutenu par l'écosystème Hugging Face。

    Motif de la recommandation :L'article détaille la spécification Open Responses, ses différences avec Chat Completion et les changements concrets pour les clients et fournisseurs d'inférence.

1mois14jourmercredi
12mois24jourmercredi
12mois16jourmardi
  1. Google DeepMind62

    Google DeepMind publie Gemma Scope 2, une suite d'outils d'interprétabilité pour toute la famille Gemma 3

    Google DeepMind annonce Gemma Scope 2, une suite ouverte d'outils d'interprétabilité couvrant toutes les tailles de la famille Gemma 3。

    Motif de la recommandation :L'original expose la couverture complète de Gemma Scope 2 sur la famille Gemma 3 et les techniques d'entraînement employées, ce qui permet de situer les outils d'interprétabilité disponibles pour l'audit des modèles.

12mois12jourvendredi
12mois3jourmercredi
12mois1jourlundi
11mois19jourmercredi