Aller au contenu
8mois20jourjeudi
8mois18jourmardi
  1. Hugging Face Blog62

    Sentence Transformers v6.0 ajoute MultiVectorEncoder pour la recherche à interaction tardive

    Sentence Transformers v6.0 ajoute un quatrième type de modèle, MultiVectorEncoder。

    Motif de la recommandation :Sentence Transformers v6.0 ajoute un quatrième type de modèle pour la recherche à interaction tardive, avec prise en charge des checkpoints PyLate et ColBERT et des modèles de documents visuels.

8mois14jourvendredi
8mois12jourmercredi
8mois11jourmardi
  1. Mistral AI62

    Mistral lance des endpoints d'inférence régionaux et un Priority Tier, et ouvre sa plateforme aux modèles ouverts tiers

    Mistral annonce trois avancées pour l'IA souveraine : la disponibilité générale des Mistral Regional Endpoints.

    Motif de la recommandation :Mistral détaille ses endpoints régionaux et son Priority Tier, ce qui aide à évaluer les options de conformité et de résidence des données pour l'inférence.

8mois10jourlundi
8mois4jourmardi
  1. Microsoft Research78

    Microsoft Research présente Orchard, un cadre open source pour l'IA agentique à grande échelle

    Microsoft Research présente Orchard, un cadre open source pour l'IA agentique à grande échelle。

    Motif de la recommandation :Le cadre open source et les recettes d'entraînement par domaine montrent comment de petits modèles ouverts atteignent des scores élevés sur SWE-bench Verified et des benchmarks web.

8mois3jourlundi
7mois30jourjeudi
7mois29jourmercredi
  1. Berkeley AI Research62

    De CUDA à MLX : comment K-Search transfère des décennies d'expertise kernel vers Apple Silicon

    IBM Research et le Berkeley Sky Lab étendent K-Search, un framework de recherche évolutive de kernels piloté par LLM.

    Motif de la recommandation :L'article détaille une couche de traduction CUDA vers MLX et les gains mesurés sur les kernels Attention et Mamba, utile pour évaluer la portabilité des optimisations GPU.

7mois22jourmercredi
7mois20jourlundi
7mois16jourjeudi
7mois14jourmardi
7mois13jourlundi
7mois10jourvendredi
7mois9jourjeudi
7mois8jourmercredi
  1. Hugging Face Blog62

    Hugging Face : le backend transformers de vLLM atteint la vitesse native

    Le backend de modélisation transformers pour vLLM atteint désormais une vitesse égale ou supérieure aux implémentations natives de vLLM pour de nombreuses architectures LLM。

    Motif de la recommandation :L'article détaille comment le backend transformers atteint la vitesse native de vLLM et ce que cela change pour le déploiement des modèles.

  2. Hugging Face Blog22

    Hugging Face vers Amazon SageMaker Studio en un clic

    Hugging Face et Amazon SageMaker AI lancent une intégration par deep-link permettant de passer d'un modèle sur Hugging Face à SageMaker Studio en une seule sélection. Les boutons « Customize on SageMaker AI » et « Deploy on SageMaker AI » ouvrent directement les pages de fine-tuning ou de déploiement avec le modèle préchargé, et SageMaker AI provisionne automatiquement un domaine avec les permissions préconfigurées via la nouvelle politique AmazonSageMakerModelCustomizationCoreAccess (SFT, DPO, RLVR, RLAIF). L'interface affiche aussi la disponibilité des quotas GPU (G5, G6) lors du choix des instances.

7mois7jourmardi
  1. Hugging Face Blog78

    LeRobot v0.6.0 : imaginer, évaluer, améliorer la boucle d'apprentissage robotique

    LeRobot v0.6.0 introduit des politiques à modèle du monde (VLA-JEPA, FastWAM, LingBot-VA)。

    Motif de la recommandation :LeRobot v0.6.0 expose en détail les nouveaux modèles, benchmarks et outils de déploiement, ce qui permet de juger l'évolution de la boucle d'apprentissage robotique open source.

  2. Hugging Face Blog67

    Hugging Face et SkyPilot permettent d'exécuter des charges IA sur n'importe quel cloud avec un stockage sans frais de sortie

    Hugging Face et SkyPilot lancent une intégration qui monte un Bucket Hugging Face ou tout dépôt du Hub dans une tâche SkyPilot via une URL hf。

    Motif de la recommandation :Le montage hf:// et l'absence de frais de sortie permettent de lancer l'entraînement sur n'importe quel cloud sans copier les données.

7mois6jourlundi
  1. Hugging Face Blog62

    Hugging Face Kernels : nouveau type de dépôt, signature de code et CLI repensées

    Hugging Face a publié une mise à jour majeure de son projet Kernels, qui standardise l'empaquetage。

    Motif de la recommandation :Le billet détaille le nouveau type de dépôt kernel, la signature de code et les CLI repensées, ce qui aide à juger comment distribuer et sécuriser des kernels personnalisés.