Aller au contenu
  1. Hugging Face Blog60

    JetBrains publie Mellum2, un modèle MoE de 12B paramètres

    JetBrains publie Mellum2, un modèle Mixture-of-Experts de 12B paramètres entraîné de zéro sur le langage naturel et le code。

    Motif de la recommandation :JetBrains publie un MoE 12B à 2,5B paramètres actifs sous Apache 2.0, avec des cas d'usage précis pour le routage, le RAG et les sous-agents.

  1. Hugging Face Blog60

    Hugging Face publie la famille Ettin Reranker, six CrossEncoder de 17M à 1B

    Hugging Face publie six nouveaux rerankers Sentence Transformers CrossEncoder, de 17M à 1B de paramètres。

    Motif de la recommandation :Six rerankers de 17M à 1B, avec données et recette d'entraînement complètes, permettent d'évaluer le compromis qualité-latence d'un pipeline retrieve-then-rerank.

Fin de la liste