Aller au contenu
Aujourd'hui10mois3joursamedi5 entrées
10mois2jourvendredi
  1. AWS Machine Learning Blog46

    Amazon Quick et le pattern Adjudicated Query pour auditer des milliers de baux

    Le pattern Adjudicated Query combine Amazon Quick et un moteur de règles déterministe pour vérifier la conformité de milliers de baux. Le modèle se limite à traduire une question en appels sur six outils typés et à restituer le résultat, sans jamais écrire de requête ni effectuer de détermination. Chaque sweep produit un reçu de complétude où compliant + in-breach + ambiguous + unreadable doit égaler scanned, et le jeu complet de résultats reste consultable dans un tableau de bord Amazon Quick Sight.

10mois1jourjeudi
9mois30jourmercredi
  1. AWS Machine Learning Blog62

    Construire un pipeline multi-agents de production musicale sur Amazon Bedrock AgentCore Runtime Instances

    L'article explique comment déployer un pipeline de production musicale à trois agents sur Amazon Bedrock AgentCore Runtime Instances. L'agent de composition utilise Claude Sonnet 4.6 et le modèle ACE-Step sur le GPU NVIDIA L4 de l'instance pour générer un fichier.wav, l'agent de livraison lit ce fichier depuis le volume partagé et applique une chaîne DSP, puis l'agent de conformité revérifie indépendamment le résultat et peut demander une nouvelle composition. Les trois agents partagent la même session via un runtimeSessionId commun, ce qui les place sur une même instance EC2 avec un système de fichiers partagé, et les sessions peuvent persister jusqu'à 14 jours. L'article détaille la création du capacity provider, le déploiement des runtimes et l'orchestration, avec un exemple complet disponible dans le dépôt AgentCore samples sur GitHub.

    Motif de la recommandation :Présente une architecture multi-agents avec sessions partagées, GPU et volumes persistants, et détaille les étapes de déploiement sur AgentCore Runtime Instances.

9mois26joursamedi
9mois25jourvendredi
9mois24jourjeudi
9mois23jourmercredi
9mois22jourmardi
  1. Raspberry Pi Blog62

    Transformer la saisie de texte en actions avec Needle, un LLM de function calling de 14 Mo

    Cactus Compute présente Needle 2, un modèle de function calling de 14 Mo qui transforme des instructions en anglais en actions locales sur un Raspberry Pi 5.

    Motif de la recommandation :Un exemple concret de modèle de function calling de 14 Mo exécuté en local sur Raspberry Pi 5, avec latences et consommation mémoire mesurées.

9mois18jourvendredi
9mois17jourjeudi
9mois16jourmercredi
9mois12joursamedi
9mois11jourvendredi
9mois10jourjeudi
  1. Hugging Face Blog62

    Async GRPO avec LoRA sur HF Jobs : un bucket, un proxy, sans NCCL

    TRL v1.14 prend en charge l'entraînement d'un adaptateur LoRA dans AsyncGRPOTrainer et ne synchronise que cet adaptateur vers vLLM。

    Motif de la recommandation :L'article détaille une architecture concrète pour entraîner un adaptateur LoRA avec Async GRPO sur des Jobs séparés, avec des chiffres de bout en bout et un diagnostic du goulot d'étranglement.

9mois9jourmercredi
8mois21jourvendredi
8mois18jourmardi
  1. Hugging Face Blog62

    Sentence Transformers v6.0 ajoute MultiVectorEncoder pour la recherche à interaction tardive

    Sentence Transformers v6.0 ajoute un quatrième type de modèle, MultiVectorEncoder。

    Motif de la recommandation :Sentence Transformers v6.0 ajoute un quatrième type de modèle pour la recherche à interaction tardive, avec prise en charge des checkpoints PyLate et ColBERT et des modèles de documents visuels.

8mois13jourjeudi
7mois29jourmercredi
7mois16jourjeudi
7mois14jourmardi