Aller au contenu
9mois22jourmardi
  1. NVIDIA Blog22

    De l'activation à l'exécution : l'écosystème IA de l'Égypte atteint l'échelle de production

    L'Égypte a franchi le cap de la production en IA, avec une base d'apprenants du NVIDIA Deep Learning Institute multipliée par plus de dix en un an et une licence accordée en juin à Hassan Allam Data Centers pour construire et exploiter des data centers, dont un investissement estimé à 400 millions de dollars avec A15. Quatre AI factories ont été annoncées ou mises en service en Afrique en un an, avec 656 mégawatts de capacité supplémentaire en préparation, tandis que Cassava Technologies prévoit des déploiements en Égypte, au Kenya, au Nigeria et au Maroc pour un investissement pouvant atteindre 720 millions de dollars. Le programme NVIDIA Inception en Égypte réunit notamment Aidera, Intella, Marses Robotics, Proteinea et Stakpak, et la NVIDIA VC Alliance s'est élargie avec A15 et M Empire.

9mois21jourlundi
  1. NVIDIA Blog22

    NVIDIA : la sécurité de l'IA est un problème d'ingénierie — comment la résoudre à chaque couche du stack d'agents

    NVIDIA publie OpenShell, un runtime sécurisé open source qui applique des politiques hors de portée de l'agent et fournit une exécution en sandbox pour encadrer l'accès des agents aux données, au réseau et aux ressources système. Les partenaires de l'Open Secure AI Alliance s'appuient dessus : DefenseClaw de Cisco ajoute une couche de gouvernance, et JFrog intègre OpenShell pour scanner et vérifier les skills des agents et appliquer des politiques sur ceux auxquels ils peuvent accéder. La sécurité des agents exige des frontières exécutoires indépendantes du raisonnement du modèle, une identité traçable par agent, des approbations humaines pour les actions sensibles, ainsi que des tests répétés après tout changement de modèle, d'outil ou de workflow.

  2. Hugging Face Blog62

    Hugging Face publie tokenizers v1 : encodage 3 à 30 fois plus rapide que la v0.23

    Hugging Face annonce la release candidate de tokenizers v1, dont le chemin d'encodage est 3 à 30 fois plus rapide que la v0.23 sur un thread avec un Apple M4 Max。

    Motif de la recommandation :L'article détaille les changements d'implémentation de tokenizers v1 et fournit des benchmarks reproductibles, ce qui permet d'évaluer l'impact sur les pipelines d'entraînement et de service.

9mois19joursamedi
9mois18jourvendredi
9mois17jourjeudi
9mois16jourmercredi
  1. Hugging Face Blog62

    IBM Research présente le Consistency Analyzer d'ALTK-Evolve pour réduire l'écart de cohérence des agents

    IBM Research présente le Consistency Analyzer, un outil de diagnostic intégré à ALTK-Evolve qui identifie les points de décision instables d'un agent en rééchantillonnant une trajectoire enregistrée, sans vérité terrain ni nouvelle exécution complète. Sur AppWorld test_normal avec un agent ReAct sur GPT-4.1, l'écart de cohérence entre Mean@5 (77,4 %) et Pass^5 (53,0 %) atteint 24,4 points ; les directives de cohérence générées à partir de ces diagnostics réduisent cet écart à 12,0 points, avec Pass^5 à 69,0 % et Mean@5 à 81,0 %. Le dépôt open source ALTK-Evolve inclut désormais l'outil et la génération de directives, et le rapport technique est publié sur arXiv.

    Motif de la recommandation :L'original expose une méthode de diagnostic de la variabilité des agents et des directives correctives, avec des chiffres avant/après sur AppWorld.

9mois14jourlundi
9mois12joursamedi
9mois11jourvendredi
9mois10jourjeudi
  1. Hugging Face Blog62

    Reconstruire AUTOMATIC1111 avec Gradio Workflow : 11 pipelines et 73 nœuds

    Hugging Face présente Workflow1111, un canevas de workflow unique qui reconstruit la plupart des fonctionnalités d'AUTOMATIC1111 sous forme de 11 pipelines multimédias construits avec 73 nœuds. Le canevas couvre la génération texte-image, le hi-resolution fix, l'image-to-image, la matrice de prompts, l'interrogation VLM, la détection vers masque d'inpainting, les annotateurs de style ControlNet, la suppression d'arrière-plan, le stockage PNG Info et l'image-to-video, avec des modèles comme FLUX.1-Kontext, Qwen3-4B, Qwen2.5-VL, DETR, AuraSR ×4, BRIA RMBG-2.0 et Wan 2.2 I2V A14B. Chaque nœud de sortie devient un point d'accès REST, et avec mcp_server=True, ces points d'accès deviennent des outils MCP appelables par des assistants IA comme Claude Code ou Cursor.

    Motif de la recommandation :L'article détaille comment reconstruire l'ensemble des fonctionnalités d'AUTOMATIC1111 avec 73 nœuds Gradio Workflow, et comment chaque sortie devient un point d'accès REST et un outil MCP.

  2. Hugging Face Blog62

    Async GRPO avec LoRA sur HF Jobs : un bucket, un proxy, sans NCCL

    TRL v1.14 prend en charge l'entraînement d'un adaptateur LoRA dans AsyncGRPOTrainer et ne synchronise que cet adaptateur vers vLLM。

    Motif de la recommandation :L'article détaille une architecture concrète pour entraîner un adaptateur LoRA avec Async GRPO sur des Jobs séparés, avec des chiffres de bout en bout et un diagnostic du goulot d'étranglement.

9mois9jourmercredi
9mois5joursamedi
  1. GitHub Blog · AI & ML71

    GitHub lance Project HydraFusion, un aperçu de recherche d'orchestration multi-modèles dans Copilot CLI

    GitHub annonce Project HydraFusion, un aperçu de recherche disponible sur tous les forfaits GitHub Copilot via /experimental dans GitHub Copilot CLI。

    Motif de la recommandation :GitHub détaille trois modes d'orchestration multi-modèles et des résultats de benchmarks avec écarts de coût, utiles pour évaluer les compromis qualité-coût des workflows d'agents.

9mois3jourjeudi
  1. Google DeepMind62

    Google DeepMind lance le Fairwind Program pour la cyberdéfense des gouvernements et entreprises

    Google DeepMind lance le Fairwind Program, un programme à accès limité destiné aux gouvernements et partenaires de confiance pour utiliser ses capacités de cyberdéfense avancées. Le programme associe le modèle Gemini 3.8 Flash Cyber au harness CodeMender pour trouver, vérifier et corriger des vulnérabilités à l'échelle agentique, avec des correctifs vérifiés prêts au déploiement générés en quelques minutes au lieu de plusieurs semaines. Plus de 650 partenaires participent, avec un accès initial réservé aux gouvernements, autorités cyber nationales, opérateurs d'infrastructures critiques et plateformes technologiques, sous conditions d'usage strictes incluant l'authentification multifacteur. Google.org porte son financement total en cybersécurité à plus de 100 millions de dollars.

    Motif de la recommandation :Le programme détaille l'accès restreint à Gemini 3.8 Flash Cyber et CodeMender, ce qui permet de situer les capacités de correction autonome de vulnérabilités et leurs conditions d'accès.

9mois2jourmercredi
9mois1jourmardi
8mois31jourlundi
8mois25jourmardi
8mois24jourlundi
8mois21jourvendredi
8mois20jourjeudi