Aller au contenu
  1. Raspberry Pi Blog62

    Transformer la saisie de texte en actions avec Needle, un LLM de function calling de 14 Mo

    Cactus Compute présente Needle 2, un modèle de function calling de 14 Mo qui transforme des instructions en anglais en actions locales sur un Raspberry Pi 5.

    Motif de la recommandation :Un exemple concret de modèle de function calling de 14 Mo exécuté en local sur Raspberry Pi 5, avec latences et consommation mémoire mesurées.

  1. GitHub Blog · AI & ML83

    GitHub Copilot migre son runtime d'agent vers Rust avec l'aide de Copilot

    GitHub a réécrit le runtime de l'agent Copilot, initialement en TypeScript sur Node.js.

    Motif de la recommandation :Le récit détaillé d'une migration de runtime de 430 000 lignes de TypeScript vers Rust menée par des agents, avec les chiffres de cache, de compaction et de répartition des rôles.

  1. Mistral AI62

    Mistral AI : moderniser un code legacy complexe avec des agents IA

    Mistral AI a migré 40 000 lignes de Fortran 77 vers C++ pour un opérateur énergétique européen.

    Motif de la recommandation :L'article détaille un workflow d'agents structuré avec harnais de parité et documentation préalable, directement transposable à d'autres migrations de code legacy.

  1. OpenAI News60

    OpenAI explique comment intégrer l'agent Codex avec le Codex App Server

    OpenAI présente le Codex App Server, une API JSON-RPC bidirectionnelle qui permet d'intégrer l'agent Codex. Elle prend en charge la progression en streaming。

    Motif de la recommandation :L'article détaille l'API JSON-RPC bidirectionnelle du Codex App Server, utile pour intégrer l'agent Codex dans des applications.

  1. OpenAI News62

    OpenAI fait évoluer PostgreSQL pour supporter 800 millions d'utilisateurs de ChatGPT

    OpenAI explique comment elle a fait évoluer PostgreSQL pour absorber des millions de requêtes par seconde afin de supporter 800 millions d'utilisateurs de ChatGPT. L'article détaille le recours à des réplicas, à la mise en cache, à la limitation de débit et à l'isolation des charges de travail.

    Motif de la recommandation :L'article détaille comment OpenAI fait évoluer PostgreSQL pour des millions de requêtes par seconde, une méthode d'ingénierie transférable aux équipes qui exploitent des bases de données à grande échelle.

Fin de la liste