Aller au contenu
5mois7jourmardi
5mois1jourmercredi
4mois20joursamedi
4mois16jourmardi
4mois4jourjeudi
3mois21jourjeudi
2mois26jourlundi
2mois23jourvendredi
2mois14jourmercredi
2mois1jourjeudi
  1. Hugging Face Blog65

    Constitutional AI avec des LLM ouverts : recette complète de Hugging Face

    Hugging Face publie une recette de bout en bout pour appliquer le Constitutional AI (CAI) aux modèles ouverts。

    Motif de la recommandation :L'article fournit une recette complète d'alignement Constitutional AI avec des modèles ouverts, incluant datasets, modèles et outil de génération à grande échelle.

1mois31jourmercredi
  1. OpenAI News62

    OpenAI construit un système d'alerte précoce pour les menaces biologiques assistées par LLM

    OpenAI développe un cadre d'évaluation du risque qu'un grand modèle de langage (LLM) aide une personne à créer une menace biologique. Dans une évaluation menée avec des experts en biologie et des étudiants, GPT-4 n'apporte au plus qu'une légère amélioration de la précision en matière de création de menaces biologiques. OpenAI précise que cette amélioration n'est pas assez importante pour être concluante, mais que ce résultat constitue un point de départ pour poursuivre la recherche et la réflexion communautaire.

    Motif de la recommandation :OpenAI expose un cadre d'évaluation du risque biologique lié aux LLM et publie les résultats préliminaires sur GPT-4, utiles pour situer les travaux de sécurité.

1mois29jourlundi
1mois26jourvendredi
1mois16jourmardi
12mois14jourjeudi
  1. OpenAI News62

    OpenAI提出弱到强泛化 :用弱监督者控制强模型

    OpenAI提出一个面向超级对齐的新研究方向, 并给出初步结果 :能否利用深度学习的泛化特性, 用较弱的监督者去控制更强的模型. 该方向将弱到强泛化作为实现超级对齐的潜在路径.

    Motif de la recommandation :OpenAI提出弱监督强模型的对齐研究方向, 并给出初步结果, 可供关注超级对齐路径的读者了解其问题设定.

10mois26jourjeudi
10mois25jourmercredi
10mois3jourmardi
9mois29jourvendredi
9mois25jourlundi
9mois19jourmardi
8mois15jourmardi
8mois2jourmercredi
7mois26jourmercredi
7mois21jourvendredi
6mois26jourlundi
6mois1jourjeudi
5mois31jourmercredi
  1. OpenAI News78

    OpenAI améliore le raisonnement mathématique par la supervision du processus

    OpenAI indique avoir entraîné un modèle qui atteint un nouvel état de l'art en résolution de problèmes mathématiques en récompensant chaque étape de raisonnement correcte (supervision du processus) plutôt qu'en récompensant simplement la réponse finale correcte (supervision du résultat). Outre l'amélioration des performances par rapport à la supervision du résultat, la supervision du processus présente un avantage d'alignement : elle entraîne directement le modèle à produire une chaîne de pensée validée par des humains.

    Motif de la recommandation :L'article expose la différence entre supervision du processus et supervision du résultat, ainsi que l'avantage d'alignement qui en découle, ce qui permet de comprendre une voie d'entraînement du raisonnement.

5mois23jourmardi
  1. Hugging Face Blog67

    Hugging Face, EleutherAI et Stability AI font de safetensors le format par défaut après un audit de sécurité externe

    Hugging Face, EleutherAI et Stability AI ont commandé un audit de sécurité externe de la bibliothèque safetensors。

    Motif de la recommandation :L'audit externe confirme l'absence de faille critique et le passage de safetensors au statut de dépendance par défaut dans transformers.

5mois22jourlundi
4mois11jourmardi
4mois5jourmercredi
3mois30jourjeudi
3mois2jourjeudi
2mois24jourvendredi