OpenAI annonce de nouvelles technologies destinées à aider les chercheurs à identifier les contenus générés par ses outils et rejoint le comité directeur de la Coalition for Content Provenance and Authenticity (C2PA) afin de promouvoir des standards industriels.
OpenAI a banni des comptes liés à l'opération d'origine russe « Doppelganger », qui utilisait l'IA pour générer des commentaires anti-Ukraine sur les réseaux sociaux。
Motif de la recommandation :L'article fournit une recette complète d'alignement Constitutional AI avec des modèles ouverts, incluant datasets, modèles et outil de génération à grande échelle.
OpenAI développe un cadre d'évaluation du risque qu'un grand modèle de langage (LLM) aide une personne à créer une menace biologique. Dans une évaluation menée avec des experts en biologie et des étudiants, GPT-4 n'apporte au plus qu'une légère amélioration de la précision en matière de création de menaces biologiques. OpenAI précise que cette amélioration n'est pas assez importante pour être concluante, mais que ce résultat constitue un point de départ pour poursuivre la recherche et la réflexion communautaire.
Motif de la recommandation :OpenAI expose un cadre d'évaluation du risque biologique lié aux LLM et publie les résultats préliminaires sur GPT-4, utiles pour situer les travaux de sécurité.
Hugging Face présente le Hallucinations Leaderboard, une plateforme ouverte évaluant les LLM sur des benchmarks dédiés aux hallucinations via in-context learning。
OpenAI, Anthropic, Google et Microsoft annoncent ensemble un nouveau directeur exécutif pour le Frontier Model Forum ainsi qu'un nouveau fonds de 10 M$ dédié à la sécurité de l'IA.
OpenAI annonce un appel ouvert pour rejoindre son Red Teaming Network, invitant les experts de domaine intéressés par l'amélioration de la sécurité de ses modèles à participer.
Motif de la recommandation :L'article explique comment GPT-4 est utilisé pour l'élaboration des politiques de contenu et les décisions de modération, avec des bénéfices concrets sur la cohérence et la rapidité.
Zama démontre qu'il est possible d'exécuter une partie de l'inférence d'un LLM sur des données chiffrées grâce au chiffrement homomorphe complet (FHE)。
Motif de la recommandation :L'original expose la création d'une instance sectorielle et ses missions, ce qui permet de situer les orientations de gouvernance de l'IA de pointe.
OpenAI annonce un programme de subventions destiné à financer le développement de capacités de cybersécurité assistées par IA pour les défenseurs. L'initiative vise à soutenir les équipes de défense via des financements et d'autres formes d'appui.
OpenAI indique avoir entraîné un modèle qui atteint un nouvel état de l'art en résolution de problèmes mathématiques en récompensant chaque étape de raisonnement correcte (supervision du processus) plutôt qu'en récompensant simplement la réponse finale correcte (supervision du résultat). Outre l'amélioration des performances par rapport à la supervision du résultat, la supervision du processus présente un avantage d'alignement : elle entraîne directement le modèle à produire une chaîne de pensée validée par des humains.
Motif de la recommandation :L'article expose la différence entre supervision du processus et supervision du résultat, ainsi que l'avantage d'alignement qui en découle, ce qui permet de comprendre une voie d'entraînement du raisonnement.
Motif de la recommandation :L'audit externe confirme l'absence de faille critique et le passage de safetensors au statut de dépendance par défaut dans transformers.
OpenAI lance un programme de bug bounty pour faire appel à l'aide du public afin de développer une IA sûre et avancée. L'initiative s'inscrit dans l'engagement d'OpenAI à créer des technologies et services sécurisés, fiables et dignes de confiance.
OpenAI expose son approche pour garantir que les systèmes d'IA sont construits, déployés et utilisés de manière sûre, un point qu'elle juge essentiel à sa mission.
OpenAI a publié un article intitulé Planning for AGI and beyond, affirmant que sa mission est de faire en sorte que l'intelligence artificielle générale。