Aller au contenu
12mois5jourjeudi
  1. OpenAI News70

    OpenAI 发布 o1 系统卡

    OpenAI 发布 o1 系统卡, 说明在发布 o1 和 o1-mini 之前开展的安全工作, 包括外部红队测试以及依据 Preparedness Framework 进行的前沿风险评测.

    Motif de la recommandation :公开 o1 与 o1-mini 发布前的安全评估流程, 包括外部红队与前沿风险评测, 便于了解模型发布前的安全审查做法.

11mois21jourjeudi
11mois7jourjeudi
10mois15jourmardi
10mois1jourmardi
9mois16jourlundi
8mois8jourjeudi
7mois24jourmercredi
7mois17jourmercredi
  1. OpenAI News32

    Prover-Verifier Games améliorent la lisibilité des sorties de modèles de langage

    OpenAI présente les Prover-Verifier Games, une méthode qui améliore la lisibilité des sorties des modèles de langage en les rendant plus claires et plus faciles à vérifier pour les humains comme pour les machines. Cette approche vise à renforcer la confiance dans les solutions d'IA en s'appuyant sur un jeu entre un prouveur et un vérificateur.

7mois10jourmercredi
6mois27jourjeudi
6mois20jourjeudi
6mois13jourjeudi
6mois8joursamedi
6mois6jourjeudi
5mois30jourjeudi
5mois21jourmardi
5mois8jourmercredi
5mois7jourmardi
5mois1jourmercredi
4mois20joursamedi
2mois14jourmercredi
1mois31jourmercredi
  1. OpenAI News62

    OpenAI construit un système d'alerte précoce pour les menaces biologiques assistées par LLM

    OpenAI développe un cadre d'évaluation du risque qu'un grand modèle de langage (LLM) aide une personne à créer une menace biologique. Dans une évaluation menée avec des experts en biologie et des étudiants, GPT-4 n'apporte au plus qu'une légère amélioration de la précision en matière de création de menaces biologiques. OpenAI précise que cette amélioration n'est pas assez importante pour être concluante, mais que ce résultat constitue un point de départ pour poursuivre la recherche et la réflexion communautaire.

    Motif de la recommandation :OpenAI expose un cadre d'évaluation du risque biologique lié aux LLM et publie les résultats préliminaires sur GPT-4, utiles pour situer les travaux de sécurité.

1mois16jourmardi