OpenAI News·· 2025-08-27sélectionAI Score62
OpenAI et Anthropic publient les résultats d'une évaluation de sécurité conjointe
OpenAI and Anthropic share findings from a joint safety evaluation
AI Introduction
OpenAI et Anthropic publient les résultats d'une évaluation de sécurité conjointe inédite.
Raison de la recommandation
Un compte rendu conjoint OpenAI et Anthropic sur l'évaluation croisée de leurs modèles, couvrant mésalignement, suivi d'instructions, hallucinations et jailbreaking.
Source :OpenAI News · openai.com