Aller au contenu
12mois10jourmercredi
  1. OpenAI News22

    OpenAI renforce la cyber-résilience face à l'avancée des capacités de l'IA

    OpenAI investit dans des protections et des capacités défensives renforcées à mesure que ses modèles gagnent en puissance en cybersécurité. L'entreprise détaille sa méthode d'évaluation des risques, les limites imposées aux usages abusifs et sa collaboration avec la communauté de la sécurité pour renforcer la cyber-résilience.

12mois3jourmercredi
12mois1jourlundi
11mois27jourjeudi
11mois20jourjeudi
11mois19jourmercredi
  1. OpenAI News62

    OpenAI 发布 GPT-5.1-Codex-Max 系统卡

    OpenAI 发布 GPT-5.1-Codex-Max 系统卡, 说明该模型实施的安全措施. 系统卡涵盖模型层面的缓解手段, 包括针对有害任务和提示注入的专项安全训练, 以及产品层面的缓解手段, 如 agent 沙箱和可配置的网络访问.

    Motif de la recommandation :公开 GPT-5.1-Codex-Max 的安全措施细节, 包括针对有害任务与提示注入的专项训练及沙箱, 网络访问配置等产品级缓解手段.

11mois13jourjeudi
11mois12jourmercredi
11mois7jourvendredi
11mois6jourjeudi
10mois30jourjeudi
10mois29jourmercredi
  1. OpenAI News68

    OpenAI lance gpt-oss-safeguard, un modèle de raisonnement à poids ouverts pour la classification de sécurité

    OpenAI présente gpt-oss-safeguard, un modèle de raisonnement à poids ouverts destiné à la classification de sécurité。

    Motif de la recommandation :Un modèle de raisonnement à poids ouverts dédié à la classification de sécurité, qui permet aux développeurs d'appliquer et d'itérer leurs propres politiques.

10mois28jourmardi
10mois27jourlundi
  1. OpenAI News60

    OpenAI améliore les réponses de ChatGPT dans les conversations sensibles

    OpenAI a collaboré avec plus de 170 experts en santé mentale pour améliorer la capacité de ChatGPT à reconnaître la détresse。

    Motif de la recommandation :L'original expose la collaboration avec plus de 170 experts en santé mentale et la baisse des réponses dangereuses, ce qui permet de juger de l'orientation de ChatGPT sur les sujets sensibles.

10mois14jourmardi
10mois9jourjeudi
10mois7jourmardi
10mois1jourmercredi
9mois30jourmardi
9mois29jourlundi
9mois26jourvendredi
9mois17jourmercredi
  1. OpenAI News62

    OpenAI et Apollo Research développent des évaluations pour détecter et réduire la dissimulation dans les modèles d'IA

    Apollo Research et OpenAI ont développé des évaluations pour la mauvaise alignement cachée。

    Motif de la recommandation :OpenAI et Apollo Research présentent des évaluations du comportement de dissimulation et une méthode précoce pour le réduire, ce qui éclaire les risques d'alignement des modèles de pointe.

9mois16jourmardi
9mois12jourvendredi
9mois11jourjeudi
9mois5jourvendredi
  1. OpenAI News60

    OpenAI explique pourquoi les modèles de langage hallucinent

    OpenAI publie une nouvelle recherche expliquant pourquoi les modèles de langage hallucinent. Les résultats montrent que l'amélioration des évaluations peut renforcer la fiabilité。

    Motif de la recommandation :L'article explique les causes des hallucinations des modèles de langage et propose des pistes d'évaluation pour améliorer la fiabilité et l'honnêteté.

9mois2jourmardi
8mois27jourmercredi