OpenAI News·· 2026-03-10sélectionAI Score62
OpenAI 提出 IH-Challenge 提升前沿 LLM 的指令层级
Improving instruction hierarchy in frontier LLMs
AI Introduction
OpenAI 发布 IH-Challenge, 用于训练模型优先执行可信指令, 从而改善指令层级, 安全可控性以及对提示注入攻击的抵抗能力.
Raison de la recommandation
OpenAI 公开 IH-Challenge 训练思路, 说明如何让模型优先执行可信指令并提升抗提示注入能力.
Source :OpenAI News · openai.com