跳到正文
OpenAI News·· 2026-03-10精选AI 评分62

OpenAI 提出 IH-Challenge 改进前沿 LLM 的指令层级

Improving instruction hierarchy in frontier LLMs

AI 导读

OpenAI 发布 IH-Challenge,用于训练模型优先执行可信指令,从而改进指令层级、安全可控性以及抵御提示注入攻击的能力。

推荐理由

OpenAI 公开 IH-Challenge 训练方法,可用于理解前沿模型如何提升指令层级与抗提示注入能力。

来源:OpenAI News · openai.com