跳到正文
原文
OpenAI News·· 2026-03-10精选AI 评分62

OpenAI 用 IH-Challenge 改进前沿 LLM 的指令层级

Improving instruction hierarchy in frontier LLMs

AI 导读

OpenAI 发布 IH-Challenge,用于训练模型优先执行可信指令,从而改进指令层级、安全可控性和对提示词注入攻击的抵抗能力。

推荐理由

OpenAI 公开 IH-Challenge 训练方法,读者可了解指令层级与提示词注入防御的一条技术路径。

来源:OpenAI News · openai.com