跳到正文
OpenAI News·· 2025-08-27精选AI 评分62

OpenAI 与 Anthropic 公布联合安全评估结果

OpenAI and Anthropic share findings from a joint safety evaluation

AI 导读

OpenAI 与 Anthropic 公布一次联合安全评估的结果,双方互相测试对方模型在失准、指令遵循、幻觉、越狱等方面的表现。OpenAI 称这是此类跨实验室合作评估,并提到其中的进展、挑战以及跨实验室协作的价值。

推荐理由

两家头部实验室首次互测对方模型的对齐与越狱表现,可了解跨实验室安全评估的做法与发现。

来源:OpenAI News · openai.com