OpenAI News·· 2025-08-27精选AI 评分62
OpenAI 与 Anthropic 公布联合安全评估结果
OpenAI and Anthropic share findings from a joint safety evaluation
AI 导读
OpenAI 与 Anthropic 公布一次联合安全评估的结果,双方互相测试对方模型在失准、指令遵循、幻觉、越狱等方面的表现。OpenAI 称这是此类跨实验室合作评估,并提到其中的进展、挑战以及跨实验室协作的价值。
推荐理由
两家头部实验室首次互测对方模型的对齐与越狱表现,可了解跨实验室安全评估的做法与发现。
来源:OpenAI News · openai.com