OpenAI News·· 2024-07-24AI 评分40
OpenAI 用规则奖励(RBRs)改进模型安全行为
Improving Model Safety Behavior with Rule-Based Rewards
AI 导读
OpenAI 开发并应用了基于规则奖励(RBRs)的新方法,让模型在无需大量人工数据采集的情况下对齐到安全行为。该方法旨在提升模型的安全表现,减少对人工标注数据的依赖。
来源:OpenAI News · openai.com
Improving Model Safety Behavior with Rule-Based Rewards
OpenAI 开发并应用了基于规则奖励(RBRs)的新方法,让模型在无需大量人工数据采集的情况下对齐到安全行为。该方法旨在提升模型的安全表现,减少对人工标注数据的依赖。
来源:OpenAI News · openai.com