AI Safety2026-09-10
OpenAI Blog
AI安全大佬Paul Christiano加入OpenAI基金会董事会
OpenAI基金会董事会近日宣布,AI对齐研究领域的重要学者Paul Christiano正式加入,并同时成为其安全与安保委员会成员。Christiano在AI安全领域拥有深厚积累,尤其以参与开创RLHF(基于人类反馈的强化学习)技术而闻名,该技术是现代大模型训练中让AI遵循人类指令、规避有害行为的关键基础。此外,他也长期呼吁建立更严格的安全标准,并推动AI实验室、政策制定者及学术社区之间的协作。
在新职位上,Christiano将为基金会提供AI安全相关的建议,具体包括评估框架的开发、安全协议的实施,以及识别前沿模型可能带来的潜在风险。随着OpenAI持续推进大语言模型和自主智能体等前沿方向,他的专业经验被认为将对OpenAI的技术路线产生重要影响。
这一人事变动正值AI安全问题日益受到监管机构、行业领袖和公众关注之际。AI偏见、虚假信息传播以及模型意外行为等事件频发,让外界对AI治理的呼声越来越高。Christiano的加入,被解读为OpenAI正视这些挑战、并愿意引入外部声音来审视自身假设的一个明确姿态。
Christiano本人对此次任命表示期待,称希望与董事会共同努力,确保AI带来的益处能够被广泛分享,同时尽可能降低潜在风险。他的加入在AI社区内获得不少正面评价,许多人认为这是推动AI朝着更负责任方向发展的重要一步。
随着OpenAI持续扩大模型规模并拓展应用场景,像Christiano这样的安全研究者在引导组织应对未来复杂的伦理与技术挑战方面,将扮演越来越关键的角色。