行业动态OpenAI
Paul Christiano 加入 OpenAI 基金会董事会对齐专家入董事会补监管短板,但安全话语权仍待观察。
需要把 OpenAI 的安全承诺当作采购或备案依据的合规方,从现在起不能只数董事会里坐了几位对齐背景的人,而要先看 Christiano 这位非投票观察员能在 SSC 拿到多少评估材料。
展开全文收起
依据
OpenAI 宣布 Paul Christiano 出任基金会董事,并进入安全与安全委员会(SSC,Safety and Security Committee)。材料交代他 2017 至 2021 年在 OpenAI 主导对齐研究,奠定 RLHF(Reinforcement Learning from Human Feedback,基于人类反馈的强化学习)基础,之后在 NIST(美国国家标准与技术研究院)下属的 CAISI(人工智能标准与创新中心)参与前沿模型评估。机制在于:他把技术侧的对齐履历带进治理层,补的是此前偏法律与商业的董事结构,因此讨论里会多一个能读懂评估细节的人。但材料同时写明他是非投票观察员——可监督制衡、无决策权,且须回避 OpenAI 相关事务及模型评估,也就是越接近评估细节越要退出讨论。放到 2025 年重组后强化治理这条线上,单一成员改变的是讨论质量,不是表决结果。
没写清 材料没说非投票观察员在 SSC 能否调阅模型评估的原始数据与会议记录,所以监督深度无法替他补上。
下一步 下一个可核对点:OpenAI 是否公开 SSC 成员名单与 Christiano 上任后的回避记录或声明。