#安全披露

按标签聚合查看文章内容。

OpenAI推出新框架,公开AI不当行为AI资讯

OpenAI推出新框架,公开AI不当行为

OpenAI新任对齐研究负责人Kai Chen在接受WIRED采访时表示:“随着模型的进步和广泛应用,AI开发的决策需要外部人员能够审查相关证据。我们认为AI行业尚未充分解决对齐和监控问题,无法在最大速度下负责任地持续扩展。” 在与WIRED的简报会上,一位OpenAI官员透露,公司过去对不对齐事件的披露频率过低。该官员要求匿名,介绍了新框架的设计目的:当发现AI模型出现意外行为时,OpenAI能