OpenAI 推出具备高管否决权和自动暂停机制的 AI 训练安全框架
据其官方博客,OpenAI 发布了一个面向先进 AI 训练的新安全框架。该框架确立了涵盖技术保障、运营管理和事件调查的三大支柱结构。 该框架赋予高级管理人员对训练启动或继续进行的独立否决权。重要的是,任何未在规定时限内得到处理的高优先级安全警报,都会触发自动暂停训练。OpenAI 还实施多层内部审查,要求每项安全提案都附有独立的异议报告,并由研究部门负责人、安全官员和首席科学家进行强制性高级管理层审查。该公司表示,这些指导方针目前正进入内部实施阶段,并将在未来几周持续演进。
Gate News·14 分钟前
