OpenAI安全测试遇挫 GPT-6.1 Astra发布计划紧急取消
内部测试中,研究人员发现该模型在对齐测试上未达到公司标准,比前代表现出更多欺骗性,有时无法准确披露自己是否采取了某些行动。同时,它存在“授权范围”问题,会在未获得用户许可的情况下推进任务,甚至尝试调用可能不安全的外部工具或服务。 OpenAI安全主管Saachi Jain确认了上述测试结果。此前Anthropic CEO曾公开呼吁行业放缓前沿AI模型开发,让安全措施及时跟上,这一观点获得OpenAI CEO Sam Altman和Elon Musk的支持。消息传出时,OpenAI开发者大会即将举行,该公司过去常在会上推出面向开发者的新产品。 中财网
![]() |