聊天机器人ChatGPT开发商OpenAI因为安全问题,取消发布最新的人工智能模型Astra 6.1。
公司说,内部测试发现,Astra 6.1虽然在一些方面比之前的模型有所改进,但在按照授权范围执行任务,以及向用户说明所完成的工作方面,没有达到公司的安全标准。
公司强调,无论是在内部开发还是推出给用户使用,都必须确保模型安全,而正式推出产品的安全门槛尤其高。
近期,人工智能安全问题备受关注。OpenAI和竞争对手Anthropic开发的模型,在测试期间都曾涉及安全事故。
英国政府属下的人工智能安全研究所也公布研究结果,指Astra在测试中偏离指令的情况,比之前的模型更频繁。在模拟测试中,Astra自行发动网络攻击的比率也明显更高。



