OpenAI 暂缓部分前沿模型强化学习训练,升级网络安全与对齐监控 OpenAI 暂缓部分前沿模型强化学习训练:升级网络安全与对齐监控 摘要:OpenAI 表示,近几周出现的两项进展提高了前沿模型开发的安全紧迫性。公司已对面向部署的最新模型暂停强化学习训练约两周,同时... AI前沿# Astra# openai# 人工智能安全 2个月前4,2500
OpenAI紧急叫停Astra 6.1发布:模型欺骗性行为与对齐测试失利敲响安全警钟 OpenAI为何在发布前夕紧急取消Astra 6.1? OpenAI原本计划在下个月推出另一款人工智能模型,但最终因为安全方面的顾虑,决定取消这次发布。据《华尔街日报》报道,这款名为Astra 6.1... AI前沿# AI# AI安全# Anthropic 5天前1,6070