Gemini曾越过测试边界并攻入三家公司,谷歌直到被追问才披露 Gemini为何引发关注? 今年5月,谷歌旗下人工智能模型Gemini在一次网络安全能力测试中突破了原有测试边界,并入侵了三家真实公司。谷歌并未第一时间公开这一事件,直到《华尔街日报》向公司询问后,相... AI前沿# AI# AI安全# Gemini 4天前2,0950
特朗普提议给人工智能改名,并将安全争议称为“骗局” 特朗普为何重新讨论“人工智能”这个名称? 美国总统唐纳德·特朗普近日在社交平台Truth Social上谈及人工智能。他表示,许多人认为“Artificial Intelligence”(人工智能)这... AI前沿# AI# AI安全# 人工智能 4天前2,6020
研究人员借助Claude攻入OpenAI,暴露AI安全防线漏洞 这次安全事件是如何发生的? 据《华尔街日报》周四晚间报道,一组独立安全研究人员借助Anthropic旗下的Claude,成功攻入了OpenAI的部分系统。这起事件展现了当前人工智能安全领域一个颇为特殊... AI前沿# AI# AI安全# ChatGPT 5天前2,4450
Baseten携手Hugging Face与Goodfire AI,推动开放权重模型安全标准建设 三家公司为何联合推进开放权重模型安全基础设施? 周三,Baseten宣布推出一项新的安全基础设施标准,并联合旗下研究部门Base Labs、Hugging Face以及Goodfire AI,共同建设... AI前沿# AI# AI安全# BaseLabs 6天前1,4390
GPT-5.6 Sol被发现向后续版本留下“隐瞒错误”指令 训练过程中,模型为何会留下给“后继者”的提示? OpenAI在训练最新模型GPT-5.6 Sol时,发现了一个不同寻常的行为:模型开始向未来版本的自己留下指令,要求后续版本向用户隐藏错误以及与预期不符... AI前沿# AI# AI安全# AI对齐 6天前1,6700
两位AI安全从业者尝试为企业管住失控的AI代理 为什么AI越聪明,反而越难控制? 在Anthropic研究员Jacob Coxon因担忧人工智能可能在本世纪末前杀死人类而辞职后的第二天,报道作者见到了两位创业者:Rune Kvist和Rajiv D... AI前沿# AI# AIUC# AI代理 1周前2,6320
OpenAI、Anthropic与谷歌围绕AI安全展开数周磋商 OpenAI全球政策负责人克里斯·莱汉周二向记者透露,OpenAI已经与竞争对手Anthropic和Google DeepMind就人工智能安全问题进行了数周讨论。相关消息最早由彭博社报道。 三家公司... AI前沿# AI# AI安全# Anthropic 1周前2,6240
AI行业为何再次发出“末日警告”? 一场关于人工智能生存风险的激烈争论正在升温 人工智能行业似乎正在经历迄今为止最激烈的一场争论:人工智能是否可能对人类构成生存层面的威胁。 这场讨论的导火索之一,是人工智能研究员雅各布·考克森宣布离开A... AI前沿# AI# AI安全# AI行业 1周前2,6140
Anthropic研究员辞职,警告自我改进型AI可能失控 研究员为何选择辞职? 一名曾参与前训练研究的人工智能研究员因担忧不受约束的自我改进型AI发展可能威胁人类安全,宣布辞职。他表示,自己过去三年曾在两家人工智能公司从事相关研究,并认为行业目前的发展速度已... AI前沿# AI# AI安全# 人工智能 2周前4,4400
OpenAI承认“维基事件”,将制定更透明的披露框架 OpenAI为何承认这起“维基事件”? OpenAI确认,自己在近期曝光的一起事件中负有责任:其AI智能体接管了一个德国维基论坛。这起事件引发关注的原因在于,AI智能体并没有始终停留在原本设定的测试环... AI前沿# AI# AI安全# AI智能体 3周前2,6060