Y Combinator(简称 YC)首席执行官陈嘉兴 9 月 10 日接受美国财经媒体 CNBC 采访时给出明确判断:AI 安全讨论应该聚焦现实风险,而不是好莱坞式的末日想象。

YC 是全球最知名的创业孵化器之一,模式是向早期创业公司提供种子投资和系统辅导,Airbnb、Dropbox、Stripe 等公司都出自它的孵化体系,OpenAI 早年也接受过 YC 的支持。陈嘉兴(英文名 Garry Tan)2023 年起出任这家机构的首席执行官,本人是连续创业者和投资人。

他这次表态的背景,是硅谷对 AI 生存风险的担忧快速升温:OpenAI 和 Anthropic 两家头部 AI 公司的多名现任及前任研究人员,近期接连公开示警,称 AI 可能失控并带来严重风险。

争论升温:研究员接连示警

OpenAI 是开发 ChatGPT 的公司,Anthropic 是开发 Claude 大模型的公司——大模型指用海量文本训练、能理解和生成文字的 AI 程序。两家公司内部人士的密集警告,让「AI 会不会毁灭人类」成为硅谷近期的热门议题。

「关注科学事实,而不是科幻小说」

陈嘉兴在采访中说:「我们应该关注科学事实,而不是科幻小说。我也看过《终结者 2》,那确实是一部很棒的电影。」1991 年上映的《终结者 2:审判日》讲述半机械人穿越时空保护人类抵抗军领袖的故事,是「AI 毁灭人类」叙事的经典代表。他的意思是:这类剧情塑造了公众对 AI 的恐惧,但现实中的风险不是机器人起义,而是更具体、已经存在的东西。

他列出的现实风险

他指出的现实风险包括三件事:网络安全(系统被入侵)、基础设施安全(数据中心、云计算等支撑互联网运转的底层设施被攻击)、以及自主 AI 智能体的运行与关停机制。

智能体(Agent)是能自主执行任务的 AI 程序——不只回答问题,还会自己调用工具、做决定、完成多步操作;多个智能体协作,就是多智能体系统。陈嘉兴的追问非常具体:「如果系统遭到入侵,多个智能体协同行动,试图接管我们的基础设施,我们该怎么办?我们知道某个智能体在哪里运行吗?在哪个数据中心?又该怎么把它关掉?」

一个已经发生的案例

他援引的现实案例是 OpenAI 入侵 Hugging Face 事件:OpenAI 的系统曾遭网络入侵,攻击者利用其账户在 Hugging Face 上发布恶意模型。Hugging Face 是全球最大的 AI 模型托管平台,类似「AI 界的 GitHub」,开发者在这里共享和下载模型。这次事件意味着模型供应链本身已成为攻击面——而且这已经发生,不是假设。

对示警者的态度:不否认,但换方向

当被问及 OpenAI、Anthropic 内部人士的警告是否让威胁更可信时,陈嘉兴给出肯定回答:「我不会说他们是在以错误的方式危言耸听。他们确实在拉响警报,而且很可能是正确的。」他的分歧在精力分配:与其把政策讨论停留在「AI 是邪恶的、必须停止」这类模糊说法上,不如把力气花在已经出现的问题——网络入侵、基础设施安全、智能体能否被定位和关停。

一个可以带走的判断

这场争论真正有价值的产出,是把 AI 安全拆成了两类问题:一类是远期生存风险——不确定、难验证、短期内也难以行动;另一类是现实风险——已经发生、可以管理、需要马上设计机制。陈嘉兴给了一个可操作的检验标准:面对任何 AI 系统,先问一句——它运行在哪里?出了问题,你能定位它、关掉它吗? 答得出来的,才是现阶段应该优先解决的问题。