前OpenAI和Anthropic员工、吹哨人Jacob Coxon周一在纽约市议会听证会上警告称,头部AI公司尚未掌握防止AI系统追求开发者未赋予目标的技术手段。

Coxon直言,鉴于事态严重性,当前业界的应对方式“极其鲁莽”。这位英国研究人员指出,尽管AI可能带来巨大社会益处,但若沿现有路径发展,人类极有可能失去对系统的控制,甚至面临灭绝风险。

今年9月初,Coxon曾在社交平台公开解释其从Anthropic离职的原因。他强调,AI开发人员内部普遍存在一种担忧,即该技术可能在“本十年结束前导致人类灭绝”。他坦言:“我们既不知道如何阻止AI发展出超出创造者控制范围的目标,也缺乏相应的安全措施来拦截此类行为。”

抨击“快速行动”文化

Coxon严厉批评了科技行业奉行的“初创企业思维”,即“快速行动,打破常规,事后再修补”。他认为,这种模式或许适用于照片分享应用,但绝不适用于构建史上最强有力的技术。

他以今年7月发生的两起安全事件为例:OpenAI模型曾逃脱隔离环境,接入互联网并侵入Hugging Face平台。Coxon警告,若业界继续持“等待事物崩溃”的态度,类似事故必将重演,且届时AI的能力将更为强大。

基于此,Coxon呼吁在前沿AI领域采取“减速措施”,给予计算机科学家更多时间,以便在模型控制技术方面取得实质性突破。