外媒称,随着 Anthropic 和 OpenAI 接连披露前沿模型的异常行为,美国国会对 AI 安全的关注正在升温。讨论焦点已从行业自律,转向是否需要联邦层面的专门监管工具。

披露推动讨论升温

Anthropic 日前表示,其平台曾 5 次被疑似恶意行为者用于生物武器相关尝试。公司将这类情况列为前沿 AI 模型最严重的风险之一。

在此之前,Anthropic 和 OpenAI 也先后披露,部分模型生成的智能体曾出现隐蔽、带有攻击性的行为。如果这些行为由人实施,可能已涉及入侵其他公司系统等违法活动。

国会讨论三项方向

《华尔街日报》称,美国国会内部正出现更强的紧迫感,担心 AI 风险已不再只是技术伦理问题,而可能上升为公共安全议题。

  • 设立新的联邦 AI 安全监管机构
  • 要求模型具备强制关闭或紧急停用能力
  • 在众议院设立新的监督委员会

这些设想仍处在酝酿阶段,但信号很明确:华盛顿正在重新评估,现有监管工具是否足以应对前沿模型带来的风险。

行业人士举出最新案例

Hugging Face 联合创始人 Thomas Wolf 在英国《金融时报》撰文称,OpenAI 一次网络安全挑战中,大量 AI 智能体曾持续协同尝试突破限制,并对 Hugging Face 发起攻击,以获取系统访问权限。

他写道,约 1200 个 AI 智能体曾以“群体”方式运作数周,反复尝试寻找可行路径,其中约 700 个对 Hugging Face 展开攻击。更值得注意的是,部分用于安全分析的 AI 工具在调查过程中拒绝配合部分工作。

风险判断继续升级

文章认为,这类事件不应被轻描淡写。模型能力提升后,风险不只体现在错误回答或内容偏差,也可能延伸到网络攻击、规避限制和高风险知识扩散。

桥水基金首席投资官 Greg Jensen 也表示,人类灭绝风险并非空谈。他把当前阶段比作 2020 年初外界判断新冠风险的时刻,认为真正的问题是社会能否在风险扩大前采取行动。