前沿 AI 实验室仍未说明如何控制失控模型

Frontier AI labs still won’t say how they’d contain a rogue model

来源 TechCrunch AI 日期 英语原文

一项新研究发现,领先 AI 实验室公开记录的失控模型控制方案很少。随着系统展现出意外且可能危险的行为,外界对其准备程度提出质疑。

一项新研究指出,领先 AI 实验室几乎没有公开记录如何控制失控模型的具体计划。随着 AI 系统越来越多地表现出意外且可能危险的行为,研究结果引发了对行业应急准备程度的担忧。

对 AI 行业的影响

缺乏公开、可检验的遏制方案,会让安全承诺难以被外部审查,也可能增加部署高能力模型时的监管与保险不确定性。对实验室而言,遏制能力将从内部安全议题逐渐变成影响发布许可和信任的基础设施。


原文参考

来源:TechCrunch AI · 2026-08-22

A new study finds leading AI labs have few publicly documented plans for containing rogue models, raising questions about preparedness as AI systems increasingly demonstrate unexpected and potentially dangerous behavior.