Anthropic 和 OpenAI 计划将安全评估人员嵌入实验室,独立性能否保持

Anthropic and OpenAI want to embed safety evaluators. Will they really be independent?

来源 TechCrunch AI 日期 英语原文

Anthropic 和 OpenAI 希望让独立安全评估人员进入其 AI 实验室。研究人员欢迎这种前所未有的访问权限,但警告称,有效监督仍需要透明度、独立性,并最终依靠监管。

Anthropic 和 OpenAI 正计划把独立安全评估人员嵌入各自的 AI 实验室。研究人员认为,进入实验室能够改善对模型安全的观察,但也提醒,评估是否真正有意义,取决于评估者能否保持独立、获得足够透明的信息。相关监督最终可能需要监管制度支持。

对 AI 行业的影响

这可能把 AI 安全评估从发布前的外部检查推进到开发过程内部。若评估者能保有独立权限,实验室的风险发现和问责机制可能更早介入;若访问受公司控制,监督结果的可信度仍会受限。


原文参考

来源:TechCrunch AI · 2026-09-16

Anthropic and OpenAI want to embed independent safety evaluators inside their AI labs. Researchers welcome the unprecedented access, but warn meaningful oversight requires transparency, independence, and eventually regulation.