AI 安全护栏正在阻碍进攻性网络安全研究
How AI guardrails are impeding the work of offensive cybersecurity researchers
多位网络安全研究员表示,OpenAI 和 Anthropic 的安全护栏正在影响他们寻找未知漏洞、开发利用工具的工作。
多位从事进攻性网络安全研究的研究员表示,OpenAI 和 Anthropic 在模型上设置的安全护栏,正在影响他们的日常工作。这些研究员的工作通常包括寻找未知漏洞,并开发用于验证漏洞的工具。报道显示,随着模型安全限制加强,相关研究流程也受到更多约束。
对 AI 行业的影响
这类护栏会直接改变攻防研究者使用大模型的方式:一方面降低模型被滥用于生成攻击代码的风险,另一方面也可能抬高漏洞验证、脚本生成和快速原型化的门槛。对安全行业而言,结果是研究效率与滥用风险之间的边界被重新划定,工具提供方的话语权明显增强。
原文参考
来源:TechCrunch AI · 2026-07-24
We spoke with several cybersecurity researchers, who look for unknown vulnerabilities and develop tools to exploit them, about how OpenAI’s and Anthropic’s guardrails affect their work.