智谱 GLM-5.3 安全争议:越狱测试引发行业讨论
Anthropic 发文批评 GLM-5.3 安全防线脆弱,安全研究者将其视为低成本越狱测试资源,引发评测标准讨论。
争议起因
Anthropic 发文指出 GLM-5.3 安全防线可被诱导编写攻击脚本。安全研究者认为这恰恰说明可作为低成本越狱测试工具。
评测标准分歧
不同公司对模型安全的定义和测试标准差异巨大,导致评测结果不可比,开发者难以判断真实安全水位。
行业启示
模型安全是持续对抗过程,标准化的安全评测框架和第三方审计机制是行业迫切需求。
DISCUSSION
文章讨论
0 条评论
