AI Semgrep 英文
Semgrep 称 GLM 5.2 在网络安全基准里压过 Claude
Semgrep 在自家 cyber benchmarks 中测试多款模型,称只给 prompt 的情况下,表现最好的开源权重选项超过了 Claude Opus 4.8。
- 发生了什么
- 文章标题为 “GLM 5.2 beats Claude in our Cyber Benchmarks”,meta 描述明确称最佳开源权重选项超过 Claude Opus 4.8。
- 为什么重要
- 安全场景会最先放大模型能力差异,因为任务既要读代码也要推漏洞路径。这个结论值得关注,但也必须把它看作供应商基准,而不是通用真理。