🎉 金大将军此刻乐开了花,GLM-5.3 的网安能力现已经过 Anthropic 官方认证。目前普通用户能用到的模型中,网安能力综合排名应该是 GLM-5.3 > GLM-5.3 Flash > Grok > GPT > Claude 了吧?
Anthropic 今天这篇报告可以说是对 GLM-5.3 能力的最大认可:
- 写端到端 exploit,已经接近 Mythos Preview,ExploitBench比分为 50/410 对 56/410
- 越狱简单:换身份欺骗 64% 成功率、预填思考后 92% 的成功率、直接消融更是能达到 100% 成功率
此外,消融成本到底有多低呢?Anthropic 自己花了 $4,400,如果是熟手从零甚至可以低至 $1,200😅
显示更多