Grok 4.5 不错,在我的链上攻击分析 Agent 上,实测验证了几次,令我满意。之前的版本我是失望的,但 4.5 可以了。
场景:加密货币链上攻击分析,在 Hermes Agent 里做了
@SlowMist_Team 相关 Harness Engineering。
GPT 5.5/5.6,GLM 5.2,Grok 4.5,DeepSeek V4 Pro/GLM 5.1,这是我的满意度梯队(从很好到还行)。为什么没有 Claude 的?已经不是关键必需品了…还一天天搞歧视及封锁…
以模型和 Agents 这样的迭代速度,相关工作真的会越来越没有门槛,门槛以后只会集中在有没有实践上,实践决定了一个人的经验,经验可以影响许多。