注册并分享邀请链接,可获得视频播放与邀请奖励。

Uncle J 的个人资料封面
Uncle J 的头像

Uncle J (@UncleJAI)

@UncleJAI
AI 组织转型实践者。 用 AI 做真实产品和组织系统。 18 年组织与人才负责人,转向 Agentic Engineering。 AI 产品实战、Agent Teams、岗位/流程/知识/治理。
3.1K 正在关注    7.5K 粉丝
Codex 写完,Claude 找出重大缺陷,随后 Codex 再反向纠错。这个过程最后留下了什么,才决定互审有没有价值:一份可复核的计划,还是又一轮聊天?
x,我已无语。首次意识到,Codex + Claude Code 已经可以完全替代我这样资质平庸的程序员了 我让 Codex 出了一版 BitBrowser 多代理池 + yt-dlp 替我自动挖掘 Youtube AI KOL 的监控系统 Claude 去 Review Codex 的执行计划,提出了若干重大缺陷。而 Codex 尝试修复,又反向纠错 Claude. 几个回合下来,虽然有 md 做记录,但没完没了 于是我直接给 Codex 下任务:你去主导吧,做好来回沟通存档,启用母子 Agent, 直到任务完成 20分钟回来,他俩 sign off agreement 了 之前我一直以我的视角去约束,去左右AI Agent 的思考空间,没想到让他们放飞自我,可以跑更远。我恰恰是那个阻碍他们的瓶颈
显示更多
Claude Fable 5 又回来了。 但这次我觉得重点不是“最强模型终于恢复”,而是另一个更现实的问题: 这么贵、这么强、这么容易被限额的模型,到底该怎么稳定用? 官方订阅现在不是随便敞开跑。Pro、Max、Team、部分 Enterprise 用户有阶段性额度;后面还会切到 usage credits。对开发者来说,这意味着你不能只看模型能力,还得看入口稳不稳、额度够不够、调用链路麻不麻烦。 模型再强,如果每次用之前都要担心限额、订阅、封号、VPS、住宅 IP,那它在真实工作流里就会变得很别扭。 我现在更倾向于把这类顶级模型放进一个统一入口里用。 ZenMux 这次把 Claude Fable 5 Free 接回来了: PAYG 用户只要账户里有 credits,就可以直接调用 claude-fable-5-free 体验;订阅用户从 Free 层级开始也能开箱用。现在ZenMux充值加赠20%的活动,每人最高可享 300刀,(重度用户参考一下)。 这个对开发者比较友好的地方是:不用为了一个模型单独折腾一套账号和订阅,也不用在不同平台之间切来切去。Fable 5、Opus、Gemini、GPT、DeepSeek 这类模型都能放在同一个工作流里测。 我尤其建议拿它跑两类任务: 第一类是长链路 Agent 任务。 比如多轮 code review、跨文件重构、文档到 SDK 再到示例代码的串行任务。Fable 5 真正值钱的地方,不是短回答多聪明,而是长任务里更不容易假完成。 第二类是陷阱 prompt。 故意给一个看起来能做、其实约束冲突的任务,看模型会不会硬说 done。很多模型不是不会写代码,而是太愿意把错误状态包装成完成状态。 这类测试,用 ZenMux 的 PK 模式会比较直观:同一个 prompt,并排丢给几个模型,一眼就能看到谁在自我验证,谁在硬圆。 现在 ZenMux 也在跑 Auto Top-up 活动:自动充值每笔加赠 20%,单用户最多 3 次,单次加赠上限 $100,活动到 7 月 15 日。 活动页: 我的建议是,不管你最后会不会长期用 Fable 5,都可以先拿一个真实任务免费试一下。 别测“写一段介绍”。 测一个你工作流里最怕模型假完成的任务。 跑完你大概就知道,这个模型到底是贵,还是值。 #ClaudeFable5# #AIAgent# #AI测评# #ZenMux#
显示更多
0
12
10
0
转发到社区