我貌似找到了 Codex 的平替了
上周我发现了一款让惊艳的 Agent IDE:Orca上周我发现了一款让惊艳的 Agent IDE:Orca
用了一周多,我已经离不开了,Codex 桌面端再也没有打开过了,目前已经成为我主要的 Agent IDE。
说说它的优点:
1. 完全开源!
Codex 桌面端只有 codex 核心是开源的,而且 Codex 越来越卡,bug 是越修越多,看在经常重置用量的情况下,就不继续骂了😆
2. 启动速度很快
使用很流畅,虽然也是基于 Electron 的,但优化的很不错,基本都是秒响应
3. 支持几乎所有的 Agent 框架
Claude Code, Codex, OpenCode, Pi,甚至还支持 Hermes Agent,OpenClaw
4. 支持手机端!!!
它的手机端体验甩 Codex 几条街!搭配 Tailscale 后就没有断连过!你敢信?
5. 支持自动化管理
创建自动化这没什么,但它还能管理 Hermes / OpenClaw 已有的自动化任务
而且还能查看每个自动化任务运行详情,这个太方便了!!
6. 支持编排、计算机控制、本地语音、手机模拟、浏览器等等等一堆功能
还没完,各种功能非常全,而且都很好用,特别是计算机控制,可以和Codex媲美了
总之,除了 Codex 的 Record & Replay 没有,其它地方体验都比 Codex 好!
快去下,不好用你找我,我直播吃!!!
显示更多
我宣布,Otty 是我新的心头好终端工具!太爱了,不愧是 Typora 团队开发的!!太多以人为本的细节了,又好看,还是原生的!!我已经卸载了 cmux 和 Alacritty 了
建议你快去下载用,如果你卸载了算我输!!我直播吃。。。
显示更多
国产模型能用了,但我还不敢用
前段时间,我的 GPT 账户意外被封,被迫开始全面试用国产模型
过去两周,我深度使用了 DeepSeek v4 Pro、Xiaomi Mimo 2.5 Pro、Minimax M3 和 Kimi 2.7,覆盖编码、文字创作和 Hermes Agent 自动化三大场景
以下是真实使用体验
DeepSeek v4 Pro:资深老编辑
文字能力确实顶尖,总结、翻译、摘要、润色都让我非常满意。但代码生成、长时任务和 Agent 工具调用只能算差强人意。它更像一位经验丰富的老编辑——文笔一流,但让他写代码或处理复杂流程,就有点力不从心
Xiaomi Mimo 2.5 Pro:六边形战士
综合能力最均衡,没有明显短板。文字、代码、逻辑都在线,像一个公司里随时能顶上的得力助手,交给他的任务基本都能稳妥完成。
Minimax M3:名校实习生
文字功底不如 DeepSeek,但在长时任务和 Agent 工具调用上表现很稳定。缺点是"智商"偶尔着急,复杂推理会卡壳。像一个名校毕业的实习生——执行力不错,但遇到需要深度思考的问题还得再带一带
Kimi 2.7:准旗舰水准
这是四款中表现最好的,整体能力接近 GPT 5.5 的水准。除了发布第一天有些不稳定,后续更新后体验大幅提升,目前是我最常用的国产模型
国产模型的共同痛点:稳定性
然而,这些模型都有一个通病——输出稳定性不足
以我的 Hermes Agent 为例:我有十几个定时自动化任务,在 GPT 5.5 下可以数月稳定运行
但同样的 Prompt 和任务流交给上述国产模型,几乎每天都会有一两个任务莫名其妙报错
诡异的是,这些报错任务单独手动执行时,又能顺利通过
这种"薛定谔的报错"让我很难完全信任它们处理无人值守的长时任务
我的当前工作流
因此,我对国产模型和 GPT 5.5 采取了不同的信任策略:
一次性、短时任务 → 首选 Kimi 2.7,效率和质量都足够
代码开发、复杂项目、长时自动化任务 → 仍回退到 GPT 5.5,稳定性是底线
简单来说:国产模型我已经敢用,但还不敢完全放手,关键任务仍需人工审查代码和结果,充当最后一道防线。
PS:至于GLM 5.2,我对智普伤透心了,没有好感,故略过
显示更多