注册并分享邀请链接,可获得视频播放与邀请奖励。

与「HermesAgent」相关的搜索结果

HermesAgent 贴吧
一个关键词就是一个贴吧,路径全站唯一。
创建贴吧
用户
未找到
包含 HermesAgent 的内容
POLO问一问大家,Fable5 50 美元你觉得贵不贵? Anthropic 6 月 9 号把 Claude Fable5 推上线, Mythos5 共用底层,戴了安全护栏才敢公开发布。 社区都在说贵贵贵。50 美元/M 输出,刷一刷X满屏吐槽。 我敢说吐槽贵的人里,10 个有 9 个没真跑过 Fable5。 贵不贵这个判断,应该建立在它到底能干多少事的基础上,不是建立在每 M 50 美元这个数字上。Fable5 主打的卖点是任务越长越复杂,领先越明显,不是短回答更聪明。这个定位决定了,它值不值的问题,跟跑多长的任务强相关 ⭐ 我让 Hermes Agent 跑了几轮真任务,印象最深的是 code review。一坨 2000 行的 Python 单体文件,丢给 Sonnet 4.5 跟 Fable5 同一个 prompt 看差异。Sonnet 在第 12 轮反馈开始漏上下文,提的建议开始重复前面说过的点。Fable5 跑到第 18 轮还能精准引用文件第 487 行的一个 import,告诉我这个 import 在新的拆分方案里应该挪到哪里去。这种差距不是"聪明 5%"的差距,是能不能用的差距。 第二个测的是多 agent 串行。让三个 subagent 接力:第一个写 API 文档,第二个基于文档写 SDK,第三个基于 SDK 写示例代码。Sonnet 链在第二轮就出现指令漂移,第三个 subagent 完全不知道第二个为什么这么设计。Fable5 链全程稳,三个 subagent 之间引用关系清晰,最后产物不需返工。 第三个是文档综述。给 30 篇技术博客,让 AI 提炼成一篇 5000 字的综述,对引用源做交叉验证。Fable5 的引用准确率明显高于 Sonnet,幻觉少一截。 这三个 case 都是长任务加真实场景,刚好打在 Fable5 的主场。短问答、单步工具调用这种,Fable5 没比 Sonnet 强多少,甚至偶尔还慢一点。所以50 美元贵不贵的答案不是非黑即白,跑短任务,确实贵得离谱;跑长任务,省心就是省钱 🎨 Fable5 直接走 Anthropic 官方 API 用得起的人不多,ZenMux 接了限时充值返赠通道,一个账号能调 200+ 模型,不限 RPM 不限流。我没充值之前是担心被割韭菜,看完文档逻辑是真聚合不是套壳才决定试试。 Fable5 这代模型,真正变的是 AI Agent 的稳定性边界,不是单点能力。把它当 Sonnet 用,50 美元贵得你想骂人。把它当 orchestrator 用,让它跑 4 小时不掉链子,50 美元等于给团队请了一个不用交社保的高级工程师。 链接在此 想上手跑评测可以看下 ZenMux 现在 PAYG 限时返赠,充 20 美元送 10 美元、充 50 美元送 30 美元,一周内有效。一个账号跑全平台 200+ 模型,不限 RPM 不限流,跑 Fable5 长任务刚好合适。 我个人订阅的是他们 Builder 计划,20 美元月固定预算,能调 ClaudeCode / Codex / OpenClaw 这一票 Coding Agent 也能用,AI 保险赔付是加分项,真出问题不会全损。 充值活动的链接 #ClaudeFable5# #HermesAgent# #AIAgent#
显示更多
0
55
30
0
转发到社区
POLO教你如何把Hermes长期运行起来 把 Hermes Agent装到 VoyraCloud 上,一台 VPS跑出24/7长期在线的 AI 工作站 ⭐Claude Code折腾半天,跑两小时电脑休眠一关就断。Hermes Agent放本地同样问题,电脑一关任务全挂,IP偶尔波动自动化任务就崩,重启一次所有进度清零。很多搞 AI 开发的人都遇到过,想要一个真正7×24跑任务的 AI 工作站,本地机器撑不住。 普通机房 VPS 是另一条路,但 IP段是数据中心的,Claude、Google、PayPal 这些平台一眼能识别,部分场景会有登录风控或环境异常提示。住宅 IP VPS 的 IP来自 ISP分配给真实家庭用户的地址段,环境更接近真实用户网络,平台接受度高,适合长期跑 AI Agent、跨境电商、海外社媒这些需要稳定环境的场景 🚀 VoyraCloud出了 Hermes官方镜像,住宅 IP VPS上一键部署,skills、memories、sessions 全保留。重启不丢进度,升级不丢数据。 30 分钟跑通第一步选 VPS。打开 Residential IP VPS页面。节点推荐华盛顿,跑 Claude Code 和 Hermes Agent 最稳。做海外社媒运营选对应目标地区节点。香港和东京节点延迟低,适合亚太业务。伦敦和法兰克福适合欧洲市场。 第二步选套餐。个人测试选轻量版1c1g,9美元/月。长期跑 Hermes Agent 和 MCP选标准版2c4g,15美元/月。要 Windows桌面选 Windows VPS2c4g,12美元/月。年中钜惠~全线最高30% OFF,新购续费都能用,截止6 月30 日 💻 第三步部署 Hermes。VoyraCloud 后台选 Hermes Image镜像,VPS启动后预装环境全配好。SSH进去跑 hermes setup配 LLM provider,跑 hermes启动 TUI。这一步5 分钟,比手动跑 自己会拆步骤、调工具、给结果。 Hermes Image镜像跟手动装的区别技能和记忆持久化。Hermes跑任务时自动生成 skills、积累 memory、记 session 历史。VoyraCloud镜像存在 Docker volumes 里,VPS 重启、升级、迁移都不会丢。手动装用本地 venv 加 sqlite,重启清空、版本升级偶发崩。 Telegram、Discord、Slack、WhatsApp、Signal、Email通道镜像预装好,跑 hermes gateway setup就能连。手动装要逐通道折腾 OAuth。镜像默认装 OpenRouter客户端,OpenAI、Claude、DeepSeek、Kimi、GLM、MiniMax直接切。跑 hermes model选就行,比手动配每个 provider 省时间。 自进化学习循环开箱即用。Hermes12 个核心功能全部预装,子 agent并行跑任务、浏览器自动化、内置 cron调度、canvas交互、plugin扩展。VoyraCloud镜像让这些能力落地在稳定的住宅 IP上,VPS跑24 小时在线,Telegram远程盯着任务跑完看结果。 哪些人最适用voyracloud? 跑长期 AI自动化任务的。RSS总结、Telegram Bot、OpenClaw情报系统、定时调研报告。Hermes有内置 cron调度,VPS7x24在线,本地电脑跑这些关机断网全白费,放 VPS上一条命令就跑起来。 养海外账号做跨境运营的。住宅 IP比机房 IP风控概率低,Claude API、Google、PayPal、TikTok、YouTube等平台对住宅 IP接受度普遍更高。固定 IP地区加独立服务器环境,比代理池靠谱很多。 现在年中优惠Mid-Year Sale全线最高30% OFF。新购续费都能用,截止6 月30 日。注册即享,无需优惠码。新用户首单额外优惠。 链接在此 POLO套餐建议: 轻量版9美元/月适合个人测试。标准版15美元/月适合长期跑 Hermes Agent。Windows桌面版12美元/月适合需要 GUI操作的人。趁活动期开一台长期用,30%折扣省下来的够跑好几个月。 官方账号 @VoyraCloud有更多活动和教程 🤖#VoyraCloud# #HermesAgent# #住宅IP# #ClaudeCode# #AIAgent#
显示更多
0
76
47
0
转发到社区
Hermes Studio v0.6.32 新版本发布 本版本涵盖 0.6.31 之后合并的全部 14 个 PR,聚焦会话分类与压缩、群聊、Workflow 路由、Skill Bundle、Ekko 记忆、Hermes 0.19 和桌面窗口界面 群聊 @mention 现在可在 CJK 文本、Emoji 和标点后正常触发;房主也可在房间设置中查看、生成和轮换邀请码 Workflow 在 handoff 和重新连接过程中会保留每次 Hermes Bridge 运行的来源;Scoped Codex 和 Claude Code 节点也可为有效 API Key 目标使用 launcher 支持的协议 会话新增全局分类、更准确的 Markdown 感知搜索排序,以及在编辑、分支和并发运行中保持正确并限制历史范围的游标压缩;完整压缩方案也已形成文档 现在可直接在聊天中创建、浏览、运行和删除 Profile 级 Skill Bundle,并清楚查看其中包含的 Skill Ekko 记忆改用 Profile 隔离的单一规范模型,支持 revision 校验的精确修改、更完整的来源审计和更严格的相关性过滤 Hermes 0.19 的助手中间消息会以独立气泡实时显示并保存;普通单聊也可异步投递持久化的后台委派结果 新的桌面 Runtime 构建、后备路径和 Windows CLI shim 现在默认使用 Hermes Agent 0.19.0 桌面窗口控件已融入页面框架:macOS 红绿灯位于侧边栏,Windows 控件位于主内容上方,Linux 继续使用原生窗口装饰 开发文档现在同时支持直接使用当前 checkout,并可按需采用隔离的 Git worktree
显示更多
0
10
23
0
转发到社区
今天发现个狠工具。 Agent-Reach:专门解决 Agent 联网找资料难的问题。 以前让 Claude Code / OpenClaw / Hermes Agent 抓资料, 经常卡在 API、订阅、反爬、平台限制上。 它直接把 yt-dlp、twitter-cli、xhs-cli 等工具打包好, 网页、YouTube、RSS、公众号、微博、小红书、V2EX 都能跑。 一句话: 以前是人帮 AI 找资料, 现在是 AI 自己去拿资料。 做 Agent、选题、舆情、竞品分析的可以看👇
显示更多
Hermes Agent v0.19.0: The Quicksilver Release Changelog below
0
103
1.6K
141
转发到社区
Accelerate your creativity with Hermes Agent and @UnrealEngine. Our new optional companion skill for the official @EpicGames MCP helps Hermes discover tools, sequence calls safely, turn plain-English prompts into polished scenes, and verify results visually. Demo by @macbethAI
显示更多
0
21
336
28
转发到社区
Hermes v0.6.30 发布|工作流、MoA、实时语音与持久记忆全面升级 2026 年 7 月 15 日,Hermes v0.6.30 正式发布。本版本汇总了 v0.6.29 之后合并的 21 个 PR,覆盖工作流编排、MoA 会话、实时语音、持久记忆、Provider 稳定性、MCU 设置和 Windows 体验优化。 工作流编排 v2 带来了更完整的执行控制能力,新增按成功、失败和始终执行的条件路由、真正跳过、all/any 汇合、有界反馈循环、执行证据、截止时间与可移植导入 已启用的 MoA 组合现在也可以在创建或切换 Hermes 聊天会话时直接选择,并正确处理组合名称、默认项、上下文窗口与运行时行为(#2078)。# 性能方面,通过按需加载 Markdown、Mermaid、Monaco、非当前语言资源和可选浮层,大幅减少了首屏初始 JavaScript 会话模型切换现在会显示阻塞式进度状态;切换对话时也会重新播放淡入动画,同时保留现有草稿和附件 语音体验迎来重点升级:单聊新增全屏实时语音模式,支持实时转写、语音队列播放、工具活动展示和打断控制 桌面端与移动端的实时语音稳定性也得到提升,现在可以从静默状态恢复、避免误录助手语音、使用当前 STT 备用服务,并在交互期间保持审批弹窗可见( Ekko Agent 新增持久化的作用域记忆,可在运行时上下文中提供当前 Provider 和模型信息,同时更安全地处理生产环境记忆数据库 对于尚未配置 Provider 的 Profile,系统现在会显示设置引导,并支持直接打开 Provider 表单 Provider 模型目录现已与 Hermes Agent 对齐,实时发现结果优先,过期的备用缓存不再遮盖更新(#2051)。# 自定义 Provider 别名在已加载的聊天会话中也能保持稳定,避免不必要的客户端重建和请求头丢失(#2054)。# Journey 图谱新增类别多选、不同形状的 Skill 和 Memory 节点、预览,以及更完善的键盘与触控操作 此外,Markdown 下载现在会保留文件扩展名,移动端转写新增明确的开始和停止控制,Scoped Codex 流式输出也不再重复最终助手消息 MCU 设置与稳定性同步改进,包括显示设备码、自动选择麦克风、同步断开状态和限制 TLS 探测时间 Windows 用户在 Git 或普通目录中捕获工作区变更时,对话界面也不再闪现 Git 黑窗
显示更多
0
19
18
1
转发到社区
Hermes Studio 开始于今年四月。 当时我们想使用 Hermes Agent,却没有找到一套顺手的 Web UI。于是团队做出了第一版界面 Hermes web ui,开放给社区使用。 5月收到第一批用户反馈后,我们继续推出桌面客户端,并持续支持 macOS、Windows 和 Linux,Hermes Studio上线。 Hermes Studio 把文件系统、终端、浏览器、Coding Agent、MCP 和多平台消息渠道集中到一个工作台里。用户可以让 Agent 搜索和整理文件、运行命令、操作网页、修改代码、执行测试,也可以连接知识库、数据库、GitHub、邮件和企业内部服务。 项目目前获得超过 9,000 个 GitHub Star,npm 下载量超过 35 万次,Docker 拉取量超过 31 万次。 Hermes Studio 在 OpenRouter 累计使用约 476.9 亿 Tokens。2026 年 6 月 8 日,桌面客户端进入 OpenRouter 全球 Tokens 日榜第 9,Web UI 位列第 17。 6月 Hermes Studio 小方盒。它可以放在桌面或户外,通过语音、实体按键和小屏接收指令,再交给电脑或远程服务器执行。这个硬件入口也会连接后续的手机 App、MCP 工具和自动化服务。 7月 Hermes Studio 已与阿里云旗下无影云电脑展开合作,相关 Web UI 镜像已经上线,用户可以一键完成部署。 未来 6 到 12 个月,团队会继续更新打磨桌面端,发布并打磨手机 App,推进 ESP32 与软件工具链的连接,同时建设Hermes Studio社区。
显示更多
0
16
53
4
转发到社区
Grok 4.5 不错,在我的链上攻击分析 Agent 上,实测验证了几次,令我满意。之前的版本我是失望的,但 4.5 可以了。 场景:加密货币链上攻击分析,在 Hermes Agent 里做了 @SlowMist_Team 相关 Harness Engineering。 GPT 5.5/5.6,GLM 5.2,Grok 4.5,DeepSeek V4 Pro/GLM 5.1,这是我的满意度梯队(从很好到还行)。为什么没有 Claude 的?已经不是关键必需品了…还一天天搞歧视及封锁… 以模型和 Agents 这样的迭代速度,相关工作真的会越来越没有门槛,门槛以后只会集中在有没有实践上,实践决定了一个人的经验,经验可以影响许多。
显示更多
AI 视频剪辑 Skill 分享「video-use」 @browser_use 团队推出的开源 Skill,定位为面向 AI Coding Agents(Codex、Claude Code、Cursor、Hermes Agent 等)的视频剪辑 Skill。它不做传统意义上的 Premiere / CapCut 替代品,它是一套让 LLM 通过 “阅读转写文本 + 按需可视化” 来理解视频、并调用 ffmpeg 等工具完成剪辑的 prompt-engineering + 工具脚本集合。 # 核心思想:LLM 不“看”视频,它“读”视频 第一层:音频转写文本(always loaded) 通过 ElevenLabs Scribe 获得逐词时间戳、说话人分离、音频事件标记(如笑声、叹息、掌声),打包成约 12KB 的 takes_packed.md。这是 LLM 的主要“阅读材料”。 第二层:视觉时间线视图(on demand) 仅在决策点(歧义停顿、重拍对比、切点校验)调用 timeline_view.py 生成胶片帧 + 波形 + 字幕的 PNG 复合图。 对比朴素方案“30000 帧 × 1500 tokens = 4500 万 tokens 噪声”,项目走的是 “12KB 文本 + 少量 PNG” 的轻量化路径。这与 Browser Use 让 LLM 读结构化 DOM 而非直接看截图的思路一致。 # 技术流水线:Transcribe → Pack → Reason → EDL → Render → Self-Eval 1. 转写 - transcribe. py / transcribe_batch.py 提取 16kHz 单声道音频,调用 ElevenLabs Scribe,缓存为 transcripts/.json 2. 打包 - pack_transcripts.py 将逐词 JSON 合并为按 0.5s 静音或说话人切换断句的 takes_packed.md 3. 决策 - LLM 自身 阅读 packed transcript,必要时用 timeline_view.py 可视化 4. 生成 EDL - subagents 输出 JSON 格式 edl.json,包含源文件、切点、节奏标签、引用、原因 5. 渲染 - render. py 分段提取 → 无损 concat → 叠动画 → 压字幕 → 响度标准化 6. 自评估 - timeline_view.py + LLM 在输出文件的每个切点 ±1.5s 检查跳帧、爆音、字幕遮挡,最多 3 轮 # 关键工程细节: ffmpeg 为主的剪辑实现 1. 分段提取 + -c copy 拼接(避免叠 overlay 时二次编码) 2. 每段边界 30ms 音频淡入淡出(消除切点爆音) 3. overlay 使用 setpts=PTS-STARTPTS+T/TB 进行时移,确保动画第 0 帧对齐输出时间线 4. 字幕始终最后叠加(防止被动画遮挡) 5. Master SRT 使用输出时间轴偏移:output_time = word.start - segment_start + segment_offset 6. 切点必须落在词边界,并加 30–200ms 填充以吸收 Scribe 50–100ms 的时间戳漂移 7. HDR 源自动 tone-map(HLG/PQ → Rec.709 SDR) 8. 竖屏源自动按高度缩放 9. 两-pass loudnorm:-14 LUFS / -1 dBTP / LRA 11,符合主流社交平台标准 # 动画与包装:多引擎并行 1. HyperFrames:HTML/CSS/GSAP compositions,适合产品 UI、网页转视频、动态排版 2. Remotion:React 组件化 compositions 3. Manim:数学/技术/3Blue1Brown 风格解释动画 4. PIL + PNG sequence + ffmpeg:简单卡片、计数器、打字效果 # SKILL.md 的 12 条“铁律”:生产正确性优先 1. 必须遵守的 12 条硬规则:字幕最后、分段提取再拼接、30ms 淡入淡出、PTS 时移、SRT 输出时间偏移、不切在词中、切点填充、逐词 ASR、缓存转写、并行动画、先确认策略再执行、输出在 /edit/ 2. 其余全部是可调整的“worked example”:调色风格、字幕分块、动画时长、节奏等都可按材料和用户品牌定制
显示更多