注册并分享邀请链接,可获得视频播放与邀请奖励。

与「提示词工程」相关的搜索结果

提示词工程 贴吧
一个关键词就是一个贴吧,路径全站唯一。
创建贴吧
用户
未找到
包含 提示词工程 的内容
我身边有个同事,技术能力很强,AI Coding 也用得特别多。 不过他有个特点,就是不太舍得花钱。 从免费的 Kimi 开始,一路买各种套餐。Kimi Coding Plan、Trae、OpenCode、阿里百炼……基本都试了一圈。最后得出的结论特别朴素:哪个便宜用哪个。 便宜确实是便宜。 但是便宜也有代价,很多最新的模型都没有,像 Kimi K3、GLM 5.2、Claude、GPT Codex 这些,他基本都体验不到。 他属于那种特别会过日子的工程师。 模型不给力,那就拼命榨模型。 前几天他写了一个 Skill,想根据一套 C++ 代码自动反推出详细设计文档。整个 Skill 十几 K,几乎全是提示词。 我拿内网模型跑了一遍。 五分钟结束。 吐出来一份二十 K 左右的“详细设计”。 我看完以后,总觉得哪里不对。 不是提示词的问题,而是感觉整个活儿都压在一个 Agent 身上了。 于是我几乎没改提示词,就是把流程拆了一下。让一个 Agent 负责规划,再分几个 Sub Agent 去写不同章节,最后回来汇总、补充、检查。 还是那个内网模型。 最后硬是跑出来一份一百五十 K 的详细设计。 说实话,质量还是一般,离 Claude 和 GPT Codex 那种效果还有距离。 但是我突然发现一个挺有意思的现象。 同样都在用 Agent。 他研究的是怎么把一段 Prompt 写得越来越长。 我研究的是怎么让几个 Agent 少聊天、多干活。 到底谁对,我现在也不敢下结论。 没准再过一年,模型聪明到一句话就全干完了,什么 Skill、什么提示词工程、什么工作流,统统都成了历史包袱。 不过至少今天,尤其是在内网这些能力没那么强的模型上,我还是觉得,Workflow 比 Prompt 更值钱一点。 以前写程序,总有人喜欢把三千行代码塞进一个函数里,也总有人喜欢拆成几十个小函数。 现在回头看,AI 好像也开始走这条路了。
显示更多
0
70
259
12
转发到社区
Claude Fable 5今天回归上线啦,ZenMux上限时免费使用真的太香了! 怎么用Fable 5输出高质量的「不会塑料 + 顶级人像提示词方法论以及户外美女人像prompt方法论大家收好! 说真的,我以为上次的Fable 5总结的AI生图焚决要绝版了,趁着现在能免费用,赶紧让Fable 5给我写了又写了一套: 怎么输出输出高质量的「不会塑料 + 顶级人像提示词方法论, 真的很炸,它对光影、材质、瞬间感的拆解细度,写出来的提示词出图质感,比网上卖几十上百块的所谓的人像焚决提示词强出一大截, 连所有人头疼的塑料皮肤、娃娃脸、畸形手问题,它自己就能系统性避开。 单轮直接出结果的版本我磨到终版了,复制完直接扔进去就能跑,Prompt: “你是有10年经验的顶级商业人像摄影师+提示词工程师。 1️⃣先做第一步拆解:AI人像出塑料感、AI味、廉价感的核心根源是什么?真正高级的商业人像有哪些共性? 2️⃣第二步输出可直接复用的提示词框架,覆盖主体人设、服装材质、表情瞬间、镜头构图、光线皮肤、背景氛围、画质处理、强力负面词8个维度每个维度给具体写法,别讲空话。 3️⃣第三步严格按框架出2个可直接复制的完整示例:1个克制老钱风,1个体育赛事广播截图风,全程禁止夸张性感、塑料皮肤、畸形结构。 4️⃣最后自我检查:两个示例哪里还有AI味风险?直接修正到最终版。 输出用清晰中文编号就行,要是觉得不够细,补一句「再优化一次,每个维度写得更落地」就好。 另外大家想做商用级内容就用三轮对话法: 先拆塑料感根源,再搭完整框架,最后出示例+自我修正,质量比单轮再提20%。 三个踩坑踩出来的Fable专属技巧,记了不吃亏: 1️⃣ 必须先给它顶级专业人士的身份,不设角色它就会套网上的烂大街模板 2️⃣必须逼它先分析"为什么会塑料",不挖根源写出来的全是正确的废话 3️⃣一定要加自我检查环节,这是Fable独有的强项,它自己挑错比你手动改十轮都管用 我自己跑这些测试全程用的ZenMux,真不是打广告,天天折腾模型的人一用就懂有多爽——现在claude-fable-5-free端点直接免费用,账户留任意余额就能跑, 不用烧官方50美元一百万token的高价额度,测十轮也花不了几块钱, 关键是真无RPM限制不限流,跑多轮长提示词从来不会半路掐断降速,迭代效率比官方高太多。 自带的同屏PK功能我用的最多,同一个需求拉上Fable5、GPT-5.5、Opus4.8并排输出,哪个写的框架质感好一眼就见分晓,做横评连切标签页都省,全平台200多个模型一个账户全覆盖,不用到处开会员; 现在开自动充值每笔还返20%余额,最多领3次共300刀赠金,余额永久不过期,跑大任务永远不用担心突然断供。 以下3张图的提示词放评论区了,大家自取,ZenMux也有gpt-image-2可以用,直接丢提示词就行。
显示更多
0
63
293
42
转发到社区
现在学 Google AI,就像 2017 年学移动互联网。 现在开始学这套东西的人,未来三年会吃到很大的红利。 我把最值得看的资源都整理好了,建议先收藏: Gemini 学院: Gemini API 文档: 提示词工程指南: Gemini Cookbook: Google AI Studio: Google 开发者 Gemini 视频: Vertex AI 官方文档: Gemini SDK 示例: MCP 官方文档: Google 免费 AI 课程:
显示更多
睡前来一发,这个视频还是挺完美的。 Anthropic的应用AI工程师Margot Van Laar在Code with Claude分享了提示词工程的实战手册。 核心观点是:我们很少从零写提示词,大部分时间都在调试和维护已有的生产提示词。 最好的起点永远是评估(Eval),而不是直接改提示词。 她用两个真实场景演示了最佳实践: 1. 维护已有提示词(客服机器人) - 先做通用清理:用XML标签结构化(角色/政策/语气/指南分开)、移除冗余补丁、明确输出格式。 - 常见陷阱:以前为旧模型加的“禁止列表”指令,在新模型上会过度拟合,导致模型隐瞒它其实能提供的信息。 - 当模型需要做精确计算时,指令没用,要给它工具。 - 升级/转人工的决策,要把代价和收益两面都说清楚,否则模型会过度优化某一边。 2. 从零构建新Agent(零售排班) - 单一复杂提示词容易失败。 - 更好的方式是拆成生成-评估-修复循环,让三个简单提示词各司其职。 - 模型选择很重要:更强的推理模型(Opus)+ 自适应思考,往往比小模型+复杂提示词更高效。 她反复强调:评估是唯一能告诉你改动是否真正有效的严谨方式。 没有评估,就只是在碰运气。
显示更多
CLAUDE 盯上的,是玩家离开游戏去外面找答案的那段时间。以前你需要花几个月磨合提示词工程,现在有人直接把成体系的 SOP 甩在了 GitHub 上。 你现在的瓶颈不再是懂不懂 AI,而是敢不敢把自家私藏的 Prompt 库公开复用。接下来该的是:这种开源是否会让初级开发者的溢价彻底归零?
显示更多
Disclaimer: 本次测试结果仅代表特定场景下的单次表现,不代表该模型的整体性能或长期水准。 测试输出受提示词工程、编程语言、实时网络搜索结果、OpenCode 版本迭代及策略调整等多重因素影响。 本测试属于个人兴趣/非盈利性评测,数据及结论仅供参考,不构成任何技术选型或商业决策依据。😅
显示更多
我已经检测过了,fable 5的强大是因为基模,相比于opus是跨越级的提升,超过gpt pro和gemini deepthink很多,不是提示词工程可以达到的
0
16
71
4
转发到社区
Boris Cherny(Claude Code 的创始人兼负责人) @bcherny 和 Cat Wu(Claude Code 产品负责人) 复盘 Claude Code 第一年: 一年前通用版上线,第一个 demo 发到 Slack 只换来两个 emoji;现在每天有几千个自主 agent 在跑。 这一年最反直觉的转变,是 Boris 已经不直接跟 agent 说话了。 「我跟一个 loop 说话,或者跟一个 routine 说话,由它来给 Claude 发提示词,这真的很疯狂。」 他把 18 个月概括成两次平台级跃迁:第一次,人从写源代码挪到跟 agent 对话;第二次正在发生,人从跟 agent 对话再挪到跟一个 loop 对话,由它去驱动 Claude。 loop 能干到什么程度?Cat Wu 留下的一个边界 bug,当晚被「另一个 Claude」先修好了——一位同事的 routine 专盯 5 小时没人回应的 bug 报告,自动提修复、容易验证的直接合并。Boris 说 routine 现在接管了全部代码审查: · 帮你盯着每一个 PR · 手动修 CI、手动 rebase 这些,他已经很久没做了 放手让 agent 自己跑,不会更危险吗?Boris 的判断正相反。 他的原话: 「其实你根本不想读大多数这些请求,把它路由给另一个模型去做安全检查,效果好太多了。」 理由是人性:当 99% 的权限提示都无害,人读着读着眼睛就发直了,真正危险那条反而被漏掉。推给用户前,团队拿数千条执行轨迹训练分类器,再让红队对代码库做提示注入攻击,每一次成功的攻击都变成一个 eval。 那怎么让一个 agent 能无人值守一直跑?Boris 的第一原则是不纠正单次输出: 「每次 Claude 犯了错,我不会告诉 Claude 下次要怎么做不同。」 而是把解法写进 CLAUDE.md 或做成一个 skill,把同类错误从此关掉。至于上下文,他给的是一条时间线——Sonnet 3.5 要做提示词工程,Opus 4 要做上下文工程,现在的模型两者都不要: 「给它最精简的系统提示词,最少的工具,然后让模型自己搞清楚。」 被问到下一步,Boris 没有预测形态,只说 agent 会跑得更久、更自主,同时并行的数量从一个跳到几千,而协调它们的界面会和现在完全不同——「再过一年,会是一套全新的东西,如果还是这些东西,那反而令人意外」。 完整双语转录 + 章节摘要 + 字幕:
显示更多
什么?! skill 也能"训练"了? 以往大家都是凭经验让AI写 skill, 然后调试的时候也是运行几下感觉没bug就完事了. 但 skill 能运行就一定好吗? 于是微软联合上交复旦同济等机构发了一个新框架 SkillOpt, 直接让AI评估skill写的好不好然后不断去优化! 最终, 这个框架写的 skill 让GPT-5.5的直接对话准确率飙升了 23.5分! 这个框架具体是怎么做的也很简单, 让skill迭代过程实现 harness 闭环! 大模型写完 skill 后, 立刻进入跑分流程, 只有得分更高的 skill 变更才会留下来. 跟大模型的强化学习过程如出一辙. 框架的设计也很值得做 Agent 框架的同学借鉴, 比如: 它设计了一个独立的优化器模型, 这个模型是用来写 skill 的, 它会根据 Agent 执行任务的试错表现得分, 对 skill 进行编辑操作(增加、删除、替换文本). 然后就是 harness 流程了:每一次文本编辑都必须在独立的验证集上分数有提升, 才会允许合并. 最后, 也是最精彩的地方, 框架还引入深度学习训练机制, 设计了文本层的学习率预算, 这个的核心就是限制大模型每次只能修改skill的一小部分, 慢慢迭代, 而不是全都重写. 论文中最有价值的数据就在这里, 论文实验发现, 每一步设置 4 到 8 个编辑操作的预算效果最好. 最终的最佳 skill 往往只包含 1 到 4 个被接受的核心修改. 甚至他们还设计了被拒编辑缓冲区, 用来存储训练过程的反面胶材, 以及周期性慢速/元更新, 这个则是跑完一个周期后, 会进行一次盘点, 类似于让框架形成记忆, 能更好的维持后续迭代. 这篇论文的结论十分深刻: skill(prompt) 完全配得上, 也需要一套系统级的训练流程. 原文中的描述直接是: 我们主张, skill 应当作为 Agent 的外部冻结状态来被"训练", 并且训练过程还要"让权重空间优化具有可重复性"! 这是不是意味着, 提示词工程(Prompting)和模型训练(Training) 的界限将逐渐变得模糊? 而提示词工程完全进入了机器学习的领域. 也许很快, 我们再也不需要人类去手动瞎改和调试提示词了! 论文地址: #skillopt# #微软# #提示词工程# #harness#
显示更多
0
17
403
75
转发到社区
兄弟们,我今天刷到一个东西,直接给我整不会了。 GitHub上有个叫 agency-agents 的开源角色库,你知道它现在多少星吗?81万。不是8.1万,是81万。这个数字意味着什么?意味着全球有几十万开发者和AI玩家已经在用了,你还不知道? 🔗 链接: 先说这东西是干嘛的。 简单讲,就是一个超级角色提示词库,里面塞了140多个专家级Agent角色。CEO、律师、程序员、产品经理、增长黑客、财务顾问、市场策略师……你能叫出名字的岗位,基本都在里面。每个角色都是精心调教过的,不是那种随便写两句"你是一个律师"就完事的垃圾提示词,是真的有深度、有专业框架的角色设定。 用法也极其简单,三步走: 1️⃣ 打开这个库,找到你需要的角色 2️⃣ 把角色描述直接喂给Claude Code或者Cursor 3️⃣ 开始对话,你的AI瞬间变成那个领域的专属顾问 就这么简单。你在做一个创业项目,不知道商业模式怎么跑通?调出CEO角色问它。合同条款看不懂?调出律师角色让它帮你拆解。代码写不下去?调出高级程序员角色让它review。 但最骚的玩法不是单个角色,是多Agent组团。 你可以同时开几个对话窗口,一个跑CEO视角,一个跑市场总监视角,一个跑财务视角,让他们对同一个问题给出不同角度的判断。这不就是给自己开了一家虚拟公司吗?而且这帮"员工"7×24小时在线,不要工资,不会摸鱼,不会跟你讲情绪。 我自己测试了几个角色,说实话,质量比我预期高很多。 特别是那些商业类角色,给出的框架和思路真的有点东西,不是那种泛泛而谈的废话,是能直接落地用的建议。当然,AI终究是AI,专业判断还是要自己把关,但作为思路启发和初稿生成,这个库的价值真的被严重低估了。 还有一点我必须说——它是完全免费的。 开源、免费、随便用、随便改。在这个到处收费、动不动就订阅的AI时代,这种东西真的越来越少见了。 现在AI工具的核心竞争力已经不是模型本身了,Claude、GPT、Gemini底层能力差距在缩小,真正拉开差距的是你怎么用、用什么角色、给它什么上下文。这个库本质上是在帮你解决"怎么用"的问题,把最难的提示词工程部分给你做好了,你直接拿来用就行。 81万星不是运气,是实力。 还没收藏的,现在去。
显示更多
0
17
152
32
转发到社区