注册并分享邀请链接,可获得视频播放与邀请奖励。

产品经理老王霸 的个人资料封面
产品经理老王霸 的头像

产品经理老王霸 (@laowangbabababa)

@laowangbabababa
0 正在关注    0 粉丝
又调整了一些细节,全程用 codex 完成的这个视频工作流,一个skill 跑完整个流程,目前基本能 100% 还原和超越抖音爆款视频了。 1、给标题,说一下要讲的书 2、A 读情绪,写文案,人再改文案 3、TTS生配音 4、生图和视频,视频可做可不做,我白嫖了 grok 生视频 5、组装视频和生成剪映草稿 这里面视频模型不需要特别的贵的模型,简单模型即可,我本地部署了一个,太压的卡了,太慢了
显示更多
0
32
124
32
转发到社区
全程用 codex 完成的这个视频工作流,一个skill 跑完整个流程,对比了抖音上的书单视频,这个能还原 90%,还差一些细节。 1、给标题,要讲的书 2、ai 读情绪,写文案,人再改文案 3、生配音 4、生图和视频 5、组装视频 6、生成视频和剪映草稿 里面唯一恶心的就是,生成速度太慢了!
显示更多
0
27
135
23
转发到社区
外链跳转产品已经初步能用了,主要使用场景 2 个 1、购课后短信内的短链,点击后加微信 2、公众号文章内容发链接,点击获取微信码。微信 5 月新规对导流行为打压严重,不能直接发码了。 小红书和抖音已经不能跳转外链,没必要尝试了。 以上 2 个场景,是我经常使用的,外面产品单月都 99 元以上,我自己做根本没有啥成本。 一些喷子说,这是几年前的产品,这给我提效就可以了。目前还不完善,逐渐迭代一下。 企业微信如果想开放第三方,是需要申请服务商,还没尝试,需求大也不是不可以做。 最后想说的是,你的产品体验足够优秀,你有流量,别人的成功商业模式,你做了也能赚钱。 有任何问题,都可以评论区讲,评论区体验👇
显示更多
卧槽,外链跳转微信加好友,被我打通了。 全程用codex ,从链接,跳转到微信app扫码,加微信的流程。从各种网站,获客的线索终于可以不会丢失了。 我看了其他网站做的这样产品,月费至少是99,我只有认证费和服务器的成本。 参考这个视频看看,对这个感兴趣的可以私聊我
显示更多
这个免费配音产品,真好玩啊,VoxCPM2。 以前做 AI 配音,要么按月给平台交钱,要么自己折腾一堆模型。现在 OpenBMB 把这套东西直接开源了。 你丢一段文字进去,它就能生成一段接近真人说话的音频。 更骚的是,不给参考声音也行。直接告诉它,年轻一点,声音温柔一点,语速稍微快点,它会自己设计一个声音。 有参考音频,玩法就更多了。 给它一小段录音,VoxCPM2 能照着克隆音色。生成新内容时,还能单独控制语速、情绪和说话方式。 中文、英语、日语等 30 种语言都支持,四川话、粤语、东北话、闽南话也能做。输出是 48kHz,已经奔着正经内容生产去了。 老王用自己的声音试了东北话,粤语,普通话,都非常像的。关键免费啊! 代码和模型全部开放,Apache 2.0 许可,可以商用。GitHub 已经超过 3.3 万 Stars。 我已经部署本地了,后面自己的coding 的产品就用这个模型,对配置要求低的。 你也拿一段课程文案试试,重点听三个东西,中文像不像真人,长文会不会越念越怪,克隆出来的声音到底像不像。 跑完再回来交作业。
显示更多
卧槽,外链跳转微信加好友,被我打通了。 全程用codex ,从链接,跳转到微信app扫码,加微信的流程。从各种网站,获客的线索终于可以不会丢失了。 我看了其他网站做的这样产品,月费至少是99,我只有认证费和服务器的成本。 参考这个视频看看,对这个感兴趣的可以私聊我
显示更多
0
58
550
70
转发到社区
天啦噜,我今天被这个 PPTskill 惊艳的嗷嗷的。生成的效果真是吊打业内的感觉。 字体排印带着设计师手调的克制感,数据图表的图形版式是大师级别,最绝的是每一页右侧的调整控件:目录页出现模块数量滑杆,图表页出现换图表类型,跟着内容走,不套死模板。 12 套主题 1020 个版式,改完导出真的可编辑 PPTX。我拿课程资料跑了一下,忍不住从头夸到尾。只能说声卧槽,可能是夯级别的 skill。 外面都在聊 AI 做 PPT 多快多省事。真正值得聊的,是这玩意儿的设计完成度。 这个 skill 有20 种页面角色、1020 个版式,SWOT、波特五力、桑基图、甘特图,做汇报真用得上的全是现成的。最让我爽的是,它自带操作台,可以直接在页面调整每个内容,而不是死板的 HTML。俨然变成了我做课件的刚需产品,内心毫不掩饰的夸赞! 使用流程: → 跟你的任意 coding agent 说:安装这个 skill → 丢文档进去,自动选版式、填文案、多道校验,几分钟出片 → 每页控制台跟着内容类型动态变,拖滑杆就增减模块、换布局、换图表,改完自动写回文件 → 一键导出真的可编辑 PPTX,逐节点还原,文字全保留。跟那种网页截图贴进 PPT 的骗人玩意儿,压根不是一个东西 课程课件、训练营讲义、客户方案,以前做一套 PPT 从找模板到调排版至少半天,现在丢文档选个主题就出片,不满意浏览器里改,改完直接交 PPTX了。 一个字:爽 按这个美感度,我感觉,这不是又一个生成工具,是把设计师的工作流打包成浏览器编辑器了。 搓作者:@dashiAIxz @Jadon_Bao 好产品,值得推荐!
显示更多
0
1
35
10
转发到社区
太好玩了!最近研究一些生图的提示词,一边做视频素材,一边在笑,给娃也弄一全套的新奇图片,包括 1、生成涂鸦插画 2、生成你的明星照 3、把你变成时尚风格插画 4、让你变成3D形象 5、把你做到封面里 6、生成动漫风格画 想要提示词吗?来查看评论!
显示更多
用 minimax 做设计稿,一次对话直接消耗 16 块,而且是在我强行暂停的情况下,只画了一张图。 我又用 DeepSeek,完成了整个页面的 UI 制作,却仅仅花费 1.2 元。 跟 DeepSeek 对比起来,minimax,毫无性价比啊~
显示更多
这项目我可太爱了!! 一个哥们把1324个健身动作全整理完了,英文、西班牙语、意大利语、土耳其语、俄语、中文,六种语言的动作讲解全翻好了。 本来这事你至少得雇两个人,一个整理数据,一个翻译。现在一个开源仓库,建表SQL、API代码、连LLM提示词都给你写好了,复制粘贴就能用了。 我最近减肥中,打算自己搞个小程序,监督训练,就看到了这个宝藏项目。 其实,做健身产品最头疼的从来不是UI界面。是把1324个动作挨个录完,把英文讲解一字一句翻成中文,再琢磨数据存哪、怎么让App读到这些数据。这堆东西,一个人干至少两周,外包出去少说两万。 这个仓库把三件事全替你干了。打开这个仓库你能拿到什么: 1324个动作的数据库,按部位、器械、目标肌肉全部分好了,拿来就能用 六种语言的讲解翻译全齐,不用自己雇人译 选个数据库类型,建表代码自动生成,不用从零建库 接口直接给你写好,七八种语言都能跑,改个地址就行 最狠的,连让AI帮你生成整个后端的提示词都写好了 数据录好了,六种语言翻好了,数据库怎么建也用不着你想了。打开setup.html,选一下你用的数据库类型,四五个主流的一列都支持,建表代码直接生成。 你连接口都不用自己看代码写了,选完框架和数据库,它给你生成一段提示词,直接甩给Claude或者GPT,一条消息整个后端就出来了。 老王自己跑了一趟,先做了个网页版吧,半小时全通了,六种语言的接口一个没落。 你也可以尝试一下,做一个自己的健身管家。
显示更多
说实话,这个数字人项目被严重低估了。 外面还在20美元/月买 HeyGen数字人会员,美团已经把整套数字人口播方案开源出来了。叫 InfiniteTalk,一张图一段话,口型、头、身体全同步,不限时长。老王拿照片试了一下,完全可用。 它表面是个数字人对口型工具,实际干的事比这多得多。底层用Wan视频模型负责出画面,再挂个音频分析引擎,把你说的每句话拆成嘴型、表情、身体该怎么动的指令,最后靠一种只刷新关键帧的策略,保人脸不崩背景不乱。 整条视频从上到下跟着音频走,不光嘴在动,肩膀、眉毛、眼神全跟着语音节奏变。那种只给你换张嘴的方案。 有两种用法。 1、拍张照片配段话扔进去,出来就是一条完整的说话视频,单人口播、唱歌都行。 2、塞段现成视频加段新音频进去,它能给原视频换配音,人物嘴型和身体动作全跟着新音频重新对齐。 硬件要求,英伟达cuda,显存至少24G,mac无法使用,内存32G以上,硬盘200G以上(权重就100G以上) 安装方法,不复杂, 让AI帮你建个新 Python 环境,跑一遍依赖清单,从 HuggingFace 拽三个模型包就齐了。从下载到出第一条视频,半小时够了。 PS:仓库在 GitHub,而且是Apache-2.0 协议,商用很友好。效果看这个视频,开源的东西做到这个程度,以前真不敢想。
显示更多
0
4
161
46
转发到社区
这些UI工具能帮你的产品,彻底摆脱AI味儿,都是我经常用的网站,推荐推荐~ 一、热门GitHub设计推荐 1、awesome-design-md,热门品牌设计系统的 DESIGN.md 文件 2、taste-skill,去除AI味道,专业设计规范 3、花叔 Design,HTML 高保真原型、动效 Demo、设计变体探索 4、frontend-design,前端 UI/UX 设计,避免 generic AI 界面 5、ai-website-cloner-template,克隆任意网站给自己用 二、炫酷前端网站推荐 1、 - 展示动态设计 2、 - 浏览器中的 3D 设备模型 3、 - 将照片转为回顾视频 4、 -图像与视频的 lo-fi 效果 5、 -基于曲线的渐变创建器 6、 -无限独特渐变 7、 -抖动、ASCII 和半色调效果 8、 -每小时在 𝕏 上发现创意UP 9、 - 每日精选设计方案 三、UI设计思路网站 1、figma make,多种UI模板参考 2、 3、 4、 UI参考 请大家继续评论区补充你私藏的好的UI网站~
显示更多
我爽了,我的UI终于脱离AI味了。 AI 写代码已经够快了,但写出来的页面……怎么说呢,总透着一股 AI 味。紫色渐变、Inter 字体、三列等大卡片,看多了你一眼就能认出来,这是 AI 写的。 AI时代,开始比拼UI的品味能力了,非常稀缺。 今天推荐taste-skill 这个项目,已经14k stars了,干的事有点意思:它不写代码,它把排版、配色、字体、动效的设计规则全写成 SKILL.md,塞给 AI。相当于给 AI 配了个免费的艺术总监。 仓库表面是十几套 SKILL.md 文件,实际在做一件事:把审美变成规则。外面还在卷 AI 写代码多快,它在卷 AI 写的页面能不能不像 AI。 DESIGN_VARIANCE、MOTION_INTENSITY、VISUAL_DENSITY,数值一调整个页面气质就换了,跟调相机参数似的,同一个场景,不同参数出来完全不同。 它有三层做法: >读意图,自己推断你要什么风格。极简、奢侈、粗野,十几套自动匹配 >选底座,该 Tailwind 就 Tailwind,该 Material 就 Material,不自己瞎造 >禁 AI 默认审美,紫色渐变、居中 Hero、三列等大卡片,全禁 我拿自己的AIGC产品跑了一遍。原来的页面代码不动,就加了一行 SKILL.md 进去,让 AI 按它的规则重新迭代,出来的页面焕然一新。不是重写,是同一个代码底子被审美规则过了一遍。 实操很简单,就两步: 装 skill:npx skills add --skill design-taste-frontend 然后把你现有的页面丢给 AI,加一句:按 taste-skill 规则迭代 UI。它自动读你的代码,出诊断,改字体、配色、间距、动效,不动你的功能逻辑。 搞独立开发的、做 landing page 的,这个skill太重要了!
显示更多
0
6
130
34
转发到社区
张雪峰真是大善啊,高考孩子有福气了。张雪峰老师虽然走了,他那套帮人选专业的核心认知全在。 有人干了一件特别牛逼的事。把张雪峰十年直播里反复用的那套判断框架,蒸馏成了一个开源的 AI Skill。5本书、15篇采访、30多条语录,一层一层提炼出5个心智模型:社会筛子论、就业倒推法、阶层现实主义、不可替代性检验。 我给你翻译一下这是什么意思。 你问它一个问题,它不是说一堆正确的废话。而是先查你有没有行业资源,再看这个专业毕业生中位数的去向,最后给你一个你够得着的方向。 不讲鸡汤。不画大饼。 老王把这东西接成了免费的高考答疑AI工具,现在谁都能用,网址: 模型全免费,你直接提问就行。 三个场景,我说说有多实用。 第一种,正填志愿的考生。拿分数、省份、想报的专业,三个要素丢过去。它按中位数去向给判断,告诉你这个分段能去哪、出来做什么、值不值得去。 第二种,孩子要选专业的家长。这也是张雪峰直播间十年反复问的一套逻辑——先别问什么专业好,先问你家里有什么行业资源,再去看这个行业出口在哪。工具会按这个顺序反过来问你。 第三种,纠结考研还是工作的。它会先问你什么专业。不同专业,答案完全不一样。学计算机的和学生物的,走的路能一样吗。 但说真的,这东西真正值钱的,不是回答本身。 是一个人的认知框架,被保留下来、被复用、被放大了。 你想想看,张雪峰做了十年直播,核心就五六个判断模型,翻来覆去地用。现在这些模型结构化地写进了 Skill 文件,谁装上,谁就继承了这套判断逻辑。代码是死的,判断是活的。 志愿这件事,信息差就是命差。 张雪峰不在了,这套框架没走。
显示更多
在老王不断的强行带货下,终于把这篇文章干到了百万阅读,它是非常值得阅读的AI入门科普文,Github也是我每天都需要用到的产品。 我单独为这个文章录制了详细的视频教程,如果你之前没有看过,我就再发一遍,看完你能学会: 1、分别什么时Git,什么是GitHub 2、如何注册和使用GitHub 3、Github页面的所有功能的定义 4、如何搜索GitHub项目 5、本地代码和线上仓库如何实现同步 等等,详细的就看视频解释和文章总结吧~
显示更多
非常Nice啊,这模型完全免费,Token终于可以自由白嫖了,甚至视频模型都是免费的,太爽了。 它叫Agnes AI,全球模型榜前十,6 月 1 号起把自己家三个核心模型全免费开放了,无限期。图片模型在 artificial analysis 上榜了,文字模型一周被干了一万亿 Token。我把它接进 Claude Code,配起来十分钟的事,Token 随便用。 这玩意到底是什么呢。 Agnes AI 是全球模型榜单前十的一个 AI Lab,这次免费开放的是三个模型,文本、图片、视频。 文本模型叫 agnes-2.0-flash。能写代码,能做知识问答,能跑 Agent,能规划复杂任务。在 Claw-Eval 智能体评测榜进了 Top 10。说真的,这周它还要上 1M 超长上下文,以前用 200K 的模型跑到 150K 就降智,这种破事不用再忍了。 图片模型叫 agnes-image-2.1-flash。图改图、多图融合、换背景、改文字、图像修复,电商主图和广告素材这种反复改的场景,太合适了。最近还加了 4K 超高清输出,最高 4096×4096,生成的图可以直接进印刷,不是那种看着还行一放大就糊的草稿。 视频模型叫 agnes-video-2.0。原生音画同步,首帧生视频、首尾帧生视频、多镜头切换都支持,720P 和 1080P 随便选。 接进 Claude Code 怎么搞,其实很简单。 第一步,去 注册,拿到 API key。 第二步,打开 cc-switch。右上角选 Claude CLI,右上角点 + 号,选自定义配置。把 API key 填进去,请求地址写 格式选 OpenAI Chat Completions。 第三步,点获取模型列表,选 agnes-2.0-flash。 第四步,点左上角设置,找到路由,打开路由总开关,Claude 打开。 完事。 回到 Claude Code 正常发消息,模型就已经切过去了。我试了一个在酒吧吉他弹唱的视频,和真人区别不大。 现在 Token 不要钱,Agent 该跑几轮跑几轮,该拆几步拆几步。反正我觉得这才是免费开放最爽的部分,不只是省钱,是心理上解放了。 我测试了一下视频模型,能用,就是慢了点,文字模型还是比较快的。 开发者文档在 OpenClaw、Hermes、Claude Desktop 的,也有现成教程。
显示更多
Hermes + Xsupergrok=监控X上所有的AI信息。把这句话,发给你接入的飞书,telegram还是其他渠道,他会自动做,提示词如下: 官方:OpenAI @OpenAI · OpenAI Dev @OpenAIDevs · Anthropic @AnthropicAI · Claude @claudeai · DeepMind @GoogleDeepMind · xAI @xai · Meta @MetaAI · Mistral @MistralAI · Cohere @cohere · Azure @Azure · Nvidia @nvidia · AWS @AWS · DeepSeek @deepseekai · 智谱 @ZhipuAI · Kimi @MoonshotAI · MiniMax @MiniMaxAI · 阿里云 @AlibabaCloud · Hugging Face @huggingface · Perplexity @perplexityai · Cursor @cursorai 负责人:Dario @DarioAmodei · Mike @mikeyk · Sam @sama · Greg @gdb · Tibo @thsottiaux · Demis @demishassabis · Satya @satyanadella · Mustafa @mustafasuleyman · Elon @elonmusk · Yann @ylecun · Karpathy @karpathy 风向:Nikita @nikitabier 监控这些x上的帖子,每1h给我定时任务发送到飞书,成功后,你测一条最新的claude发的帖子
显示更多
太牛逼了。真的,太牛逼了。真的能爬一切,而且速度嘎嘎快! 以前让 Claude Code 上网搜个东西,推特 API 要钱,网页抓取要订阅,B站小红书直接给你拦在外面。每个平台一个门槛,烦得要死。 Agent-Reach,一个免费开源仓库,一条命令把这 14 个平台全通了。 我装上跑了一遍 ,让 Agent 去搜一条小红书任意帖子的评论并总结,十秒总结出来,我当时真愣了一下,又快又好啊。 讲道理,Agent 能写代码能改文档,上网找东西就一直卡在这。Agent-Reach 干的就一件事,把选型和配置全帮你做完了。 yt-dlp 提字幕,twitter-cli 搜帖子,xhs-cli 抓小红书,装好以后 Agent 自己调,不经中间层。哪块不好用随时换。 零配置直接跑的有网页、YouTube、RSS、公众号、微博、V2EX。不用记命令,直接说需求,Agent 自己知道走哪。 >安装方法: 跟你的大模型说: 帮我安装 Agent Reach
显示更多
0
3
69
11
转发到社区