注册并分享邀请链接,可获得视频播放与邀请奖励。

岚叔 的个人资料封面
岚叔 的头像

岚叔 (@LufzzLiz)

@LufzzLiz
用代码表达思想,用 AI 拓展想象,从生活汲取能量。 探索阅读与创造的边界。输出有温度的洞察。 致力于降低 AI 使用门槛,让更多人受益。 某大厂架构师-多模态、模型私有化领域 关注AI产品、AI结合教育、艺术创作领域 📮: lanshulan007@gmail.com
716 正在关注    20.9K 粉丝
用kimi-k3 vibe了一个言出法随的小网页,哈哈,还可以。本想精进下,奈何kimi-k3太火了,还要排队 先抛砖引玉吧~
未来游戏里的高玩,可能轮到语文课代表了。 我们玩了这么多年游戏,能对游戏世界说的话其实一直很有限。NPC 只听得懂设计师写好的选项,技能也只能通过固定按键触发。 “火球术”听着像咒语,背后仍是一段提前写好的程序。玩家只能使用设计师准备好的动词。 AlayaWorld 的案例有点不同。 场景还在继续生成,你临时说一句“让天黑下来”,下一段真的进入夜晚;说“召唤一只白熊”,熊便出现在街上。还可以让建筑倒塌、神社燃烧,让洪水淹没沙漠。 语言开始直接干预环境,Prompt 也有点像这个世界里的物理规则。 未来的游戏攻略,可能会研究另一种东西: “召唤”和“创造”有什么区别? “摧毁一栋房子”和“让它忘记自己存在过”,世界会怎么理解? 哪些词稳定有效,哪些隐喻会触发奇怪结果? 到那时,厉害的玩家也许更像一群研究未知文明的语言学家。他们会慢慢试出这个世界听得懂哪些动词,遵循什么语法,又会在哪些表达上产生意料之外的反应。 当然,一句话想成为有效的行动,世界还得记住它造成的后果。 房子倒了,走开再回来时仍然应该倒着;召唤出的东西,也不能一离开镜头就消失。否则所谓“咒语”,最后只是一段临时生成的视觉特效。 AlayaWorld 用 3D Cache 记住道路、建筑和地标的位置,再用压缩历史保留刚刚发生的事情。 简单理解,它在努力让这个生成世界拥有“过去时”。 目前这些能力主要停留在视觉层面,离完整的游戏机制还有距离。官方案例还没有证明稳定的碰撞、伤害、角色状态和长期物理规则。 不过,AlayaWorld 已经公开推理代码和 15B 模型权重。训练代码与部分数据仍在后续计划中,社区已经可以换掉官方输入,测试这个世界究竟听得懂什么,又会在什么情况下产生误解和穿帮。 小时候我们背秘籍,后来研究连招和配装。 以后,也许会有人共同写出一本“世界语法”:哪些话是技能,哪些话是漏洞,哪些话一旦说出口,连模型自己都不知道会发生什么。 如果语言真的可以改变游戏世界,你最想先测试哪个词? “倒流”“复制”“遗忘”,还是“违抗”? 项目案例: 代码与权重:
显示更多
未来游戏里的高玩,可能轮到语文课代表了。 我们玩了这么多年游戏,能对游戏世界说的话其实一直很有限。NPC 只听得懂设计师写好的选项,技能也只能通过固定按键触发。 “火球术”听着像咒语,背后仍是一段提前写好的程序。玩家只能使用设计师准备好的动词。 AlayaWorld 的案例有点不同。 场景还在继续生成,你临时说一句“让天黑下来”,下一段真的进入夜晚;说“召唤一只白熊”,熊便出现在街上。还可以让建筑倒塌、神社燃烧,让洪水淹没沙漠。 语言开始直接干预环境,Prompt 也有点像这个世界里的物理规则。 未来的游戏攻略,可能会研究另一种东西: “召唤”和“创造”有什么区别? “摧毁一栋房子”和“让它忘记自己存在过”,世界会怎么理解? 哪些词稳定有效,哪些隐喻会触发奇怪结果? 到那时,厉害的玩家也许更像一群研究未知文明的语言学家。他们会慢慢试出这个世界听得懂哪些动词,遵循什么语法,又会在哪些表达上产生意料之外的反应。 当然,一句话想成为有效的行动,世界还得记住它造成的后果。 房子倒了,走开再回来时仍然应该倒着;召唤出的东西,也不能一离开镜头就消失。否则所谓“咒语”,最后只是一段临时生成的视觉特效。 AlayaWorld 用 3D Cache 记住道路、建筑和地标的位置,再用压缩历史保留刚刚发生的事情。 简单理解,它在努力让这个生成世界拥有“过去时”。 目前这些能力主要停留在视觉层面,离完整的游戏机制还有距离。官方案例还没有证明稳定的碰撞、伤害、角色状态和长期物理规则。 不过,AlayaWorld 已经公开推理代码和 15B 模型权重。训练代码与部分数据仍在后续计划中,社区已经可以换掉官方输入,测试这个世界究竟听得懂什么,又会在什么情况下产生误解和穿帮。 小时候我们背秘籍,后来研究连招和配装。 以后,也许会有人共同写出一本“世界语法”:哪些话是技能,哪些话是漏洞,哪些话一旦说出口,连模型自己都不知道会发生什么。 如果语言真的可以改变游戏世界,你最想先测试哪个词? “倒流”“复制”“遗忘”,还是“违抗”? 项目案例: 代码与权重:
显示更多
0
98
61
2
转发到社区
Kimi-K3 确实不错,测评下来感觉与海外SOTA模型差距是在缩小的,恭喜Kimi-K3 和GLM-5.2 ,国产之光。 就是跑的有点慢,还特意充了钱,才把我的测评任务跑完! 其中,托举大力神杯这个测评我觉得kimi-k3做很好,仅次于fable-5 👍
显示更多
我刚用 iMessage,把一条视频发到了 TikTok。 准确点说,是我发了条消息,然后它替我自动进 TikTok 里点了发布。 一开始我是抱着试一试的心态:给 +16502137322 这个号码发了条消息。当时心里其实在打问号,这东西真能隔着 iMessage 帮我操作手机 App? 结果视频真发出去了,而且是不需要开VPN的! 我用的是之前做好的一条数字人视频,过程就三步: 1️⃣把视频链接准备好 2️⃣在 iMessage 给那个号码发消息:说帮我发到 TikTok 3️⃣第一次会让我登录账号,点它发来的链接,进云端手机,邮箱 + 验证码过一下就行 然后它就在那台云端手机里自己点、自己发。 最离谱的是:不用下 App,不用先注册后台,也不用提前买什么 agent 资源。就像给朋友发短信一样,把你要干的事说清楚,它就开始干活。 这次只是拿发 TikTok 做了个最小演示。但跑通那一刻,我脑子里已经在转别的了:视频分发、账号日常操作、TikTok 获客……这些以前觉得链路很长的事,突然变得很近。 国内手机发 TikTok 有多折腾,用过的都懂。这次用 @airtap_ai 的 Airtap 跑完之后,我是真开始觉得:以后有好玩的视频,除了发 X,也可以顺手丢一条到 TikTok。 完整过程我录进视频了。 建议大家先自己试一次,不用想太多,0门槛,几分钟就能知道我为什么说它离谱。 评论区我接着写一个更具体的:怎么用 Airtap 一步步做 TikTok 自动获客。 #justtextit# #textyourapps# #Airtap#
显示更多
AI机器人开始陪练打羽毛球了😃
GPT-5.6 Sol 实战测评来了,比5.5 好很多了,但是不得不承认:我的这些场景里fable 5 略好一点 GPT-5.6 Sol 让我惊喜的点是能发现项目中更多潜在的问题了
显示更多
grok-4.5 的前端比现在的GPT 5.5 好太多了,凭借速度优势,用grok-4.5 写前端还是挺爽的,迭代起来非常快,也能听懂需求👍
哈哈,grok-4.5 我愿称之为: 小fable 5😂 也可能是巧合,我发现我的两个测评任务grok-4.5与fable 5 神似 grok-4.5 效率很高,速度很快,这对我们大众来说这是好事👍 其他测评结果及地址见评论👇
显示更多
哈哈,grok-4.5 我愿称之为: 小fable 5😂 也可能是巧合,我发现我的两个测评任务grok-4.5与fable 5 神似 grok-4.5 效率很高,速度很快,这对我们大众来说这是好事👍 其他测评结果及地址见评论👇
显示更多
0
11
26
0
转发到社区
英伟达官方提供了免费的GLM 5.2 ,有需要的朋友可以冲了。RPM 50左右,还可以,一直loop还是很香的。 只需要注册一下,手机号国内即可验证 直达链接见评论👇
显示更多
0
48
175
24
转发到社区
受神佬 @berryxia 启发,打算玩玩数字人,争取这几天搓出一个60s的🐶
0
39
68
4
转发到社区
嘿嘿,skill写好了,开源了朋友们! 实现原理: 把文章或架构内容先压缩成一份结构化 JSON spec,再由本地 Python + Pillow 渲染出黑底手绘风格的 PNG、GIF 和可编辑的 Excalidraw JSON。 开源地址见评论👇 欢迎Star~ 算是抛砖引玉,目前只做了一个风格,更多风格大家可以自己告诉你的Agent DIY
显示更多
哈哈,早上看到 @YuLin807 发帖老外们做出类似漂亮的动图,我尝试了下用动图总结下我这个文章的项目,没想到很快就出来了 QingYue快来看看,效果可以不,可以我就整个skill 开源出来🐶
显示更多
0
23
124
27
转发到社区
哈哈,早上看到 @YuLin807 发帖老外们做出类似漂亮的动图,我尝试了下用动图总结下我这个文章的项目,没想到很快就出来了 QingYue快来看看,效果可以不,可以我就整个skill 开源出来🐶
显示更多
0
56
139
17
转发到社区
生视频中间效果感觉也是趋势,毕竟一个4K也太贵了😂 更类似于导演台的功能,减少生视频抽卡 不过我好奇Viewport Preview 究竟怎么做出来的,我看评论有很多骂的😂 感觉世界模型也可以作为中间态来辅助生视频🤔
显示更多
目前有个省钱生成人物视频的好方法: 就是用APIMart 家几乎不要钱的gpt image 2 生成宫格图片,然后用 seedance-2.0-mini 试效果,最后再用他家 doubao-seedance-2.0-face 生成最终片子 我用同样的图生视频方式,官方不支持人脸过不去 ,但是APIMart 秒过没有问题 看了下 APIMart 不光有claude-opus-4-8,还有新出来的Happyhorse-1.1 和doubao-seedance-2.0-mini 尝试用Happyhorse-1.1 和 doubao-seedance-2.0-mini 各生成了一个视频,大家猜猜左右哪个更好? 链接直达: 宫格图及生视频技巧提示词见评论👇:
显示更多
doubao-seedance-2.0-mini 已经上线,价格是官方的原价,并且"不卡人脸" doubao-seedance-2.5 预计 7 月份上线,到时候还是官方原价,如果豆包官方放开了,可以有折扣,平台也会给大家弄折扣的,在没有折扣的时候给大家原价使用,并且不卡人脸 该字段(tools)官方尚未明确支持 doubao-seedance-2.0-mini,暂勿使用,否则可能报错,待官方确认后再更新说明。 官方域名: 中国大陆可使用域名:
显示更多
我去,K神定义了LLM 用户界面和用户体验的第三次重大变革:LLM 是一个独立、可持续运行的系统,拥有全组织范围内的各种工具和上下文信息,能够与人类团队协同工作。 而这个恰恰是我在内部已经实现的东西:我基于Pi 实现了组织内与agent 的交互,且agent 针对不同群拥有不同记得记忆、kb、skill、model。而且不光对组织内,还能对你的客户群,高效且丝滑! 如果各位企业Leader有需要欢迎来细聊~
显示更多
This is a new paradigm for interacting with Claude that is significantly more "inline" with all the other human activity org-wide. Once you do all of the under the hood engineering work to make this "just work" (e.g. across tools, integrations, compute environments, memory, security, etc.), Claude basically joins the team in a seamless way - you can talk to it as you would talk to a person and it can help with a very large variety of workloads. Imo this is the 3rd major redesign of LLM UIUX. The first paradigm was that the LLM is a website you go to, the second was that it is an app you download to your computer. This third one is that it is a self-contained, persistent, asynchronous entity with org-wide tools and context, working alongside teams of humans. It really takes a while to wrap your head around it, but it works and it is awesome.
显示更多
0
28
87
11
转发到社区
我去,happyhorse 1.1 宫格生视频成了,人物保持的很好啊。AI视频写真来了
以免大家不知道:codex 其实也支持直接改你vibe 的网页 只需要用codex 自带浏览器,然后点击右上角的注释按钮即可 当然,如果仅仅是改图片、改网页,其实截图后用截图工具里的画笔也很方便,看大家选择了
显示更多
哇哦,Claude design 配 Fable 5 绝了,兄弟们请把帅字打在评论区!!
0
26
286
30
转发到社区
@dotey 宝佬试试这个,他们有个gropu by
codex 开发任意pet 教程,以手搓阿莫dei 为例🐶 仅需要codex和手(或嘴)就行,不需要任何外力,制作方式如下: 1. 用 Hatch Pet skill 以「愤怒的阿莫迪 Dario Amodei」为概念,确定包名 angry-amodei,显示名 Angry Amodei。 2.让 Codex 按宠物规格生成 9 个动画状态: Idle、Run right、Run left、Waving、Jumping、Failed、Waiting、Running、Review。 3. 把每个动作整理成 Codex 要求的图集规格: 单格 192x208,总图 1536x1872。 4. 后来你要求透明背景,我把最终 spritesheet.webp 改成透明背景版本,并确认尺寸正确。 5.codex 设置> Appearance > Pets (需要拉到最下) 选择自己开发的即可 最后感慨下: codex有了gpt-image-2 简直无敌
显示更多
Pets. Now in Codex. Use /pet to wake your pet.
0
7
118
15
转发到社区