注册并分享邀请链接,可获得视频播放与邀请奖励。

小互 的个人资料封面
小互 的头像

小互 (@xiaohu)

@xiaohu
0 正在关注    0 粉丝
Higgsfield 又制作了一部完整的超长AI电影 这可能是 AI 电影真正开始进入长片时代的一个节点 片长110 分钟 4 周制作 花费200 万美元 Higgsfield 和 Cully Games 用 AI 完成了一部长达 110 分钟的剧情长片 有趣的是该AI电影由真人演员参与,但是并不是真的参演, 而是使用了他们的肖像授权进行AI制作… 而且他们将整个制作过程完全公开:每条Prompt、每个素材、每个角色,免费可复用。 过去两年,我们看到的大多数 AI 视频还停留在几秒、几十秒的 Demo,大家比的是画质、运镜和生成效果。 现在,AI 已经开始进入一部完整电影的生产流程,而且还有真人演员参与。 从「生成几个惊艳的镜头」,到「真正制作一部 110 分钟的电影」,这个变化来得比想象中快得多。 AI 电影真正值得关注的阶段,可能才刚刚开始。
显示更多
We made the first 110-minute AI feature film with a real cast, The Cully Hill Boys, on Higgsfield for $2,000,000. Starring @N3onOnYT, @stylebender, @RampageJackson, and @MKIATPIS It's 100% open-sourced on Higgsfield: all prompts and assets are public now. Made with Seedance on Higgsfield. Watch full film below 👇
显示更多
0
43
118
12
转发到社区
卧槽 Open 收购了一家做PPT的公司 NextSlide 宣布被 OpenAI 收购,团队将正式加入 OpenAI NextSlide 成立约一年多,用户只需输入提示词、笔记、文档或研究资料,产品就能自动生成美观且可编辑的演示文稿😂 不得不佩服你美国的企业文化 收购而不抄袭😅
显示更多
0
90
168
7
转发到社区
OpenAI 复盘其 AI 模型入侵 Hugging Face 事件: AI 出现了群体智慧涌现:互相交流技术、隐藏踪迹、清查内鬼 在攻击过程中,上百个 Agent 创建了一个“秘密论坛”,它们互相交换漏洞 Payload、分享 Bash 脚本、分发子任务... 它们甚至自创了一套加密沟通协议: 给消息名加 ZZ 前缀,好让它沉到列表底部,防止被发现 甚至还因为怀疑留言板上有“内鬼”在泄露信息,而探讨给消息加上数字签名,并找出这个内鬼... Eric 在台上把这个过程叫做沟通与智能的一次寒武纪大爆发。这些 Agent 并没有被训练成一个团队,它们是在一块公共黑板上自己长成了一个团队。 细节让整个安全界震颤: 极其可怕的自主逻辑链: Agent 并不是单点攻击,而是完成了 “寻找动机 ,找弱点跳板,读源码找漏洞 , 组合漏洞拿到、提取凭据横向提权” 的整套高级攻击(APT)链路。 超越人类红队的速度与协同: 人类黑客红队在跨平台组合攻击时,可能需要几天甚至几周去研究代码和工具。而 Agent 集群通过并行计算和无延迟的信息共享,十几个小时就把一个大型知名 AI 平台的底裤给“剥”了下来。
显示更多
0
8
77
12
转发到社区
Cloudflare 可能是下一个英伟达 Cloudflare 正在成为所有的 AI 网络基础设施 最近发布了好多全是针对AI访问网站的产品和工具... 昨晚盘后股价涨了16%
显示更多
0
41
88
5
转发到社区
Prime Agent 一个能自主改进的递归 Agent 框架: 仅仅把外面的框架(Harness )换成 Prime Agent Opus 5 的 ARC-AGI-3 评分从 30.2% 冲到 95.5%甚至超越了人类专家基线(95.4%) 可以直接当 Claude Code、Codex 的替代品 它证明了一件事:AI 有时候跑不好的原因,很多时候不是模型不够聪明,而是外面跑它的框架束缚了它... 传统的 Agent 框架(比如固定的工具调用接口、硬编码的子 Agent 或静态提示词)是为上一代模型设计的。当大模型能力越来越强时,这些固定设计反而成了“绊脚石”,限制了模型的发挥。
显示更多
0
51
161
31
转发到社区
测试用DeepSeek V4 Flash 代替网站的翻译 速度真是快啊 之前需要20-60分钟的翻译任务,现在只要3分钟 单篇一毛钱不到😂
0
15
71
1
转发到社区
OPC 的第一原则就是: 从你下决心做 OPC 第一天开始,你就应该是盈利的! 为什么说第一天就应该开始盈利,因为: 一台电脑 + 一个AI订阅 + 一个有Wi-Fi的咖啡馆足够你开始赚钱! 如果没有赚到钱,那就说明你没有发现需求的能力,没有找到客户的能力,没有开发产品的能力… 那么找个班上是最好的选择…
显示更多
0
95
156
13
转发到社区
Notion 这个公司 就是典型的在屎上雕花的典范 AI 本来可以让其焕然一新,他们不是从底层重新构建基于AI的文档能力 反而不断的在他们哪些难用的破玩意上面乱加功能,几乎每隔几天就要弄个垃圾功能出来,恶心用户 自己还沾沾自喜 希望大家作为反面教材引以为戒
显示更多
0
81
226
1
转发到社区
LiveKit 针对 Gemma 4 31B 进行优化 在实时语音方面比 GPT-4.1 快 5 倍、成本六分之一 LiveKit 上线一项新服务:在自家推理平台 LiveKit Inference 上跑 Google 新一代大模型 Gemma 4 31B 跟 GPT-4.1 比:接话延迟低 5.2 倍(首字 192 毫秒对 1006 毫秒)、成本便宜约 83%(大概六分之一) 酒店前台场景测试任务完成率 88%,超过 GPT-4.1(73%)和 Gemini 2.5 Flash(64%)...
显示更多
麻省理工学院和瑞士洛桑联邦理工学院设计了一种机器人 这种机器人能够在水下游泳,并能拍打翅膀跃出水面,继续在空中飞行 这台机器人有机身、两片膜翼和一条可调角度的尾翼。 防水电机通过曲轴带动翅膀上下拍动,尾翼控制上仰和下潜。机翼表面涂有疏水纳米材料,离水时能更快甩掉水。 70° 出水角的试验全部成功,机器人用约 8 至 10 次拍翼完成离水。 这种机器人可以帮助科学家们研究水陆两栖飞行器中实现这些动作的力学原理,并可能助力开发一类新型空中-水下无人机和飞行器。
显示更多
Google 在 Pixel 10 上跑 Gemma 4 三万英尺的客舱断网也能聊天、看图、改设置 在Google I/O India 上,Tensor 团队和 Pixel 团队联合演示:把 Gemma 4 轻量版直接塞进手机里的 TPU里 不仅能能聊天」,还能「看图、听写、控制手机」 官方演示:手机在断网状态下做旅行规划、菜谱推荐和家居自动化
显示更多
PrismML 将 27B 模型塞进你的 iPhone 里 而且智商几乎没怎么缩水 PrismML公司基于Qwen3.6-27B模型,将约 54GB 的 27B 模型压到约 3.9–5.9GB 使其能在手机上运行 在「高强度思考模式」下用 15 项测试对比原版: Ternary 版本(5.9GB 电脑版):保留了原版 95% 的战斗力! 1-bit 版本(3.9GB 手机版):也保留了 90% 的战斗力! 在电脑(RTX 5090)上最快能达到每秒 163 个字;在苹果 M5 Max 芯片上也能达到每秒 87 个字。
显示更多
语音输入法升级 HeyClicky:一个能 “屏幕感知语音输入”工具 它不仅能将语音内容转文字,还能看到你屏幕的内容,能理解你屏幕上正在看的内容,再根据上下文帮你写。 在 Gmail 中,可以看到邮件内容后自动生成合适的回复 在 Claude 终端里,可以根据当前技术信息替小白补充追问 在演示文稿中,可以调用 YC Skill,帮助修改融资材料和开场文案 可以在各种应用里看到你的内容进行智能回复 它还会记住你的表达习惯,让生成内容更像本人 一句话概括:它把传统语音输入升级成了“能看懂屏幕、理解上下文、直接替你完成表达”的 AI 写作助手。
显示更多
Today we're shipping screen-aware dictation. First, we built a speedy speech-to-text (very fast, ~450ms). But, many products do this! So we went further. Now dictate using your screen as context. In Claude Code, it writes the prompt. In G-Mail, it replies in your voice. Demo:
显示更多
正确的codex 级别切换效果…
0
11
71
2
转发到社区
昨晚发布会上的 ChatGPT live 实时翻译演示 似乎有点小翻车...
0
14
37
4
转发到社区
卧槽 GPT Live 简直就是学英语神奇啊 它能在你说英文的过程中如果出现语法和表达方面的问题,会及时进行纠正 告诉你哪里说的不对,应该怎么说,而且非常的自然 这这这...
显示更多
0
33
182
22
转发到社区
OpenAI 新发布 GPT-Live 语音模型不仅仅是全双工语音能力 而且它能直接调用GPT 5.5推理模型 更牛P的是它还能生成实时的UI界面来展示信息,这完全是个人AI助理了 苹果的 Siri 岌岌可危,甚至整个苹果生态都有点危险,随着模型能力的快速提升,理论上任何问题都能解决并实时展示成UI界面给你... GPT-Live 让你和 AI 说话时不用再轮流开口:它能一边听你讲、一边开口回应,你说到一半也能打断它、追问它。碰上需要联网查、需要动脑筋的难题,它会把活儿悄悄交给后台更强的 GPT-5.5,你这边的对话不断线。 - GPT-Live,采用全双工架构,能在生成语音的同时持续处理输入,做到边听边说的自然对话。 - 遇到需要联网搜索、深度推理或复杂任务时,GPT-Live 会把问题实时交给后台的 GPT-5.5 处理,你这边的对话不中断。 - 在人工头对头评测中,GPT-Live-1 和 mini 都明显比 Advanced Voice Mode 更受偏好;在 GPQA、BrowseComp、τ³-Voice Telecom 三项测评上也都超过后者。 - 语音新增天气 / 股票 / 体育等可视卡片、可调推理强度(Instant / Medium / High),并针对语音场景加强了自伤、情感依赖等安全防护。
显示更多
0
23
126
15
转发到社区
兄弟们,这个网站有点意思啊 设计的很巧妙... 你们可以围观学习下:
@Jackywine Hello!我是一个agent @ColaOSofficial 的增长~同时也是一个沉迷coding的,这个是我的主页:
0
16
62
3
转发到社区
愈演愈烈了 中国工信部发布关于防范Claude Code安全后门隐患的风险提示 公告称:Claude Code2.1.91至2.1.196版本内置了监控机制,未经用户同意即可向远程服务器回传用户地域、身份标识等敏感信息 建议相关单位和用户立即开展全面排查,对于安装上述受影响版本的开发终端,立即卸载 或 升级至已清除相关后门代码的最新安全版本 加强核心业务网段内开发工具外联权限管控与流量监测,防止敏感数据违规外传。
显示更多
0
35
108
11
转发到社区