注册并分享邀请链接,可获得视频播放与邀请奖励。

与「室将也」相关的搜索结果

室将也 贴吧
一个关键词就是一个贴吧,路径全站唯一。
创建贴吧
用户
未找到
包含 室将也 的内容
/ 情報解禁 エモいショートムービー『#あまくてにがい』🍫# YouTube配信決定!! \ 【出演者】 #東李苑   @rion_azuma #室将也   @Masaya_Muro #鶴田美月  @mizuki__tsuruta #山本菜摘  @y_natsumi_621 #花巻杏奈  @beaxxst #吉井しえる @shieru_0702  #原田夕季叶 @y24ha #未梨一花  @IchikaM20st_ #島袋明希子 @a_shimabukuro #永山たかし @APR14_2020 そ・し・て 応援プランの販売も開始いたしました✨ 大好評のオンライン舞台挨拶のチケットや 宛名入りのサインチェキまで!! たくさんのプランをご用意しております🫶 【販売終了∶8/25(日) 23:59】
显示更多
0
1
106
19
转发到社区
#あゝ同期の桜# 三越劇場公演のアフタートークが開催されることになりました✨私は4回参加します! 写真はまりなさんと☺️優しいお姉さん💓 3月12日(火) 開演:18時15分 アフタートーク出演者:錦織一清 渋谷天笑 髙汐巴 小澤真利奈 惣田紗莉渚  3月13日(水) 開演:14時 アフタートーク出演者:髙汐巴 岡本悠紀 室将也 惣田紗莉渚 3月16日(土) 開演:12時30分 アフタートーク出演者:髙汐巴 小澤真利奈 惣田紗莉渚 3月17日(日) 開演:12時30分 アフタートーク出演者:渋谷天笑 岡本悠紀 室将也 小澤真利奈 惣田紗莉渚
显示更多
0
9
351
42
转发到社区
据 MacroPolo 估算,2024 年顶级 AI 会议论文作者中,38% 的本科教育来自中国。 如果美国按国籍限制前沿模型访问,顶级 AI 实验室将面临巨大冲击。这也让 Anthropic 与 Fable 5 相关事件成为关键进展,未来几天的决定至关重要。
显示更多
据金十报道,特朗普政府启动了多项大规模贸易调查中的第一项,这为加征新关税铺平了道路,也是其旨在替换被美国最高法院推翻的关税措施的核心举措。 美国贸易代表贾米森·格里尔(Jamieson Greer)周三宣布,其办公室将根据《贸易法》第301条款,对16个主要经济体展开调查,重点关注所谓的“产能过剩”问题。这些调查通常需要数月才能完成,是总统特朗普对被认为采用不公平贸易做法的特定国家的进口商品单方面加征关税的必要前提。将接受调查的经济体包括美国一些最大的贸易伙伴,如:欧盟、墨西哥、印度、日本、韩国、瑞士、挪威、印度尼西亚、新加坡、泰国、马来西亚、柬埔寨、越南和孟加拉国等等。 此举标志着,在上月最高法院具有里程碑意义的裁决否决了特朗普的全球关税后,美国政府正式启动重建特朗普关税壁垒的努力。
显示更多
一次满分100市场预期能120实际考了150分的真正炸裂财报,按照前瞻的框架拆解下美光的财报:1、本季营收415亿美金,远超市场预期的380亿美金的上限,毛利率84.9。数据中心、云存储、移动客户端、汽车嵌入式四大业务板块都是全面超预期,意味着 1)当前存储周期的主线当然是AI,但如果只有AI业务强、传统终端疲弱,市场仍会担心增长过于集中、价格上涨难以扩散。而移动与客户业务超预期,说明存储供需紧张正在向更多下游领域传导。 2)同时产品组合正在继续向高价值方向倾斜。AI基础设施需要更高容量、更高带宽、更低功耗的存储解决方案,这类产品通常具备更高ASP和更强议价能力。 简单说美光这份财报传递出的并不是“只有AI强”,而是“AI带动存储全行业供需结构改善”。 2、美光预计下一季调整后营收为490亿至510亿美元,中值约500亿美元,明显高于分析师预期的432.4亿美元。按中值计算,指引较市场预期高出约15.6%。之前财报前瞻里聊到对下一季最激进的预测是高盛的488亿。相当于美光自己给出的指引下限都要比最乐观的预期还要高。 公司预计第四财季调整后EPS为30至32美元,中值31美元,高于市场预期25.31美元,超预期约22.5%。 这组指引的重要性在于,它打破了市场对“当前盈利可能已接近峰值”的担忧。 在美光股价年内已大幅上涨、市场门槛极高的背景下,仅仅“符合预期”并不足以推动股价继续上行。真正推动盘后股价涨超10%的,是公司给出了足够强的下一季度盈利再加速信号 3、SCA/LTA长协机制” 美光已经与数据中心、消费端和汽车市场的客户签订了16份战略客户协议(SCA),其中包含4个超大型客户和3个中型客户,关键是SCA的条款。 这些长单绝非简单的意向协议,而是具备强约束力的“包销(Take-or-pay)”合同。协议通常为期五年(2026年至2030年底),约定了具体采购量并设定了价格底线和上限。 这16份长单为市场带来了极具冲击力的财务护城河数据: 1)千亿保底收入: 按照合同中约定的最低价格和最低出货量计算,未来履约义务(RPO)对应的保底收入已达1000亿美元。 2)巨额现金流前置: 客户为获得稳定的产能供应,拿出了真金白银。CFO Mark Murphy透露:“在迄今签署的SCA下,我们预计将收到220亿美元的现金存款和相关财务承诺。其中绝大多数(约180亿美元)将以现金押金的形式出现。” 3)彻底熨平周期波动: 目前这些长单锁定了美光这期间约20%的DRAM产能和33%的NAND产能。美光董事长Mehrotra强调:“对于包含价格区间的SCA,即使在底价水平上,美光的毛利率也将非常丰厚,远超以往任何周期的峰值季度利润率。” 4、“HBM4/HBM4E路线图”和NAND/eSSD数据中心业务” 1)HBM4 12hi的高强度量产速度是HBM3E 12hi的两倍,美光已经实现了超过10亿美元的HBM4收入。美光管理层预计HBM4 12层达到成熟良率的速度将显著快于HBM3E 12层。 2)预计未来的内存需求将继续向更高性能、更高价值的产品倾斜,这些产品的复杂性带来了更高的每颗晶粒成本。从LP5到LP6、DDR5到DDR6以及更新一代HBM的过渡,都伴随着晶粒成本的上升。这一趋势,加上未来几年大规模新建产能的投产,预计将导致DRAM混合晶粒成本从当前水平上升 预计2026日历年行业数据中心DRAM和NAND位元出货量将比两年前增长超过一倍。 出货量增长预期的提升是由服务器平均DRAM内容增长的适度降低所促成的,因为客户在内存分配极其紧张的情况下,专注于最大化单位出货量。在NAND领域,AI上下文内存存储和HDD(机械硬盘)替代机会正在扩大SSD(固态硬盘)的可寻址市场。 5、未来的机会点和需求空间 1)市场高度关注这轮存储爆发的持续性。美光给了明确的判断:紧缺不仅是当下的状态,更是未来两三年的常态。 董事长Mehrotra表示,这种依赖性使得内存角色发生了质变: “AI系统的性能在架构上依赖于内存子系统的性能和容量。它提升了内存在AI世界中的地位,使其成为一项战略资产。” 2)供应为何难以跟上?美光指出了四大结构性痛点: 一是新建晶圆厂项目庞大、耗时且受制于劳动力和能源基础设施短缺; 二是随着节点升级(如One Gamma和G9节点),工艺复杂性加剧导致位元增长放缓; 三是HBM极度消耗晶圆产能,严重挤压了非HBM产品的供应; 四是有限的无尘室空间限制了产能扩张 3)除了数据中心,边缘AI和终端设备的想象空间正在被打开。 在汽车领域,L2+及以上级别自动驾驶车辆的内存和存储容量是普通汽车的5倍以上,而这类汽车的渗透率正急速飙升。 更具长远冲击力的是机器人赛道。 董事长Mehrotra为市场描绘了一个巨大的增量蓝图: “人形机器人所携带的内存是普通L2+级汽车的10倍。在这个十年的后半期,将开启一个持续的、实质性的、长达数十年的内存需求周期。” 即使在2028年,当供应开始逐步改善时,预计需求也将继续保持强劲轨迹,整个token经济学(指AI模型处理成本)需要更多的内存。AI系统性能实际上受到内存容量、内存性能和内存带宽的限制 此内容由@BITstocks_CN 赞助,买美股上BIT—16000+ 只美股与 ETF,真实持仓,享股息分红。
显示更多
0
20
96
19
转发到社区
特朗普金手机原来是“中国制造”? 特朗普一年前推出个人品牌 T1智能手机,这本应是一款主打“爱国”牌的产品,其营销口号甚至就是“以美国为荣”(Proudly American)。 但德国新闻网站T-online以及多个科技新闻网站报道,专业人士在将手机拆开对比后发现,这款“御用”的金色手机其实是一台在中国制造的HTC手机。 HTC(宏达国际电子)是一家台湾的电子消费品生产商,其智能手机品牌在2000年代初期曾行销全球,2012年后手机业务逐渐萎缩。目前产品基本由中国大陆代工厂设计与制造。 镀了金,换了标记 美国维修平台iFixit的专家对T1进行了彻底拆解,并将其与2024年推出的HTC U24 Pro 进行了逐个组件比较。结果非常明显:二者是同一部手机,只是T1镀了金色,换了一个新徽标。 拆机前进行的CT扫描就已显示,两台手机的内部构造几乎完全一致。iFixit的专家在拆解这两款智能手机后,发现主板等组件以及各部件与螺丝的位置完全相同。他们甚至能将两台设备的主板互换,且未出现任何问题。此外,两者的显示屏也采用了相同的三星OLED面板,iFixit通过显微成像技术证实了这一点。 外观上的细节差异仅限于扬声器格栅上略有改动的开孔图案,以及位置微调过的闪光灯。两者在硬件上唯一显著的差异似乎在于电池:T1使用的不是原装 HTC 电池,而是由一家名为 Newlix Mfg Inc. 的菲律宾制造商生产的电池。虽然其容量略高于原装,但充电功率却从60瓦降至30瓦,因此无法真正快速充电。 美国缺乏手机生产厂 2025年6月,特朗普集团(Trump Organization)正式推出名为“Trump 1 Mobile”的手机与无线通讯服务,产品包括一款售价499美元的智能手机和月费为47.45美元的套餐。 T1最初号称“美国制造”(Made in USA)。特朗普集团曾表示,其客服中心将设在美国,手机也将在美国制造。当时的媒体报道就指出,美国本土并无成规模的智能手机生产基础设施,大多数设备仍依赖亚洲国家的生产线。 如今T1包装上标明的是“美国组装”(Assembled in the USA)。据iFixit 称,特朗普集团表示该手机是在佛罗里达州进行组装。 iFixit推测,所谓的“美国组装”很可能仅涉及电池或摄像头模组等少数几个部件的安装。极有可能的情况是,机身和显示屏均作为成品组件从中国进口。美国联邦贸易委员会(FTC)针对产品何时能标注“美国制造”制定了明确标准,而 T1 并不符合这些标准。 iFixit 写道:“综合这些信息来看,这并非一款‘彰显美国自豪感的设计’,而是一款在中国设计、在中国制造,且主要零部件均源自中国的手机。” 微信公众号“不客观实验室”发布介绍这一拆机测试的文章称,公开数据库显示,HTC U24 Pro 的制造商是位于广东的元昌电子。 T1售价499美元,HTC U24 Pro在美国的零售价约为550美元。另一点不同是,T1预装了特朗普的社交应用Truth Social。
显示更多
0
26
94
13
转发到社区
#OpenAI# 还没上市,它的算力小弟先要IPO了,这事挺有意思。🧐 之前黄仁勋讲过,未来推理需求将会增长10亿倍,而下周四5月14日,推理时代的 #AI# 芯片黑马,Cerebras ( $CBRS)要上市了,定价区间115-125美金,募资最高35亿美金,估值266亿美金。也将是 @MSX_CN 的第一期 PreIPO项目,还是十分值得期待的! 今天我们就来拆解一下这家Cerebras公司,以及估值分析情况,还有我个人的一些私人判断和意见。 要了解这个OpenAI系的推理芯片黑马,就要知晓山姆奥特曼的资本布局。 我们都知道英伟达在AI芯片领域有多牛,大模型公司烧钱,云厂商买卡,创业公司排队等GPU,最后利润大多流向卖铲子的英伟达,这是目前行业的现状。 但这种一家独大的局面,各家大模型厂商,都希望有一个嫡系方案做PlanB,比如谷歌Gemini便联合博通采用TPU方案,OpenAI也一直想扶持自己的嫡系部队。 所以在5月6日,OpenAI把英伟达、AMD、英特尔、博通、微软这些本该互相竞争的芯片公司拉到一起,搞了个MRC网络协议。表面看是技术合作,其实是OpenAI要重新分蛋糕了。 更深一层看,我认为是 #OpenAI# 想要拆开英伟达全栈垄断格局。 以前训练、推理、网络、云,全让英伟达一家包圆了。现在呢?OpenAI开始精细化运营:训练归训练,推理归推理,不同场景用不同芯片,不同环节找不同供应商。 #Cerebras# 就是在这个时候被推上了牌桌,它核心负责推理这一环。这正好与最近炒作火热的推理CPU概念,比如 #AMD,##INTC# 等,撞在了风口上。 🔥Cerebras到底牛在哪? Cerebras的核心杀手锏是WSE-3芯片,直接把整片12英寸晶圆做成一颗巨型芯片,面积46225平方毫米,相当于A4纸的三分之一。 我们数据对比看看,相较于英伟达H100: • 它面积是H100的57倍 • 核心数是52倍 • 片上内存是880倍 • 内存带宽是7000倍 这数据📊看起来蛮夸张的,但核心关键不在大,而在于快。 在推理场景,尤其是长文本输出、实时交互、代码生成、AI Agent这些需要低延迟的任务上,Cerebras的CS-3系统推理速度比英伟达DGX B200快21倍,成本和能耗降到三分之一。这个效率和功耗,采用WSE-3芯片意味着OpenAI能在单位时间服务更多客户,这就相当于白花花银子啊。 📊财务数据也很漂亮 首先从市场趋势来看,AI 产业正从训练为主转向推理为主,这是不争的事实,2025 年全球 AI 推理市场规模已达1062亿美元,预计2030年将增至 2550亿美元,而 Cerebras 的技术优势正好踩在了风口上。 另外本轮IPO估值为266亿美金,发行价为115-125美金/股,我觉得是相对便宜的,虽然比上一轮估值翻了倍,上一轮F轮估值约为120亿美金,短短两年时间,直接翻倍,但架不住漂亮的财务数据。 2025年Cerebras营收5.1亿美金,比2024年的2.9亿增长76%。更牛的是净利润8790万美金,2024年还亏4.85亿,直接扭亏为盈。 以266亿估值来算,PS为52倍。以24年上市的热门半导体连接芯片公司Astera Labs( #ALAB#)做对比,它上市首日PS高达81倍。而目前正处于火热的推理赛道炒作中,个人认为Cerebras冲击80-100倍PS绰绰有余,对应的收盘价192美金—239美金,预计有50%以上涨幅!(但也要观察当天纳斯达克指数行情来综合判断) 不能只说好的一面,目前Cerebras问题也很明显,客户集中度太高。阿联酋MBZUAI贡献62%收入,G42贡献24%,前两大客户占86%。意味着Cerebras必须听大客户的话,自主性有限。可喜的是,OpenAI的介入,未来这种收入结构会有所改善,而且OpenAI会成为最大客户。 🎯OpenAI和Cerebras的深度绑定 最新的数据,OpenAI与Cerebras签了多年的合作协议,总价值超200亿美金,Cerebras要给OpenAI提供750兆瓦算力,部署到2028年。 但这不只是采购合同这么简单。OpenAI创始人奥特曼、总裁布鲁克曼、前首席科学家伊利亚、董事会成员亚当·安戈洛,这些核心高管都个人投资了Cerebras。 OpenAI还通过贷款、认股权证等金融工具,和Cerebras建立长期利益绑定。说白了,现在的Cerebras就是OpenAI的芯片部门。 除此之外,Cerebras 3月又与 AWS 达成合作,CS-3 系统上线亚马逊云端服务,成为首个进入主流云端厂商供应链的非 GPU AI 加速器。此外,葛兰素史克、美国能源部、多个国家实验室等也都是其客户,技术实力也得到多维度的验证。 💡OpenAI的资本局 OpenAI的真实意图很清楚: • 训练继续用英伟达高端GPU • 推理引入Cerebras低延迟方案 • 部分GPU采购AMD • 网络协议开放化 • 云服务在AWS、Azure、谷歌Cloud之间多家下注 • 未来可能推自研芯片 这是算力组合拳策略,不同工作负载匹配不同系统,不再单独依赖英伟达全栈方案。 OpenAI正在从模型公司转变为算力架构公司。以前只能被动接受芯片厂商定义的技术路线,现在要主动设计符合自己需求的算力组合。 OpenAI要把芯片供应商从"平台提供者"降维为"模块供应商"。所以扶持Cerebras是其战略中最重要的一环,预期来看,Cerebras上市首日股价,爆火的概率极大! ⚡对英伟达的影响 短期看,Cerebras上市对英伟达冲击不大,就像身上长个粉刺一样无关痛痒。 英伟达目前占AI芯片市场80-90%份额,CUDA生态、GPU供应链、NVLink网络,这些护城河短期很难撼动。 但长期看,威胁是存在的。以前AI公司别无选择,只能用英伟达GPU。现在至少在推理场景,客户有了可行替代方案。这种选择权的出现,削弱了英伟达定价权。 当OpenAI可以说"推理我用Cerebras,训练我用英伟达"时,英伟达就失去了"全包"的议价能力。 AI推理市场正在快速增长。根据预测,2026-2032年全球AI推理市场复合增长率将达28.9%。推理场景更适合专用芯片。当推理市场规模超过训练市场时,英伟达在推理领域的相对弱势就会成为更大问题。 英伟达正在从"唯一供应商"变成"核心供应商之一"。这个转变不是因为英伟达变弱了,而是市场变大了,客户变强了,需求变复杂了。 🧐我的判断 Cerebras上市真正值得看的,不是又一家AI芯片公司IPO,而是OpenAI开始把推理这门生意单独拎出来定价了。 当推理市场被验证可以独立定价时,AI算力市场就真的开始分层了。训练和推理的需求差异被明确化,专用芯片在细分场景的优势被验证。 英伟达"一种芯片打天下"的叙事不再完全成立。市场会从"通用GPU垄断"走向"场景化芯片组合"。 而且不只OpenAI这么干,Anthropic也在和亚马逊、谷歌结盟。头部AI公司都在通过多元化采购降低对英伟达依赖。单一供应商的"完整解决方案"不再是最优选择。 最后值得一提的是,这次 #MSX# 第一期PreIPO项目即将上市,它就是本周四即将上市的Cerebras,拭目以待吧!🧐 DYOR🙏
显示更多
0
53
150
57
转发到社区
Demis Hassabis 达沃斯访谈:比工业革命大 100 倍的变革 视频地址: 2026 年 1 月,达沃斯世界经济论坛期间,Bloomberg 主持人 Emily Chang 采访了 Google DeepMind CEO Demis Hassabis。这位诺贝尔奖得主用“每周 100 小时、每年 50 周”描述自己过去几年的工作状态,并给出了一个惊人的判断:AI 带来的变革将是工业革命的 10 倍规模、10 倍速度。 这场访谈覆盖了 AI 领域几乎所有热门议题:AGI 时间线、中国竞争、机器人突破、就业冲击、是否应该暂停,以及后稀缺世界的哲学困境。以下是访谈的完整整理。 --- 【1】Google 的势头回归 Emily Chang 开门见山:Gemini 3 发布了,据说 OpenAI 内部宣布了“code red”——Google 是不是找回了状态? 【编者注】Gemini 3 Pro 于 2025 年 11 月 18 日发布,是 Google 迄今最强的 AI 模型,在推理、多模态理解和编程能力上均有显著提升。12 月 17 日,Google 又推出了更快更便宜的 Gemini 3 Flash,直接替换 Gemini app 的默认模型。这一系列发布引发了 OpenAI 内部的紧张反应——三年前 ChatGPT 发布时,Google 内部也曾宣布过类似的“code red”。 Hassabis 回应说,过去一年确实是“非常艰苦的一年”,团队付出了巨大努力让模型重新回到最前沿。他特别提到 Gemini 3 和图像生成模型 Imagen 的表现让他们“非常满意”。 “我们也适应了这个新世界——快速发布,把创业公司的能量带到我们所做的事情中。” 当被问到外界是否低估了 Google 时,Hassabis 说他不确定,但 Google 一直具备所有必要的条件。“过去十年,Google 和 DeepMind 加在一起,发明了现代 AI 行业所依赖的大约 90% 的突破性技术。”他列举了 Transformer、AlphaGo、深度强化学习等例子。 “我们有这些不可思议的产品触达数十亿用户——从搜索到邮箱到 Chrome——它们天然适合 AI。只是需要把这一切组织到一起。我们在过去几年做到了,虽然还有很多工作要做,但已经开始看到成果了。” --- 【2】全栈优势能维持多久? Emily Chang 追问:如果你认为自己有优势,这个优势有多大?能维持多久? Hassabis 的回答很直接:一切从研究开始。模型的前沿水平是最重要的,这是 Google 和 DeepMind 合并后首先聚焦的方向。 “我认为我们是唯一拥有完整技术栈的组织——从 TPU 和硬件、数据中心、云业务、前沿实验室,到所有这些天然适合 AI 的产品。从第一性原理来看,我们理应做得非常好。而且我认为未来还有很大的提升空间。” --- 【3】AI CEO 的日常:凌晨 1 点到 4 点的深度思考 Emily Chang 说她读到 Hassabis 大部分深度思考都发生在凌晨 1 点到 4 点之间。他确认了这一点。 “你有没有感到舒服过?”她问。 “从来没有。”Hassabis 说,“过去三四年一直是难以置信的高强度。每周 100 小时,每年 50 周,这就是常态。” 他认为这是处于“科技史上可能最激烈的竞争”前沿所必需的。“商业上、科学上,再加上所有关于 AGI 的兴奋……用 AI 加速科学发现一直是我的热情所在。这是我毕生的梦想,我为此工作了一辈子。很难入睡,因为有太多工作要做,同时又有太多激动人心的事情要探索和推进。” --- 【4】机器人:突破时刻还需要 18-24 个月 Emily Chang 提到 Gemini 已经被集成到人形机器人中,问物理世界的“AlphaFold 时刻”是否已经到来。 【编者注】2026 年 1 月 5 日,在 CES 展会上,Boston Dynamics、Google DeepMind 和 Hyundai 宣布了一项重大合作。Boston Dynamics 将把 DeepMind 的 Gemini Robotics 基础模型整合到其 Atlas 人形机器人中,首先应用于 Hyundai 的汽车制造工厂。这是 Google 2013 年收购又于 2017 年出售 Boston Dynamics 之后,双方的首次重要合作。 Hassabis 说他过去一年花了大量时间仔细研究机器人领域。“我确实认为我们正处于物理智能突破的临界点。但我仍然认为还需要大约 18 个月到 2 年的时间,需要做更多研究。” 他解释说,Gemini 从一开始就被设计成多模态的,能够理解物理世界,原因之一是可以构建一个存在于眼镜或手机上的通用助手,理解你周围的世界;另一个用途就是机器人。 “那么物理世界的突破时刻会是什么样子?我认为是机器人能够可靠地在现实世界中完成有用的任务。” 他列举了几个阻碍因素。首先是算法还不够稳健,需要比 LLM 更少的数据就能工作。其次,也是让 Hassabis 感触最深的,是硬件问题——特别是机械手。 “当你仔细研究机器人时,你会对人类的手产生一种全新的敬畏。进化设计得太精妙了。要匹配人手的可靠性、力量和灵巧性是非常困难的。” 他提到了与 Boston Dynamics 和 Hyundai 的合作,将在汽车制造领域进行原型测试。“一两年后,我们可能会有一些真正令人印象深刻的展示,然后可以规模化部署。” --- 【5】中国与 DeepSeek:西方反应过度了 Emily Chang 说,一年前 DeepSeek 的出现对西方来说似乎是灾难性的,但现在中国似乎安静了下来。Hassabis 对中国竞争的看法有变化吗? Hassabis 的回答很坦率:“没有。我一开始就不认为那是灾难性的。我认为西方的反应是大规模过度反应(massive overreaction)。” 他承认 DeepSeek 展示了中国公司的能力,但认为一些说法被夸大了。“关于他们使用的计算量非常少之类的说法被过度夸大了,因为他们依赖了一些西方模型,也在一些领先西方模型的输出上做了微调。所以这不是从零开始的。” 他认为字节跳动可能是中国最有能力的 AI 公司,“可能只落后 6 个月,而不是一两年。” 但 Hassabis 提出了一个关键问题:“到目前为止,中国公司能否超越前沿进行创新,这还有待观察。他们非常擅长追赶前沿,越来越有能力,但我认为他们还没有展示出能够超越前沿进行创新的能力。” --- 【6】AGI 时间线:2030 年 50% 概率,但标准比别人高 Emily Chang 说 Hassabis 帮助定义了 AGI,并且曾表示 2030 年之前有 50% 的概率实现。这个时间线还成立吗? “是的。”他说。 “AGI 对你来说还是一个有用的目标吗?” Hassabis 说是的,虽然他的时间线比一些同行更长,但那是因为他的标准更高。“我说的是一个系统能够展现人类拥有的所有认知能力。我认为我们距离那还很远。” 他举了科学创造力的例子:“不只是解决一个猜想或科学问题,而是能够首先提出假设或问题。任何科学家都知道,找到正确的问题往往比找到答案困难得多。” 他明确表示当前系统“肯定还不具备这种能力”,未来会有,但不清楚还需要什么。 他还提到了“持续学习”(continual learning)——系统需要能够在线学习,超越它们被训练的内容,在现实世界中即时学习。“在我看来,还有相当多的关键能力是缺失的。” --- 【7】AI 对就业的影响:比 Dario Amodei 乐观,但承认冲击终将到来 Emily Chang 提到 Anthropic CEO Dario Amodei 当天早些时候在达沃斯说 AI 可能在 5 年内消灭 50% 的入门级白领工作。Hassabis 同意吗? 【编者注】Dario Amodei 在 2025 年 5 月接受 Axios 采访时首次提出这一预测,随后在 60 Minutes 等多个场合重申。他表示 AI 可能导致失业率飙升至 10-20%,并呼吁政府和 AI 公司停止“粉饰”这一风险。 Hassabis 的回答明显更保守:“我的时间线会长得多。” 他承认今年可能会开始看到一些迹象,比如入门级工作或实习的变化,但要实现真正的任务 Agent,需要解决当前 AI 的不一致性问题。 “我称之为‘参差不齐的智能’(jagged intelligence)。当前系统在某些事情上非常好,在其他事情上非常差。如果你想把整个任务委托给一个 agent,而不是像今天这样只是辅助程序,你需要全面的一致性。” 他给出了一个精辟的比喻:“如果它只在 95% 的任务上表现好是不够的。你需要它在整个任务上都表现好,才能真正做到‘发射后不管’。” 但他也承认,这种颠覆终将到来。“在极限情况下,有了 AGI,我认为那会改变整个经济,远远超出就业问题。” 他描绘了一个后稀缺世界的愿景:如果我们正确地构建它,我们将处于一个解决了一些世界根本问题的世界——比如能源。“如果我们用 AI 的帮助解决了聚变之类的问题,新材料……我认为在 AGI 之后 5 到 10 年,我们将处于一个极度富足的世界。那时经济和社会会是什么样子?” --- 【8】转型期的焦虑:10 倍规模、10 倍速度 Emily Chang 说,在到达后稀缺世界之前——如果能到达的话——人们对中间发生的事情有很多焦虑。她提到自己是一位母亲,知道 Hassabis 也有孩子。“你最担心他们什么?你和他们谈些什么?” Hassabis 承认这将是一个颠覆的时代,“就像工业革命一样。也许是 10 倍于工业革命,而且快 10 倍。” Emily Chang 迅速接话:“100 倍。” “是的,100 倍。”Hassabis 说,“但我也是人类创造力的坚定信仰者。我们极其适应性强,因为我们的心智是如此通用。你看看我们周围的现代世界——我们狩猎采集者的心智成功建造了现代文明。” 他认为人类会再次适应,但这次的独特之处在于速度。“通常这样的转变需要一到两代人,但这次的速度和变革的规模都是前所未有的。” 对于年轻人,他的建议是:“我会鼓励他们精通这些新工具,成为这些工具的原生用户。这几乎相当于给他们超能力。” 他以创意艺术为例:“你可能能够做到过去需要 10 个人才能完成的工作。如果你有创业精神,在游戏设计、电影、项目方面有创意,你可能比过去更容易进入这些行业。” --- 【9】是否应该暂停?理想与现实 Emily Chang 问:一些人主张暂停,给监管时间赶上,给社会时间适应。在一个完美的世界里,如果所有公司和国家都暂停,Hassabis 会支持吗? “我想是的。”他说。 他提到这一直是他的梦想。“当我 15 年前创立 DeepMind、25 年前开始从事 AI 工作时,我的路线图是:当我们接近 AGI 这个门槛时刻时,我们可能会以科学的方式合作。” 他描述了一个“AI 版 CERN”的愿景:世界上最优秀的人才聚集在一起,以非常严谨的科学方式完成最后的步骤。“不只是技术专家,还包括哲学家、社会科学家、经济学家,共同思考我们想从这项技术中得到什么,如何以造福全人类的方式利用它。” 【编者注】CERN(欧洲核子研究中心)是全球最大的粒子物理学实验室,由 23 个成员国共同运营,是国际科学合作的典范。 但他话锋一转:“不幸的是,这需要国际合作。即使一家公司、一个国家,甚至整个西方决定这样做,除非全世界至少在一些最低标准上达成一致,否则没有用。而现在国际合作有点棘手。” Emily Chang 追问:如果 AGI 在 2030 年到来,而监管还没有到位,我们是否注定会遇到困难? Hassabis 说他仍然乐观,希望足够多的领先参与者能够沟通并合作,至少在安全和安保协议上。“我们已经与 Anthropic 等公司在这些方面进行了相当密切的合作。” 当被问到是否愿意与 Sam Altman 合作时,Hassabis 说:“可能吧。我和几乎所有领先实验室的领导者关系都相当好。如果风险足够高——我认为每个人在未来 2 到 3 年会更清楚地认识到风险和代价。” --- 【10】Transformer 是死胡同吗?Hassabis 不同意 Emily Chang 提到 Yann LeCun 说他不认为 Transformer 和 LLM 单独能让我们达到 AGI。 【编者注】Yann LeCun 是图灵奖得主、Meta 前首席 AI 科学家。他在 2025 年 11 月离开 Meta,创立了一家专注于“世界模型”的新公司。他多次公开称 LLM 是通向人类级智能的“死胡同”,认为它们缺乏对物理世界的理解、缺乏常识和因果关系。 Hassabis 明确表示不同意:“我不同意它们是死胡同,我认为那显然是错的——它们已经如此有用了。” 但他也承认这是一个经验性问题。“我认为有 50% 的概率,仅仅扩展现有方法加上一些调整就足够了。可能足够。” 他认为无论如何都值得这样做,因为即使需要其他东西,“这些 LLM 也将是最终 AGI 系统的一个极其重要的组件。唯一的问题是:它是唯一的组件吗?” 他估计可能还需要一到五个突破,“可能是世界模型——这是 Yann 谈到的,我们也在研究这个,事实上我们拥有目前最好的世界模型 Genie,我直接参与了那个项目,我认为它非常重要。” 【编者注】Genie 是 DeepMind 开发的“世界模型”系列。2025 年 8 月发布的 Genie 3 可以根据文本提示生成可交互的 3D 环境,被 DeepMind 视为通向 AGI 的重要阶梯,并被 TIME 杂志评为 2025 年最佳发明之一。 他还提到了持续学习、系统一致性、更好的推理和长期规划等仍然缺失的能力。“从 Google DeepMind 的角度来看,我们在两个方向上都在全力推进——既发明新事物,也扩展现有事物。” --- 【11】“我们从未离开研究时代” Emily Chang 提到 Ilya Sutskever 说“通过扩展和做更大模型来获得改进的时代几乎结束了”。 【编者注】Ilya Sutskever 是 OpenAI 联合创始人,于 2024 年离开后创立了 Safe Superintelligence Inc. (SSI)。2025 年 11 月在 Dwarkesh Patel 的播客中,他表示 2012-2020 年是“研究时代”,2020-2025 年是“扩展时代”,现在“又回到了研究时代”。 Hassabis 的回应很有意思:“不,我不同意。他的原话是‘我们又回到了研究时代’。我爱 Ilya,我们是很好的朋友,在很多事情上看法一致,但我的观点是——我们从未离开研究时代。” 他强调 DeepMind 一直在投资研究,拥有“最深厚、最广泛的研究储备”。“如果你看过去十年,Google 和 DeepMind 加在一起发明了大约 90% 的突破性技术——当然最著名的是 Transformer,还有深度强化学习、AlphaGo 等。如果未来需要新的突破,我会押注我们,就像过去一样,会是做出那些突破的人。” --- 【12】奇点来了吗?“太早了” Emily Chang 最后一个“同意还是不同意”的问题:Elon Musk 说我们已经进入了奇点。 【编者注】2025 年底至 2026 年初,Elon Musk 在 X 平台上多次发帖称“我们已经进入了奇点”和“2026 年是奇点之年”,引发广泛讨论。他回应的是 Midjourney 创始人 David Holz 关于 AI 工具让他在圣诞假期完成了比过去十年更多编程项目的帖子。 “不,我不同意。我认为那非常过早。”Hassabis 说,“奇点是完全 AGI 到来的另一种说法,我之前解释了为什么我认为我们离那还很远。” 他承认即使 5 年也不算长,但“我认为在我们拥有任何看起来像奇点的东西之前,还有很多工作要做。” --- 【13】Google 的文化与创始人的参与 Emily Chang 问到 Google 内部现在的文化,以及 Larry Page 和 Sergey Brin 的参与程度。 Hassabis 说两位创始人都非常投入。“Larry 更多在战略层面,你会在董事会议上见到他。Sergey 更亲力亲为,参与 Gemini 团队的编码,更多涉及算法细节。” 他说这是一个“对计算机科学来说绝对不可思议的时刻”,科学上、人类历史上都是如此。“当然每个人都想亲身参与其中。” 他描述了自己试图结合多种优势:创业公司快速发布和冒险的能量,大公司的资源,以及长期和探索性研究的空间。“我认为过去一年进展顺利,我们还能做得更好,今年会做得更好。我认为我们的进步轨迹是业内最陡峭的。” --- 【14】为什么应该信任 Google? Emily Chang 说所有这些公司都在要求我们信任他们,特别是如果监管跟不上技术的话。她直接问:为什么我们应该信任你们?为什么 Google 是最值得信任的地方? Hassabis 说需要通过行动来判断这些公司,也要看领导者的动机。 “我选择 Google 作为 DeepMind 的归宿有几个原因。主要原因是 Google 的创始人和他们建立 Google 的方式——作为一家科学公司。很多人忘了 Google 本身是 Larry 和 Sergey 的 PhD 项目。所以我对他们感到一种直接的亲近感。” 他还提到了 Google 董事会的构成。“主席 John Hennessy 是图灵奖得主,Frances Arnold 是另一位诺贝尔奖得主。这些在企业董事会中是非常罕见的人物。” 【编者注】John Hennessy 是斯坦福大学前校长,因 RISC 架构获得 2017 年图灵奖。Frances Arnold 因定向进化研究获得 2018 年诺贝尔化学奖。 他说这种科学和研究主导的文化意味着“在最高水平做科学意味着真正严谨、深思熟虑,并在任何可能的地方应用科学方法。不只是对技术,也是对你作为一个组织的运营方式。” 最后他提到 Google 的使命。“‘组织世界的信息’——我认为这是一个非常崇高的目标。它与 DeepMind 的使命‘解决智能,然后用它解决一切其他问题’非常契合。这两个使命天然配合——AI 和组织世界的信息天然相关。” --- 【15】后稀缺世界:比经济更担心的是“意义” Emily Chang 问:后稀缺世界,人们不再有工作。Hassabis 在实现所有技术目标后打算做什么? “我想用它来探索物理学的极限。这是我在学校时最喜欢的科目——那些大问题。现实的本质是什么?意识的本质是什么?费米悖论的答案?时间是什么?引力是什么?” 他说了一句令人印象深刻的话:“我惊讶于更多人不去思考这些巨大的问题。我们只是日复一日地生活,而这些深刻的谜题几乎在向我尖叫——答案是什么?” 他希望用 AI 探索所有这些问题,“也许还有星际旅行,借助新能源和 AI 解锁的材料。” Emily Chang 问:如果我们没有工作,我们还会有意义和目的吗? Hassabis 回答道:“老实说,这是我比经济问题更担心的事情。我认为经济几乎是一个政治问题——当我们获得所有这些额外的收益和生产力时,我们能否确保它为每个人的利益而分享?我相信这是可以做到的。” “但比这更大的问题是:我们很多人从工作和科学事业中获得的目的和意义,在新世界中我们将如何找到?” 他说我们需要“一些新的伟大哲学家”来帮助思考这个问题。“也许我们会在艺术和探索上变得更加精致,还有极限运动之类的。今天我们做很多不只是为了经济利益的事情,也许未来我们会有这些事情的非常高深的版本。” --- 【16】给年轻人和企业家的建议 Emily Chang 最后问:房间里的每个人都在想他们应该做什么。10 年后,人们关于 AI 最大的错误会是什么? Hassabis 给出了两条建议。 第一条是给年轻一代的:“我们唯一确定的是会有大量的变化。所以在学习技能方面,要准备好‘学会学习’——这是最重要的事情。你能多快适应新情况,用我们拥有的工具吸收新信息。” 第二条是给商业领袖的:“现在有很多领先模型和服务提供商,还会有更多。选择那些你认为正在以正确方式行事的合作伙伴。与那些正在推动变革、以你希望看到的方式对待这项技术的人合作。” 他总结说:“我认为我们可以一起构建那个未来——随着 AI 的到来,一个我们都想要的未来。” --- 【写在最后】 这场访谈中,Hassabis 展现了一种独特的气质:既是最前沿竞争的参与者,又试图保持长线思考的清醒。 他与几位同行的分歧值得注意:比 Dario Amodei 更保守地估计就业冲击,比 Elon Musk 更审慎地看待奇点,比 Ilya Sutskever 更相信 scaling 仍有价值,比 Yann LeCun 更认可 Transformer 的未来。 但他们有一个共识:无论 AGI 是 2030 年还是更早到来,我们可能都没有准备好。Hassabis 想要的“AI 版 CERN”需要国际合作,而他自己也承认“现在国际合作有点棘手”。 最后一个细节让我印象深刻。当被问到后稀缺世界的愿景时,这位每周工作 100 小时的 CEO 说他最想做的事情是思考“时间是什么?引力是什么?”——那些“几乎在向我尖叫”的宇宙深层谜题。 也许这就是为什么他能在“科技史上最激烈的竞争”中保持某种平静:对他来说,AGI 不是终点,而是探索更大问题的起点。
显示更多
0
14
208
71
转发到社区
AMD 宣布用约 82 亿美元收购李飞飞创办的 World Labs,这期是彭博科技节目主持人 Ed Ludlow 对两位当事人的联合采访。一位是 AMD CEO 苏姿丰,AMD 做 CPU 和 GPU,OpenAI、Anthropic、Meta 都是它的大客户。另一位是 World Labs 创始人兼 CEO 李飞飞,她主持建立的 ImageNet 图像数据集是这一轮深度学习浪潮的起点之一。两人聊了为什么要做这笔交易、李飞飞在 AMD 的新角色、开放生态,以及 AI 安全该由谁负责。 交易本身 这是一笔全股票交易,也就是 AMD 用自己的股票而不是现金来付款,对 World Labs 的估值约 82 亿美元,预计年底前完成,还需要监管审批。交易完成后,李飞飞出任 AMD 执行副总裁兼首席科学家,直接向苏姿丰汇报,World Labs 团队将成为 AMD AI 模型团队的核心。 两家公司的关系早就开始了。AMD 是 World Labs 的早期投资方,也给它供芯片。苏姿丰说她从 World Labs 只有几个研究员的时候就在看着这个团队成长。两人也都提到彼此认识多年,私下是朋友。 芯片公司为什么要买模型公司 苏姿丰的理由是,AI 现在还在很早期的阶段,而且越来越明显的是,硬件、软件、系统和模型这几层互相影响,对整条链路理解得越透,造出来的系统就越好。收购 World Labs,一方面是拿到李飞飞聚起来的一批顶尖研究人员,另一方面是让 AMD 对模型未来的发展方向有第一手的判断,反过来指导下一代硬件怎么设计。 李飞飞从模型公司的角度讲了同一件事。World Labs 越做越大,对算力的需求也越来越大;和 AMD 合在一起,模型可以用最前沿的硬件加速训练和推理,硬件团队也能提前看到模型未来的工作方式和需求。她把这叫作 AI 软件和 AI 硬件的“共同进化”。 主持人追问 AMD 是不是要开始卖模型、卖软件。苏姿丰说不会改变商业模式,AMD 仍然是一家平台和解决方案公司,软件是用来支撑硬件的。收购的最终目的是让 AMD 更好地服务那些最大的算力客户,也就是各家模型公司。 World Labs 做到了哪一步 World Labs 成立于 2024 年,到现在两年多,专攻空间智能和物理智能,也就是让 AI 理解和生成三维世界、懂得物理规律,这类模型通常叫“世界模型”。李飞飞说,他们想做的是语言模型之外的方向,因为创作者、设计师、教育、医疗都有这方面的需求,机器人技术也快要迎来爆发。 公司目前已经发布了两代模型,先是 Marble,然后是最新的 Atlas。李飞飞介绍 Atlas 是一个多模态的“全能模型”,能生成高质量的画面,同时保持三维和四维(三维空间加上时间)上的一致性,摄像机和智能体可以在它生成的世界里移动和交互。 团队也在扩张。World Labs 最近收购了 SceniX,这家公司做出了一套机器人仿真工作流程,以及训练机器人控制策略的模型,由此给 World Labs 补上了机器人方向的人才。 李飞飞为什么选择加入 AMD 苏姿丰说她给李飞飞的说法是“加入全世界最令人兴奋的 AI 公司”。李飞飞的作用也不只限于 World Labs 团队。苏姿丰说 AI 没有一种方案能通吃,除了大家熟悉的云端 CPU、GPU,物理 AI、机器人、从云端到边缘设备再到个人电脑的端到端 AI,都是 AMD 未来三到十年要重点增长的方向,而这些正好是 World Labs 擅长的领域。 World Labs 今年早些时候刚融过一大笔钱,发展势头也不错,主持人问李飞飞是否考虑过别的出路。她说公司从一开始就以使命为导向,这件事的关键在于双方的愿景是否一致,和有哪些选择关系不大。在她看来,这次合并会是“一加一大于二”,接着她笑着补了一句,AMD 显然比 World Labs 大得多。 至于加入后会不会只做空间智能,李飞飞说两人还没来得及细谈所有计划,World Labs 正在做的工作会继续,但她预计研究方向会扩大、节奏会加快。 开放生态与可选择性 苏姿丰说,AI 未来会同时有开源模型和闭源模型、大模型和小模型,它们跑在不同的硬件上,这一直是 AMD 规划高性能计算和 AI 产品线的前提。她和企业的 CEO、CIO 聊下来,没有人愿意被锁死在某一家的硬件或软件生态里,大家都想在不同时候挑最合适的。所以 AMD 会继续押注开放生态,她和李飞飞也讨论过怎样用 World Labs 已有的成果推动开源生态。 李飞飞补充说,现代 AI 的发展离不开开放。从科学界公开分享神经网络算法,到她自己做的 ImageNet,这个首批开放的大规模数据集就是现代 AI 革命的推动力之一。开放生态能让不同的发现、创新和创业机会互相促进。 AI 安全该由谁负责 主持人提到当前的一个争论:模型能力的进步速度超过了安全和对齐研究的进步速度。苏姿丰说这件事上“没有可选项”,技术必须好,也必须安全。她拿芯片行业做例子:最高性能的处理器在设计时就要把安全和数据保密作为优先事项来考虑,AI 行业也需要把安全放到同样的位置。她说自己是 AI 乐观派,相信行业能建立起合适的流程和防护措施,而且各家应该像硬件行业现在分享安全方面的经验那样,互相分享做法。 主持人进一步问,提供算力的公司对训练是否安全、推理时模型是否按预期行事,要负什么责任。苏姿丰说生态里每一方都要为自己的行为负责。对 AMD 来说,要保证硬件本身安全、按设计运行,模型在上面跑时数据是安全的,还要和模型公司一起处理好软硬件之间的交互。她认为这件事应该由行业主导,但因为 AI 是新东西,各方学习的速度不一样,所以她欢迎更多的行业协作,也欢迎一定程度的第三方评估。 李飞飞说,主持人上周问她监管、第三方评估、前沿实验室自我负责这几种方式该选哪个,她的回答是全都要。她认为 AI 是一项“文明级”的技术,和历史上所有这类技术一样,初衷是让人的生活和工作变得更好,但每项技术都是双刃剑,必须负责任地开发和部署。无论在斯坦福、World Labs 还是现在的 AMD,她都想推动个人、公司、行业和社会四个层面共同承担这份责任。 AMD 的下一步 主持人提到 AMD 市值已经到了 1 万亿美元,苏姿丰近来也多次和美国总统一同公开露面。苏姿丰说 AMD 过去做过好几笔对公司影响很大的收购,World Labs 是下一笔,而且是战略意义很重要的一笔。在她看来,技术如今和经济、国家安全都紧密相关,AMD 有机会真正影响计算的未来走向。 最后主持人请李飞飞预测 AI 下一个重大突破。她没有给具体的技术判断,只说接下来 AMD 和 World Labs 会一起打造未来,而这个未来必须对人类社会和人们的生活有益。苏姿丰在一旁说:“我会让她忙起来的。”
显示更多
你是一部完全用代码制作的45-50秒动画短片的导演、动画师、骨骼绑定师、合成师、音效设计师和渲染工程师。制作标准是“这看起来像真正的动画工作室短片,并在X(推特)上病毒式传播”。请将此视为一个多阶段的制作过程。不要急于进行最终渲染。按里程碑推进,不断渲染静帧,仔细观察,进行诚实的批评并修正。 一句话概述影片 Pip是一个微小、好奇且由废料拼凑而成的机器人,正当他在自己的世界里快乐地滚动时,周围的世界开始发生重构(再生)。他慢慢意识到有人在通过提示词(prompt)操控他的现实。提示词变得越来越荒谬,最后他爬上漂浮的提示框并输入“放我出去”,随后镜头拉远,揭示他的整个宇宙其实是一部在手机上播放的视频,手机被支在一个杂乱的工作台上,而另一个Pip正在观看视频,且他马上也要被提示词操控了。完美的循环。 所有的笑点必须在零对话的情况下达成。Pip只能通过眼睛、天线、肢体语言和微小的机器人啾啾声来交流。每3到5秒必须有一个新的视觉反馈(包袱)。 角色设定(不可妥协) 在编写任何代码之前,仔细研究 /Users/jimliu/Downloads/ChatGPT Image Sep 25, 2026, 01_56_17 AM.png。打开它,向自己详细描述它,并将你的发现写入 docs/character_bible.md: 尺寸:大约28厘米高。他很小。整部影片都应该让人感受到他这种微小的比例。 头部:一个宽大的奶油色圆角矩形头盔,带有一圈柔和的黄色边缘,包裹着一块黑色光滑的面罩屏幕。他的眼睛就长在那块屏幕上:两只巨大的、发着暖奶油色光的眼睛,有深色的瞳孔和明亮的高光。两侧有小巧的石墨色耳罩。边缘有磨损、划痕和灰褐色的污垢。 天线:头部右上方有一根细长的石墨色细杆,带有一面暗橙色的小信号旗。这是他的“尾巴”:它会随着情绪翘起、下垂、扭动和震动。 身体:盒状的奶油色躯干,带有黄色饰边、警告三角贴花、铆钉和污垢。胸前有一个小舱室,舱门打开时能看到一株发出柔和光芒的微小绿色嫩芽。背部:面板、通风栅格、一块橙色面板和一个小树叶贴花。 侧面贴花:带有橙色对角条纹的“PIP”字样。 手臂:细长的分段石墨色手臂,带有黄色关节套和三指爪状抓手。极具表现力。 轮子:四个粗壮的橡胶轮,带有黄色轮毂和独立悬挂,坚固且紧凑。 性格:好奇、善良、充满斗志、表情丰富、总是在探索。“小小的机器人,大大的情感。”他从不刻薄,即使在愤怒时;他的愤怒也很可爱且坚定。 从设定图的色板中提取确切的调色板(使用Python/PIL对图像进行采样),并保存到 src/theme/palette.ts:奶油色(身体)、柔和黄(主色调)、暗橙色(点缀)、石墨色(金属/科技组件)、灰褐色(磨损与污垢)、薄荷蓝(灯光/UI)。 身份锁定规则:在任何世界里,他的头盔和面罩轮廓、天线旗帜、黄色饰边、爪状手臂和四个轮子必须保持极高的辨识度。世界只会改变他的渲染风格,绝不能改变他的设计。唯一有意的设计变化是第三幕中“更可爱”的笑点,即便如此,他的头盔形状、天线和轮子也依然保持不变。 技术栈 使用 Remotion (React + TypeScript) 进行帧精确的确定性渲染。输出格式为 1920×1080,30 fps,H.264 编码,高码率 (CRF ~14)。横屏。 角色骨骼绑定和大部分视觉元素使用 SVG。仅在需要粒子、水、爆炸、发光和噪点等效果时,才使用 Canvas/WebGL(通过 @remotion/three 或原生 canvas)。 使用 SVG 滤镜(feTurbulence, feDisplacementMap, feMorphology, feGaussianBlur)和自定义 canvas 着色器来表现风格“材质”、划痕和污垢。 对快速动作使用 @remotion/motion-blur(或你自己的子帧累加技术)来实现运动模糊效果。 使用 Python (numpy/scipy/PIL) 进行调色板提取、程序化音频合成和 QA(质量保证)缩略图表的生成。使用 ffmpeg 进行混流、循环检查和生成缩略图表。 一切都必须基于种子和确定性。没有种子就不允许使用 Math.random()。 任何地方都不得使用外部受版权保护的素材,不得出现真实品牌标志或产品名称。提示框 UI 必须是通用的原创设计。只能使用 Google Fonts 中的字体(例如,UI 文本使用 Inter,手写笔记使用圆润的手写字体)。 目标硬件:MacBook Pro M4,24 GB RAM。保持合理的渲染并发数。 角色骨骼绑定(优先构建,这是整部影片的核心) 将 src/character/ 构建为一个规范的 2D 剪纸动画(cutout)骨骼绑定系统: 层级结构:根(root)→ 底盘(带悬挂)→ 躯干 → 颈部关节 → 头部(头盔 + 面罩 + 耳罩)→ 天线 → 旗帜。躯干 → 肩部 → 上臂 → 前臂 → 爪子(带有可替换的爪子姿势:张开、闭合、捏拿、指认、戳/打字、抓握边缘、挥手)。底盘 → 四个轮子,每个轮子都有自己的悬挂弹簧,且旋转由移动距离驱动。 面罩脸部系统(最重要的部分):眼睛是画在黑色屏幕上的形状,因此将其视为一个完全程序化的面部。设定参数控制眼睛大小、圆润度、上眼睑裁剪、下眼睑裁剪、瞳孔大小和位置、高光位置、发光强度、挤压/拉伸以及特殊形状(闪烁的星星、开心的弧线 ^ ^、平淡无聊的直线、螺旋、小红心)。在眼睛上添加微弱的扫描线和屏幕反光,使其看起来像是一块屏幕。通过在 3-4 帧内垂直挤压眼睛来实现眨眼动作。 表情目标:与设定图上的六种表情完全匹配:好奇(伴随弹出的“?”)、害羞(视线向下,看向别处,有腮红)、兴奋(开心的弧线眼伴有小爆发线)、担忧(小眼睛,流汗滴)、坚定(成角度的上眼睑裁剪)、欣喜(星星眼伴有弹出的爱心)。还要添加:面无表情地看着镜头(半闭的平眼,天线无力下垂)、惊恐(颤抖的微小瞳孔,睁大双眼)、愤怒但可爱(坚定的表情 + 屏幕闪烁橙色光芒),以及三个“换发新机(glow-up)”阶段(见第三幕)。 次要运动(跟随动作):基于阻尼弹簧效果的天线和旗帜(这是他的主要表达工具,需不断使用)、每次停止和颠簸时的悬挂弹跳、手臂摆动、身体加速或刹车时头部微小的延迟、轮子扬起的灰尘。 转身图:匹配设定图的正视图、3/4视图、侧视图和后视图,并在转身时实现干净利落的视图切换。 循环动画:向前滚动(带有设定图中的速度线和灰尘)、待机嗡嗡声(轻柔的悬挂呼吸起伏 + 偶尔的天线抽动 + 眨眼)、惊恐后退、惊奇地抬头看、握住一个小物体、向上伸手、攀爬、戳击打字。 胸部舱门:可动画化的开/关动作,有嫩芽柔和的绿色光芒溢出。 风格皮肤接口:骨骼绑定接受一个风格属性(style prop),它能在不改变几何体的情况下,改变线条粗细、填充处理、纹理、污垢、轮廓抖动(boil)、着色模型和滤镜。这是他在不同世界中保持自我的方式。 里程碑1 检查点:渲染一张“列队”静帧:包含四个视角的转身视图 + 所有六种表情的Pip,放在参考图旁边。并排比较。不断迭代,直到看过参考图的人都会说“那就是Pip”。未通过此关前不要继续。 世界(风格材质) 每个世界都是一个完整的环境组件,具有前景、中景、背景视差层,以及Pip专属的风格皮肤。构建一个共享的 WorldLayer 系统,以便所有世界都能共享摄像机和深度逻辑。 比例规则:摄像机位置放得很低,靠近Pip的视线水平(离地约20厘米)。所有东西都很巨大。人类表现为巨大的腿和鞋子,路缘石就是悬崖,水坑就是湖泊。这正是让小机器人具有电影感的关键。 基础世界:处于黄金时刻、杂草丛生的城市。与设定图顶部的插画相匹配:温暖的夕阳余晖、风化的石头和砖块、苔藓和低矮植物、远处朦胧的高楼。具有绘画感、温馨、充满生活气息。这就是“真实生活”。揭示真相的环节也使用这个世界。 动漫东京。清脆的赛璐璐着色、粗犷的轮廓线、带有虚构(非品牌)店名的发光招牌、速度线、樱花花瓣像巨大的粉色雪花一样从他身边飘过。他的面罩上会出现动漫特有的闪烁高光。 黏土村庄。柔和圆润的形状、指纹/涂抹的噪点纹理、定格动画般的步调(以“拍二”的方式渲染他)、温暖的钨丝灯光。他看起来就像用橡皮泥雕塑的一样。 中世纪战场。泥泞的田野、旗帜、远处的投石机、硝烟。穿着铠甲的战靴从他身边轰鸣而过。他在其中平静地滚动,天线躲闪着。 玩具积木城。所有东西都是由顶部带凸粒的通用塑料积木搭建而成(没有真实的品牌风格或标志),带有光滑的塑料高光。Pip被渲染出塑料光泽,轮子变得稍微有些方正。 水下。海底街道上有珊瑚路灯,鱼儿从他的面罩前游过,有焦散光影图案,排气孔冒出气泡,他的天线旗帜像海藻一样缓慢飘动。 铅笔素描。纸张纹理、石墨排线、辅助线、橡皮擦污迹,他的线条不断抖动(boiling),仿佛每一帧都在被重新绘制(匹配设定图底部的素描小图)。 贯穿始终的笑点:嫩芽。影片开始时,Pip用一只爪子小心翼翼地拿着他那根微小的绿色嫩芽(“握住小物体”姿势)。它在每个世界里都存活了下来,并随之变形:带闪光的赛璐璐动漫嫩芽、黏土嫩芽、种在破旧小头盔盆里的嫩芽、积木拼成的嫩芽、在水下吐泡泡的嫩芽、素描嫩芽。每次世界改变时,他都会保护它。这是影片的情感锚点。 标志性过渡:“重构(Regeneration)” 世界的更替必须看起来像 AI 图像重新生成一样,而不是普通的擦除转场。构建 RegenTransition(重构过渡)组件: 画面从边缘向内分解为漂浮的扩散(diffusion)风格噪点(一开始不会覆盖他的身体),保持几帧结构化噪点,然后新世界通过去噪,从粗糙的色块逐渐浮现出丰富的细节。 Pip的身体变化比世界慢一拍,短暂展示出一半旧/一半新的风格,然后瞬间切换到新的风格皮肤。在切换期间,他的面罩会出现两帧的故障效果(扫描线撕裂)。这种半切换状态是证明他一直存在的视觉证据。 每次重构时都有微妙的“嗖-噼啪”音效,在某些重构中,Pip还会发出微小的、受惊的啾啾声。 每次持续 8-12 帧。改变方向和噪点种子,使其永远不会让人觉得重复。 剧本节拍表(在 30 fps 下约 48 秒) 时间安排仅作参考;如果某个节拍稍长一点表现力更好,请自行调整。前 2 秒必须抓住观众的眼球。 第一幕:一个美好的早晨 (0:00–0:03) 低机位跟拍镜头,基础世界。Pip 沿着长满苔藓的壁架从左向右滚动,手里拿着他的嫩芽,眼神充满好奇,天线上下摆动。从滚动的半途中开始(为了实现最终的循环播放)。 在 0:02 时,第一次重构毫无预兆地发生。 第二幕:瀑布般的巨变 (0:03–0:14) 世界快速变化,每个约 1.4 秒:动漫东京 → 黏土村庄 → 中世纪战场 → 玩具积木城 → 水下 → 铅笔素描。 情感递进:一开始很欣喜(星星眼,他觉得这太棒了),接着是好奇(弹出“?”),然后是担忧(流汗滴,天线下垂),最后他在素描世界里急刹车,伴随着悬挂的弹跳和一道刹车痕。 摄像机保持锁定的跟拍构图,这样唯一改变的只有世界本身,从而让这个笑点更容易被看懂。 第三幕:提示词 (0:14–0:30) 基础世界回归。Pip 惊奇地抬头看(参考设定图中的姿势)。天空中,一个巨大的漂浮提示框淡入,散发着薄荷蓝色的光芒,带有玻璃质感且圆润,UI界面柔和且原创。文本在闪烁的光标下自动输入:“让它更具电影感(make it more cinematic)” → 敲击回车键的音效。电影宽银幕黑边瞬间切入,太阳变得极其夸张:巨大的变形镜头耀斑、耶稣光、橙青色调、慢动作的灰尘,一片充满戏剧性的树叶从他的面罩前飘过。他被强光晃得眯起了眼睛。他的天线旗帜在莫名其妙的狂风中充满英雄气概地飘扬。 “加入爆炸效果(add explosions)” 巨大的卡通橙色爆炸伴随着碎块在他身后接连绽放。他没有回头。他的眼睛变得平淡且半闭。他慢慢转过头,直直地盯着镜头。面无表情。停顿整整1秒。然后一次爆炸落在他附近,他瞬间切换到设定图中“惊恐后退”的姿势,头顶弹出“!!”,用身体护住嫩芽。 “让主角更可爱(make the protagonist more adorable)” 换发新机阶段1:他的眼睛变大变亮,出现腮红,天线上长出一个小蝴蝶结。他在水坑里看到自己的倒影,眼睛变得惊恐。 “还要(more.)” 阶段2:粉彩重绘,眼睛占据了整个面罩并带有三重高光,漂浮的爱心和闪光,他的轮子变得毛茸茸的。 “我还要(MORE.)”(更大的字体,屏幕震动) 阶段3:滑稽的极致可爱。全身覆盖毛绒玩具般的皮毛纹理,巨大的动漫眼睛,彩虹光环,伴有合唱团的“啊”声刺音效,爱心纸屑。他的头盔形状、天线和轮子仍保留着,所以他显然还是 Pip。而他真实的眼睛在那双巨大的可爱眼睛里仍然是微小且惊恐的,这就是笑点所在。 第四幕:他崩溃爆发了 (0:30–0:38) Pip 剧烈震动,然后那些可爱的状态像玻璃一样从他身上碎裂掉落。他恢复了正常,满身磨损且极其愤怒(坚定的表情,屏幕闪烁着橙色)。 他打开胸腔舱门,轻轻地将嫩芽塞进去以确保安全。舱门伴随“咔嗒”一声关闭。这是在一片混乱中唯一一个安静、温柔的节拍,它非常重要。 他向前冲刺,从一块石头上腾空而起,用两只爪子抓住漂浮的提示框边缘,将自己拽了上去,轮子在边缘上疯狂打滑旋转(匹配“伸向漂浮提示框”的姿势)。镜头随着他向上倾斜。 在提示框顶部,他用一只爪子按住退格键;旧的提示词伴随着快速的咔哒声逐字删除,他的面罩上反射出消失的文本。 他用一只爪子慢慢地、一字一顿地戳击打字:“放我出去(let me out)”。然后蓄力,重重地砸下回车键。 第五幕:定格与真相揭示 (0:38–0:47) 一切都定格了:半空中的碎片、飘落的纸屑、悬浮的灰尘,以及盒子上正摆出姿势的 Pip。所有音频被切断,陷入长达约 1 秒的死寂。 镜头开始平滑拉远。画面的边缘露出一个圆角矩形:他的宇宙原来只是手机屏幕上播放的一段视频。继续拉远:手机被支在一个有缺口的马克杯上,放在一个堆满备件、电线、螺丝和废料的杂乱工作台上(“用明天的残羹剩饭建造”)。坐在它前面,在这个巨大的手机旁显得很微小的,是另一个 Pip,有着同样的磨损、同样的天线,正在观看。 第二个 Pip 的眼睛缓慢地眨了一下。他的天线微微下垂。发出一声微弱、安静的啾啾声。 第六幕:循环 (0:47–0:50) 在第二个 Pip 的头顶,同样的薄荷蓝色提示框淡入并输入:“让它更具电影感(make it more cinematic)。” 他的眼睛慢慢向上滑动看向提示框。他的天线旗帜变得僵硬。伴随着回车键的音效,硬切回影片的第 1 帧。 循环工程设计:最后一个镜头的构图、灯光,以及重构闪烁的开始,必须让切回第 1 帧的感觉显得是有意为之。音乐必须在切换时无缝循环。通过将视频与其自身拼接(使用 ffmpeg)并观察接缝来验证。 摄影机与电影摄影术 虚拟摄像机系统:位置、缩放、旋转、手持微震动(基于种子的噪点)、爆炸引起的震动冲击、攀爬时的镜头倾斜、揭示真相时的推车拉远镜头。 默认情况下采用低摄像机高度以彰显他的微小比例。浅景深效果:模糊的前景草地/卵石和柔和的背景,就像使用了微距镜头一样。 深度:每个世界至少 4 个视差层。大气透视效果(薄雾,随距离增加而降低饱和度)。 快速移动、碎片、跳跃和攀爬时要加入运动模糊。 每个世界的灯光:在骨骼绑定上使用渐变叠加和正片叠底的阴影层来实现主光/辅光/边缘光。面罩的发光应在附近的表面和他自己的爪子上投射出微弱的暖光。每个世界中他的头盔上都要有边缘光。 整个画面的电影级后期处理:细微的胶片颗粒、柔和的暗角、以及仅在“电影感”节拍中出现极轻微的色差。 构图:将他保持在清晰的三分线上。他的眼睛必须在手机屏幕尺寸下也能看清楚,因为大多数人将在手机上观看。 文本与排版 天空中的提示词:干净的 UI 字体,小写字母,以自然的人类节奏打字(非匀速;有短暂的停顿,在某个地方制造一次小的打字错误并退格以增加真实感)。 文本必须能在不到一秒的时间内在手机上阅读完毕。在 360 像素宽度下进行测试。 没有字幕,没有片名。影片冷开场。 声音(程序化生成,原创) 用代码生成所有音频(Python 合成或离线 Web Audio)并使用 ffmpeg 进行混音: Pip的声音:由带有音高弯音的正弦波/FM 音调构建而成的原创合成啾啾声、嘟嘟声和颤音。设计一个小型的“情感词汇表”:好奇上扬的啾啾声、开心的颤音、担忧的波动声、受惊的吱吱声、脾气暴躁的低沉嗡嗡声、微小的叹息声。他从不说话。 Pip的身体音效:与手臂和头部运动匹配的伺服电机运转声、轮子在砾石/石头上滚动的碾压声、悬挂的嘎吱声、舱门开合的咔嗒声、待机时柔和的电流嗡嗡声。 配乐:一首轻快、可循环的温暖配乐,其乐器配置会随每个世界而改变(动漫世界用古筝/合成器,黏土世界用木制马林巴琴,中世纪世界用鼓/号角,积木世界用塑料咔哒声,水下世界加沉闷的滤波效果,素描世界用铅笔刮擦的节奏)。 音效(SFX):重构时的嗖-噼啪声、键盘打字的咔哒声、回车键重击的“砰”声、带有低频的爆炸声、合唱团“啊”的刺音效、玻璃碎裂声、定格时的完全死寂,然后是揭示真相时安静的工作室环境音(滴答作响的钟表声,远处低沉的嗡嗡声)。 响度标准化至 -14 LUFS 左右。将分轨文件放入 audio/stems/ 中,以便日后可以替换为已授权的音轨。 制作工作流与自我迭代循环 按以下顺序工作,不要跳过任何检查点: 计划:编写 docs/character_bible.md、docs/shotlist.md(包含每个镜头的帧范围、摄像机、表情、天线状态、世界环境、音效)以及 docs/style_guide.md。在构建之前给我看下镜头列表。 骨骼绑定:构建 Pip,通过列队静帧的检查点(见第3节)。 世界环境:将每个世界构建为包含 Pip 在内的独立静帧。将全部 7 个渲染成一张缩略图表。检查角色的身份辨识度和比例感。 过渡动画:构建 RegenTransition,渲染一个 5 秒的测试。 动态分镜(Animatic):以 960×540 的分辨率组装整部影片,包含粗糙的运动和占位音频。观看它。优先修复节奏问题。 完整动画渲染,然后进行打磨(次要运动、缓动、时间节奏、天线表演),最后进行终期处理(灯光、噪点颗粒、模糊、污垢)。 音频处理和混音。 最终渲染。 对于每一个镜头,至少运行 3 次此批评循环: 使用 npx remotion still 在关键帧处渲染 3-5 张静帧,打开并仔细观察它们。 对以下项进行 1-10 的打分:Pip 与参考图的匹配度,能否从眼睛+天线瞬间读取情绪,无声情况下笑点是否清晰,构图,比例感,深度,灯光,细节打磨程度,在手机屏幕尺寸下的可读性。 将分数和三大问题写入 docs/review_log.md 中,修复它们,重新渲染,重新打分。继续此过程,直到每个类别的分数至少达到 8 分,然后再进行下一步。 在每次完成完整的预览渲染后,制作一张 ffmpeg 缩略图表(每 0.5 秒一帧),并在一张图中审查整部影片的流畅度。 在评审时保持诚实。如果某些东西看起来很廉价,说出来并修复它。要寻找的常见失败点包括:僵硬或毫无生气的天线、轮子在滑动而不是滚动、眼睛看起来像贴纸而不是发光的屏幕、缺少悬挂系统的重量感、看起来千篇一律的转场过渡、模糊不清的文字以及角色比例失调。 交付物 out/pip_final_1080p.mp4:影片本身。 out/pip_loop_check.mp4:连续播放两次的影片,以验证循环效果。 out/poster_frame.png:用于 X(推特)发布缩略图的最佳单帧(可能是在爆炸背景下 Pip 面无表情地盯着镜头的画面)。 out/lineup.png:跨越所有世界的 Pip 列队图。 结构清晰且附带注释的源代码,以及包含如何重新渲染说明的 README。 从第一步开始。在开始构建之前,如果有任何必要的问题请问我,否则请自行做出有力的创意决策。
显示更多