TopicDigg
最新
社区
登录
注册
注册并分享邀请链接,可获得视频播放与邀请奖励。
立即注册
与「怪事发生」相关的搜索结果
搜索结果
怪事发生
怪事发生 贴吧
一个关键词就是一个贴吧,路径全站唯一。
创建贴吧
用户
未找到
包含
怪事发生
的内容
东海边十三妹(💯在线交四海之友)
@shisanmei666
2026.08.27 12:24
这两个帖之间还有一个帖 上午莫名其妙失踪了 中午又出现了 现在又没有了 There is another post between these two posts. He disappeared inexplicably in the morning. Appeared again at noon. Now it's not there. #
怪事发生
#
显示更多
0
0
1
3
0
转发到社区
小盖
@xiaogaifun
2026.05.02 23:49
强烈推荐大家看看DeepMind CEO Demis的最新判断。 真的,Google DeepMind 的 CEO Demis Hassabis 每一期访谈我觉得值得都花时间看看。这哥们讲东西很实在,而且通俗易懂。 早上边跑步边听完了他和 YC CEO Garry Tan 的最新一期播客。 刚刚把笔记写完,也给大家分享下。 多说一句,好多人问我这种笔记是不是 AI 写的。我说下自己的流程。 我会先完整听完播客,然后用语音输入法把感触尽量充分地讲出来,再让 AI 帮着整理初稿,最后自己逐字修改优化。 如果全部交给 AI 做总结,那等于把思考和理解的能力让渡给了 AI,对自己理解这件事其实没有任何价值。 OK,咱们进正题。 1 Demis 的态度非常明确,现在的大模型范式(大规模预训练 + RLHF + CoT)一定会是 AGI 最终架构的一部分,他不认为这会是条死路。 但要实现 AGI,还有几个关键问题要解决。这几个问题包括:持续学习、长程推理和记忆系统。 先从最容易看到的现象讲起,Context Window。 现在大模型处理长信息,最常用的招就是把 Context Window 一直撑大。一开始 8k,后来 32k,再后来 100 万 Token。听起来很厉害,但本质上是暴力堆砌。 Context Window 其实就相当于人脑里的 Working Memory,工作记忆。人的工作记忆能同时装多少东西?心理学里有个经典数字,7 个左右。背电话号码能记住 7 位上下,再多就溢出了。 大模型呢?已经做到 100 万 Token。 按理说,模型的工作记忆比人大几十万倍,应该比人聪明几十万倍才对。但显然不是。 问题也恰恰就出现在这。把所有东西都塞进 Context Window 里,里面包含了不重要的东西、错的东西、过时的东西。看起来信息很多,其实是一团乱麻。 那人为什么 7 个数字的工作记忆就够用? 因为人脑背后还有另一套机制在工作。我们记得几年前的事,记得童年的事,记得几小时前发生的事。这些都不塞在工作记忆里,而是另一套系统。 具体来说这套系统是海马体,大脑里负责把新知识整合进已有知识库的那个部分。 研究发现,人睡觉的时候,特别是 REM 睡眠阶段,大脑会重放白天重要的片段,让大脑从中学习。新东西在睡觉的过程里,温柔地融进了旧的知识体系。 这个把新东西融进旧知识库的过程,就是持续学习。 模型现在没有这套机制。每一次对话结束,刚学到的东西就会忘记。下次重新打开,还是上次那个模型,没长进。 2 再聊聊长程推理的问题。英文表达是 Long-term Reasoning。我翻译为了长程。 长程推理这个词太抽象了。Demis 讲了一个特别具体的故事,听完会立刻明白他说的是什么。 他说自己喜欢跟 Gemini 下国际象棋。下棋的过程里能看到模型的 thinking trace,也就是它在那里到底想了什么。 然后他发现一件怪事。 模型考虑一步棋的时候,思考链里清清楚楚写着,这步是个昏招。但接下来,它没找到更好的走法,于是又走回这步昏招。 明明知道是错的,还是把错的那一步走出去了。 这个细节比任何 benchmark 数据都说明问题。因为它暴露的是模型缺少对自己思考过程的某种内省能力。 正常人下棋,意识到一步是昏招之后,脑子里会有一个反应,停一下,再想想。停一下、再想想这个能力,模型现在没有。它能在每一步局部判断对错,但没法基于整盘棋的局势去调整整体策略。 这就是长程推理还没搞定的样子。模型可以一步一步往前走,每一步看起来都合理,但走到后面整盘棋的方向其实是错的。它没有那种退回到当前思考的上一层、重新审视一下的能力。 说到底,模型缺的是一种内省。 3 学习、长程推理、记忆,这是 Demis 在播客里点出来的三个 AGI 鸿沟。 除此之外,他还反复提到了创造力。 2016 年 AlphaGo 跟李世石下棋,第二局走出了著名的 Move 37。那一步棋走出来的瞬间,全世界的围棋高手都看呆了。 所有人类几千年下围棋积累的经验都告诉它不该下那里,但 AlphaGo 下了。下完之后大家发现,是一步神来之笔。 很多人觉得,这就是 AI 的创造力来了。 但 Demis 说,对他自己来说,Move 37 只是起点。他真正想看到的是另一件事。AI 能不能发明围棋这件事本身。 这两件事的区别非常关键。 Move 37 是在围棋这个现成的规则里,找到了一步人类没想到的招。但围棋的规则、棋盘的形状、黑白子的对弈方式,是人类发明出来的。AI 在已有的框架里非常厉害,但能不能自己造一个框架,是另外一回事。 Demis 给了一个具体的设想。 如果给 AI 一个高层次的描述。造一个游戏,五分钟能学会规则,要好几辈子才能精通,棋局有审美,一下午能下完一局。AI 能不能根据这个描述,自己倒推出围棋? 目前做不到。 为了把这件事讲得更清楚,Demis 还提了一个测试,他自己叫爱因斯坦测试。 用 1901 年人类已有的全部知识训练一个模型,看它能不能在 1905 年那个时间点,自己推出狭义相对论。 爱因斯坦在 1905 年那一年里,连写了几篇改变物理学的论文,后来叫爱因斯坦奇迹年。那些工作不是从已有的物理学论文里通过拼接得到的,是基于已有材料做了一次全新的概念跳跃。 爱因斯坦测试想问的就是这件事。AI 能不能做这种跳跃。 目前的大模型主要在做两件事,pattern matching 和 extrapolation。一个是从大量数据里找规律,一个是把规律往外延伸一点。但发现新东西需要的是类比推理的能力。从一个领域里抽出深层结构,搬到另一个全新的领域去用。 这个能力,模型现在还没有。也可能是有,但用法不对所以激发不出来。 4 除此之外,Demis 还分享了一个让我特别出乎意料的判断,他说未来 6 到 12 个月,真正的价值不在更大的模型,在更小的模型。 这一部分内容我反复听了好几次,确实突破我的已有认知。 不知道大家的想法,反正我自己,这一年来并没有怎么关注小模型的进展。毕竟行业的焦点就是把模型做大嘛。 那小模型的价值到底在哪? 最直接的是成本。同样一个任务,小模型的推理价格可能只是前沿模型的十分之一甚至更少。 但 Demis 说,比成本更重要的其实是速度。 这里有一个前提得先说清楚。Demis 不是在说速度可以替代智能。 他的原话是,当小模型的能力已经达到前沿模型的 90% 到 95%,也就是已经相当不错的时候,剩下那 5% 到 10% 的能力差距,比不上速度带来的好处。 比如现在工程师用 AI 写代码,已经形成了一种新的工作节奏。一个想法冒出来,几秒之内就能看到结果,不行就改,再不行再改。 这个一改再改的循环跑得越快,做出来的东西就越好。如果每次调用都要等十秒,整个工作流就被打断了。 更关键的是,快到一定程度,工程师在这种节奏里能进入心流。一个想法、一次尝试、一个反馈、再来一个想法,思维不被打断。 这件事写过代码的人都懂,进入心流和频繁掉出心流,产出的差距是数量级的。 Agent 也是同样的逻辑。一个 Agent 跑完一个任务可能要调几十次模型,每次慢一秒,整个任务就慢一分钟。慢到一定程度,Agent 就从一个能用的东西变成鸡肋。 小模型不是大模型的廉价替代品。有些事只有小模型能做。 比如手机、眼镜、家用机器人,需要的就是一个能在本地跑起来的模型。本地跑除了反应快,还有一个特别重要的好处,隐私。 家里机器人看到的视频、听到的对话,全部在设备本地处理,根本不上云。这件事对很多用户来说不是加分项,是底线。 成本、速度、边缘部署,这是小模型的价值。 5 讲完小模型的价值,接下来一个更关键的问题是,能力被压到这么小的参数里,会不会有上限? Demis 的判断是,目前没看到信息密度有任何理论上限。小模型的智能天花板还远没看到。 支撑这个判断的,是 DeepMind 在蒸馏这件事上的积累。蒸馏简单说就是先训练一个超大的模型,然后用这个超大模型去教一个小模型。教完之后,小模型用极少的参数,能复现原来 95% 以上的能力。 为什么 DeepMind 这么重视蒸馏?因为要把 AI 能力放进谷歌的头部产品中,前提是低延迟、低成本。前沿模型再强,每次推理花几秒钟、花几毛钱...这条路,恐怕很难走得通。 一个前沿模型发布之后,6 到 12 个月内,他们就能把这个模型的能力蒸馏到边缘设备能跑的小模型上去。这个时间表比很多人想的要快。 在很多场景中,小模型和大模型会相互配合。 举个例子,一个端到端的智能助手,绝大部分日常任务在本地的小模型上跑。智能眼镜看到的画面、家里机器人听到的对话、手机里的私人助理,模型直接在设备里读懂,不需要往云端传一遍。 只有遇到特别复杂、本地搞不定的问题,才向云端的前沿模型发起请求。 也就是说小模型在边缘做主力,前沿模型在云端做后援。 不过,这个构想对小模型的要求也比较高,它不能只会处理文字,还得能理解物理世界。 这就是为什么 Gemini 从一开始就坚持多模态,不光处理文字,也处理图像、视频、声音。 一开始这么做比只做文本要难得多,但眼镜也好,机器人也好,需要的是一个能看懂周围世界的模型,不是一个只会聊天的模型。 讲到这里,小模型这条路的轮廓就完全清楚了。它独立成立,不是前沿模型的廉价替代品,而是另一条同样重要的路。 嗯,很有启发。
显示更多
0
0
48
1.2K
239
转发到社区
Bill The Investor
@billtheinvestor
2026.04.30 16:38
卧槽,AI可以用来这样辨别渣男渣女! 这位来自科尔多瓦的男子训练了一个 AI,用来检测他的下一任女友是否和他前任一样。 马科斯,31岁,科尔多瓦。与卡拉在一起四年。分手时闹得很僵:煤气灯操纵、三次出轨,她离开前还掏空了他的银行账户。六个月后,他开始使用 Tinder。但他不再信任自己的判断力,因为当初他也选了卡拉。 于是他做了一件怪事:他下载了与前任四年的 WhatsApp 聊天记录(共 38,000 条消息),并在 Claude 上训练了一个微调模型,用以检测每次毒性事件发生前的语言模式。 包括早期的操纵、扮演受害者、爱意轰炸、三角关系。现在,每一个新的匹配对象都要经过这个过滤器。他将截图发送给智能体,系统会输出一个 0 到 100 之间的“与卡拉相似度”评分。只要超过 60 分,他就会直接断联。在四个月内,他排除了 23 个女孩。他现在正与第 24 位交往,时长 5 个月。评分:12。 他上周将其上传到了 GitHub。项目名为 ExFilter。6 天内获得了 4,300 个星标。最令人不安的部分是:在他排除掉的女孩中,有三个在几个月后给他发信息,找他借钱。
显示更多
0
0
0
8
2
转发到社区
李承鹏(大眼哥)
@dayangelcp
2026.08.27 14:52
我的油管第7期:《在中国,千万别当好人》 在中国,千万别当好人。因为一扶,就得扶一辈子。 救人一命没有胜造七级浮屠,救人一命胜过七世糊涂。四川达州70岁蒋婆婆讹诈扶她的9岁小孩,索赔20万;沈阳70岁老太太敲诈救命恩人10万元;湖南常德老人摔倒却敲诈好心人3万元,祁东死者家属敲诈10万元。药店店主孙向波把一个存活率只有1%的老太太救回来,却被老太告上法庭,心力交瘁,落得生意关门。 中国不是没有好人,上面那些助人为乐的就是好人,但坏人横行,渐渐地好人也不敢做好事了。劣币驱逐良币…… 晚清的时候,一批外国人来到中国,办医院、兴学校、开育婴堂。库姆斯放弃英国的优沃生活来到中国。义和团杀进学校,她用身体护住中国孩子,恳求义和团饶了那瘸腿的中国女孩一命。义和团就把她扔进火里,用石头砸……第二天,人们只找到她几块烧焦的骨头。 毕翰道来到中国,他和妻子为中国人做过数百例成功的白内障手术,让几百个中国人重新见到了光明。毓贤杀他时,毕翰道还在为毓贤祈祷,被一刀砍下了头颅。然后妻子的头被砍下,12岁的儿子的头也被砍下,每砍下一颗头颅,士兵们就把它沿街踢着玩,以示轻蔑。 那个从火里逃出来的英国传教士喊:山西大旱,我拿出五六万两银子,救活了几千人,你们连饶我一条命都不行吗。然后他被清军杀死。还有一个英国妇女抱着孩子跪下,说自己在这里行医,每年救活好几百人,求他们放过母子二人。士兵把她击倒,她和孩子一起被推进火里,活活烧死……连孕妇都被剁成碎块。 我们从不缺士为知己者死的个人报恩,比如荆轲、豫让、聂政。但从不鼓励公共领域的诚信、契约、感恩。因为士为知己者死,方便肉食者收买笼络。要是全社会形成诚信、契约、感恩,人民很容易团结起来,这就不好管理了。 这些年你是不是感觉坏人越来越多了,好人越发孤独了,这正是维稳制度想要的社会状态:人和人没有共识、没有友好协商,遇到坏人司法也不公正裁决,只要不影响统治,放出些小坏人,正是极权所想看到的,你忍气吞声,社会就和谐了,你据理力争,也只能去求政府,一切尽在掌控中。 原子化、散沙化、非共识化以及社会触感孤独化,是极权社会最理想的统治状态。最近几年,身边出现很多怪事儿,熟悉的朋友变怪了,熟悉的街道变怪了,熟悉的菜的味道也变了——不是它们变了,而是大环境变了,大环境一定要让你变成那条孤立无援的鱼。 自彭宇案后,见老人不敢扶,自崔英杰夏俊峰之后,见弱者被辱,不敢拔刀相助。其实是自韩非子以来,“侠以武犯禁,儒以文乱法”。身边的熟人越来越陌生,街上的事儿越来越怪了,可是你抬头,看那一片茫茫的原子化、散沙化,就知道,我们孤独的生活,就这么来的。 点击进入:
显示更多
0
0
11
81
25
转发到社区
Yiwu Iife
@lyj93052
2026.08.04 05:08
最近两年明显感觉到一个怪事,网上吐槽工作的人越来越多,但真正辞职跑路的人却很少。放在几年前,职场完全是另一番光景。那时候各行各业都在扩规模,抢市场,招新人,互联网行业更是高歌猛进,资本涌入,新赛道不断涌现,市场上遍地都是机会。职场人最大的底气就是,此处不留爷,自有留爷处。薪资不满意,领导傻叉,加班太累,同事难相处,随便一个理由就能跳槽。而且跳槽是刚需,老老实实待在一家公司薪资涨得慢,跳一次薪资涨一截,这是当时所有人的共识。跳槽或裸辞是职场常态,离职潮一波接着一波。但是到了2026年,这一切都翻篇了,离职潮几乎消失不见了。
显示更多
0
0
0
1
0
转发到社区
William Long
@williamlong
2026.07.12 01:18
【2009年高分科幻悬疑电影《恐怖游轮》定档7月17日在内地上映】豆瓣8.5高分科幻悬疑电影《恐怖游轮》官宣定档7月17日在内地上映。本片主打烧脑循环+无限轮回,已于2009年在英国首映。影片讲述了单亲妈妈和一帮朋友出海遇上风暴,山穷水尽之时在海上遇到一艘神秘游轮,登船之后怪事、凶杀接踵而来。
显示更多
0
0
0
0
0
转发到社区
郭宇 guoyu.eth
@turingou
2026.03.28 00:59
鈴鹿也有这么おしゃれ的咖啡馆我是没想到的…最近几年每次来看 F1 都住在榊原温泉的高尔夫球场,这家酒店每次还都住不满,大家却宁愿住到老远的名古屋去,真是一件怪事
显示更多
0
0
5
61
0
转发到社区
苔苔 /Nori Chan
@taitai257
2024.02.16 10:17
明明是在攻擊可是卻看起來像在做怪事的兩人組/// FF預售開始啦✨ 面交表單: 露天: #
不死不運
# #
出雲風子
##
不死不運
# #
アンデッドアンラック
# #
UndeadUnluck
#
显示更多
0
0
0
415
16
转发到社区
加载中...