注册并分享邀请链接,可获得视频播放与邀请奖励。

与「提醒」相关的搜索结果

提醒 贴吧
一个关键词就是一个贴吧,路径全站唯一。
创建贴吧
用户
未找到
包含 提醒 的内容
等等,Anthropic 前沿红队对智谱开源模型 GLM-5.3 做了系统测评 ?结论是:“自由可获取能力的关键门槛已被跨越”! Anthropic 认为这是第一个能力达到前沿水平(可与 Claude Mythos Preview 相当的端到端自主漏洞利用能力)、但又几乎不设防的、任何人都可以下载的模型。这算什么?对 GLM-5.3 安全性的提醒,呼吁加强管制,还是变相帮 GLM-5.3 宣传?😂
显示更多
2026 年 9 月 29 日,OpenAI 在旧金山 Fort Mason 办了今年的开发者大会 DevDay。主讲是 CEO Sam Altman。其他几位上台的人都在做这些产品。产品团队的 Holly 演示了新产品 Dots。后训练(模型预训练之后做对齐和能力调优的阶段)研究负责人 Tejal 讲了模型怎么反过来帮 OpenAI 做研究。Codex 的演示由 Romain Huet 来做,他在 OpenAI 负责开发者体验,去年 DevDay 主题演讲里的 Codex 演示也是他做的。整场演讲分三块:面向用户的常驻智能体 Dots 和协作空间 ChatGPT Space,给开发者的新模型和新工具,以及帮开发者做分发、赚钱的渠道。 1. Dots:一直在线、会主动干活的智能体 Sam 把 Dots 比作电影里那种一直在身边帮忙的 AI 助手。他认为订餐厅、买机票这类代办虽然有用,但和这项技术能做的事比起来太小了。他想要的 AI 知道正在发生什么,也知道你在意什么,不用你事事交代。 Dots 是常驻在线的智能体(Agent),有自己的云端电脑和浏览器,能写代码、跑测试。它的权限跟着用户走,能直接用用户已经在 ChatGPT 里连好的插件,覆盖 4000 多个应用。除了在 ChatGPT 里对话,之后还可以给它发短信、打电话。目前每人先有一个 Dot,以后可以配一整组。Dots 跑在 本月早些时候发布的 GPT-6 Astra 上,Sam 称它是 OpenAI 对齐做得最好的模型。用户可以限定 Dot 能用哪些应用、能不能操作电脑,也能给它的各类操作写自定义指令,愿意交出多少责任就放多少权。 Sam 说,他自己的 Dot 每天早上会把夜里进来的消息过一遍,挑出紧急的提醒他。他说这让他拿回了一部分注意力,没那么离不开手机了。他还举了一个更重的例子:把应用从一个即将停用的旧 API 上迁走。这个 API 可能散落在代码库各处,改了哪里会连带弄坏什么,事先看不出来。Dot 可以追踪依赖关系,找出所有要改的地方,写代码、跑测试,最后把 PR(代码合并请求)交给团队审。他让听众想想,过去做这件事要几个人、花多久。 开场视频里,用户把自己的 Dot 改名叫 Alfred。Alfred 和另一个 Dot 帮用户上线网站,改董事会材料,在婚礼蛋糕商家取消后找好备选。它们还发现财务会和女儿的演出撞了期,提出改时间。每件事都是 Dot 推进到需要人确认的地方,再由人拍板。 2. ChatGPT Space:人和智能体一起用的工作区 Sam 认为,现有的生产力软件几乎都没考虑过人和 AI 一起干活。ChatGPT Space 以页面为单位,可以在里面写计划、做调研、生成图片和数据。页面和文件像网盘一样放在同一个空间里。Dot 能直接在页面上工作,在评论里 @ 它,它就会接活。页面本身也能带指令,比如“每天去看 API 平台的 Slack 频道,把发现更新到这里”。之后 Space 里还会加入演示文稿,格式做成智能体方便读写的样子,团队成员可以和各自的 Dot 一起改。 在 Holly 的演示里,页面用斜杠命令就能插入交互图表、表格和可运行的原型。她 @ 自己的 Dot(名叫 Dotty),让它把一组数据改成柱状图。图表可以按反馈类型筛选,Dotty 每小时刷新一次。她还让 Dotty 把“某位工程师在我 Slack 私信里提过的新手引导数据”补进 FAQ。Dotty 能看到她的上下文,所以这种模糊的指代也找得到。 3. OpenAI 内部怎么用 Dots Holly 用一个虚构的歌单应用 Blossom Music,模拟发布前一天的状况。早上 Dotty 已经做了几件事:发现发布评审会提前,改好了日历;看完前一晚测试用户的反馈;注意到设计团队临时改了首页,把新设计发给她。她让 Dotty 直接把这个设计做出来。Dotty 调用她笔记本上的 Codex 构建应用,在 iPhone 模拟器里跑起来,再提交 PR。现场的语音演示卡住了,Dotty 一直回复“还在查”。Codex 线程也报过一次错,她重试后才继续下去。 她说,Dots 真正改变 OpenAI 工作方式的地方在 Slack。Dots 在公司 Slack 里有自己的身份,员工就开始把它们当作代理人。被同事 @ 到的零碎请求,直接转给自己的 Dot 处理。建群时,大家从一开始就把各自的 Dot 拉进来,Dot 带回结果时所有人都能看到。 工程师走得更远。有人在反馈频道贴出会话 ID 和一个用户 bug,某位工程师的 Dot 就会接手排查,提 PR 修复。她说这是真实情况:工程师们的 Dots 每天这样修掉几十个 bug,Dots 这个产品本身有很多部分就是 Dots 写的。 4. 上线范围和企业用的 Specialist Dots Dots 和 Space 当天向 ChatGPT Pro、Business Premium 和 Enterprise 用户开放。Dot 包含在套餐里,和它的对话不占用额度。 企业客户还可以预览 Specialist Dots。这是由公司统一设置、供整个团队使用的虚拟同事,负责会计、市场、法务这类工作量大的事。公司给它目标和背景,审核它的产出,给它反馈,反馈在全公司共享。OpenAI 也在和微软合作,把 Specialist Dots 接入 Agent 365(微软用来管理企业智能体的工具),企业可以用已经在用的微软工具来管理它们。 5. 新模型:更便宜的 GPT-6.1 Sol,更快的 UltraFast Astra 发布这几周,用户的要求集中在两点:更便宜,更快。GPT-6.1 Sol(转录稿误作 Soul)的能力接近 Astra,价格是它的五分之一。缓存输入(重复发送、已被缓存的上下文)比标准输入便宜 95%。智能体需要反复读同一批上下文、长时间迭代,这对它们尤其省钱。Sam 说 Sol 在某些方面比 Astra 还聪明,定位是开发者的日常主力模型。 UltraFast 是新的速度档,API、ChatGPT 和 Codex 里都能用。原有的 Fast 档是两倍速度、两倍价格;UltraFast 是八倍速度、六倍价格,每秒 300 个 Token。它现在可以配合 Astra 用,之后也会支持 Sol。现场让两个模型用同一个提示词,做一个 DevDay 配色的火箭。UltraFast 的火箭已经升空时,标准速度的还没做完。 订阅也跟着调整。新推出的 500 美元档 Pro 订阅叫 Pro 500,额度最高,是 Plus 的 25 倍。它可以在 ChatGPT 和 Codex 里用 UltraFast,还能通过“用 ChatGPT 登录”在合作方的应用里使用。Pro 200 重新开放,继续提供所有前沿模型。 另外预览了 Decisions API。它给 Luna 模型一组预先定义好的选项,让模型从中选一个,比如给请求分流、给图片分类、决定智能体下一步做什么。任务收窄成选择题之后,响应时间可以压到一秒以内,同时保留图像理解、多语言和安全防护。Romain 后来补充说,做机器人的朋友看中的是它能处理视觉输入:机器人可以根据看到的东西,近乎实时地快速行动。 6. 模型开始帮 OpenAI 做研究 Sam 提到,去年这个时候,他和 Jakob 在一次直播里预测,一年内会出现第一个“AI 研究实习生”,当时几乎没人相信。几周前 OpenAI 宣布达成了这个目标:有了一个能接手定义清晰的研究任务的系统,这类任务原本要熟练的研究员花大量时间和精力。 Tejal 的方向是电脑操作(computer use,让模型像人一样操作桌面和浏览器)。她举了两个例子。 第一个是让模型优化电脑操作的运行框架(harness,包在模型外面、负责调用工具和管理步骤的代码)。模型在循环里持续寻找能同时降低延迟、提升效果的改动,团队把找到的改进合进生产环境的框架,并用于后训练。结果是延迟改善了两倍以上,已经上线。 第二个是模型帮忙改进了监控和拒绝训练,让 Astra 在不安全的场景里更会拒绝。Astra 在电脑操作压力测试上因此达到业内领先,操作时出错更少,也更贴合用户的本意。 她给出了几项内部数据。今年夏天之后,研究工作消耗的 Token 量急剧上升。1 月时,模型能做好 15 分钟以内的短任务,需要一天以上的任务大多会失败;到 7 月,超过三分之一的一天量级研究任务,模型能在无人干预下完成。她还提到,Astra 这类模型已经帮忙解决了 100 多个悬而未决几十年的数学问题,也在参与针对耐药感染的新抗生素、古代语言研究、可再生能源和工业机器人等方向的工作。 7. 给开发者的底层工具 Sam 说,OpenAI 想让开发者用上自己内部用的东西。 第一件是 Codex 的运行框架。它同时支撑着 Codex、ChatGPT Work 和 Dots,目标是用最少的 Token、最快拿到准确结果,现在已经开源。第二件是 Codex 完全上云:在手机上开始的任务,可以在浏览器或桌面端接着做,合上笔记本任务也不会中断。 云端能力带来了 Codex Security Cloud。它在云端环境里持续寻找漏洞,并准备好验证过的修复方案供人审核,这次新增了自动去重、定时扫描和新界面。Sam 说这是为了给防守方更好的工具,因为“我们看得到接下来会发生什么”。 新的 Agents API 进入公开测试。它包含运行框架、托管、记忆、多智能体控制等功能,是 Codex 和 Dots 用的同一套技术,也加入了电脑操作能力。现场的例子是一个网站测试智能体,会自己打开浏览器、点击页面、测试流程。基础设施方面,OpenAI 和 AWS 合作推出由 OpenAI 驱动的 Bedrock(AWS 的托管 AI 服务)托管智能体,AWS 客户可以直接使用 OpenAI 的前沿模型、Codex 和 ChatGPT Work。 隐私方面预览了 OpenAI Private Intelligence。其中的零数据留存(ZDR)配合私有安全处理,可以在不把用户内容存到 OpenAI 服务器的情况下做安全检测;私有推理则把隐私保护延伸到推理阶段。Sam 说这套方案是和最大的一批客户一起设计的,目的是让他们能把模型用在最敏感的工作上。 性能方面,Responses API 一年里增长了 100 倍,可靠性保持在 99% 以上。首个 Token 的等待时间缩短了 45%,工具调用和工作流提速 30% 以上。 8. Romain 的 Codex 演示 演示从手机上的 Codex 开始。Romain 人还在会场外,让 Codex 替他跟观众打招呼、讲一个会场的冷知识。接着他用几张会场照片生成的 3D 场景演示 UltraFast,一边说一边改:把小人放到座位上,把直播画面投到场景里的大屏幕上。现场语音没连上,他改成了打字。 Codex 命令行工具(CLI)这次全面翻新。他让 UltraFast 写一个应用,从观众里随机抽三个人送明年的门票,几秒就写完;改成抽六个人,也几乎是瞬间完成。命令行现在支持由 GPT Live 驱动的双向实时语音,不只是语音转文字,但现场没能演示出来。 后面几段演示了多模态和电脑操作。游戏 Astra Adventures 从一张纸上的草图开始,几轮之后画面还很粗糙,借助图像模型,才变成有质感、能用在正式游戏里的美术。然后他让 Astra 通过浏览器自己学着玩这个游戏,屏幕左边显示模型的决策,右边显示它按下的按键。 他又用“应用快照”(app shot)把自己记录飞行课程的应用作为上下文交给 Codex,让它在各种屏幕尺寸下审查这个应用并截图。Codex 自己在模拟器里点开了各项功能。云端 Codex 现在和本地版用同样的工具,包括插件和电脑操作。他顺手把一个“用 Rust 重写整个后端”的任务丢到云端,打算稍后在手机上查看。 最后一个演示用的是 Hugging Face 借来的可编程小机器人 Micro Duck,它名叫 Lavender。Romain 前一晚让 Codex 把它接好:视觉用 Astra,图像生成用 GPT Image 2.5,语音交互用 GPT Live 1。机器人现场看着观众画了一幅画。他说,OpenAI 做 Dots 和 Codex 用的,就是 API 里开放给开发者的同一批工具。 9. 分发和变现:让开发者在 ChatGPT 上做生意 ChatGPT 每周大约有 12 亿人使用。Sam 承认,此前类似的尝试效果参差不齐。他说这次有信心,是因为开发者拿到的是 OpenAI 自己做 ChatGPT 用的工具。 第一项是“用 ChatGPT 登录”(Sign in with ChatGPT)。用户登录第三方应用时,可以直接用自己 ChatGPT 套餐里包含的 Token,开发者不必替新用户垫付模型费用。首批有 16 家合作方。 第二项是插件扩展(plugin extensions)。开发者可以把编辑器、仪表盘乃至整个工作区,做成原生嵌在 ChatGPT 和 Codex 里的应用。现场展示了三个例子。一个是会议应用:在 ChatGPT 里看日历上的会议,点“记笔记”后,页面变成团队和 Dots 一起跟进待办的 Space。一个是 Figma:打开设计稿、看团队评论、让 ChatGPT 改稿。还有一个是 Adobe:在 ChatGPT 里使用 Photoshop 的功能。ChatGPT sites(在 ChatGPT 里生成的网站,几个月里已有数百万个)现在也能接入插件和数据。访客用自己的账号登录、带上自己的智能体,看到的内容因人而异。 用户发现插件的渠道也扩大了。除了在插件库里搜索,ChatGPT 还会在对话中识别出能帮上忙的插件,用户当场就能连接。插件审核流程也简化了:开发者可以跟踪审核进度,看到需要修改的地方,申请人工复审,更新工具时也不用从头提交。 第三项是 OpenAI Marketplace,首批有 30 多家合作方,包括 CodeRabbit、Notion、Vercel。企业客户可以用已经和 OpenAI 签下的采购承诺额度来买这些产品,有承诺额度的开发者也能在这里花。通过和模型推理托管公司 Baseten(转录稿写作 Base10)合作,市场里还能用到开源模型。 10. 收尾:一次额度重置,和“文艺复兴”的说法 当天的后续安排里,Peter 会讲 OpenAI 对开源社区的投入,包括新的 OpenClaw Enterprise Harness(OpenClaw 是一个开源 AI 智能体项目)。还有一个 Codex 游戏工作室环节,观众可以用 Codex 做复古游戏,每人能领一台 DevDay 限定的 chromatic computer,用来玩自己做的游戏。最后是 Sam、Tibo (Thibault) 和 Tejal 的现场问答。 Sam 和 Tibo 还在台上按下按钮,给全世界的用户重置了一次用量额度。Sam 说 OpenAI 已经做过太多次重置,Tibo 一直想把公司改名叫“重置公司”。 最后 Sam 说,他不喜欢把 AI 比作新一轮工业革命,那意味着人变成巨大机器里的齿轮,转得越来越快;生活里有些部分不能也不该被自动化。他希望,如果做对了,AI 带来的会更像一场新的文艺复兴:让人对自己的生活有更多掌控,有更多工具去创造、学习和探索。
显示更多
0
8
145
34
转发到社区
打到就进钱包。🪙 怪物掉落的代币,会直接从怪物钱包进入你的钱包。 没有最低提现,没有提现门槛,也不需要等你攒够多少。 怪掉多少,你就收到多少。😂 温馨提醒:这是测试视频,所以掉率调高了。 正式游戏里,普通怪掉代币的概率极低,主要还是精英怪和 BOSS 才会掉得比较多。 #GameFi# #维洛传说#
显示更多
我终于找到 AI 真正融入生活的姿势,这才是真正的 AI Native🤩!!! 我直接让 AI 接入 微信、邮箱、日历,在后台跑定时任务: 每天定时读取新信息,自动帮我做好当天的行程规划和任务梳理,手机端准时弹出提醒。 微信群里各种通知、各种可能遗漏的客户,还有一堆邮件…… 每天被这些事情浪费很多时间,还可能遗漏。 这几天我把整个任务丢给了 Today AI,真的是爽翻了! 大概实现是这样的: 1、我用 Skills 解密本地微信数据,让它读取到微信最新信息,同时将工作邮箱和日历授权给它,它在后台跑定时任务,每天定时抓取最新上下文,自动做好统筹和规划,手机端直接推送执行建议。 2、并且设置了定时任务,每天早晨 8 点,Today 自动结合昨天的微信沟通、新邮件和今日日程,生成报告,以及待办的任务,并在手机上提醒我。 3、定期扫描邮箱账单,定期自动检查收据,帮我翻出了在吃灰的会员,并且差旅发票和报销凭证随手发过去,自动按项目归类核对金额,省下大把时间。 4、而且,健康饮食和健身规划也都可以交给它,做好定时任务和长期规划,接着就可以开始健康生活了~ 5、除此之外,这是国内第一个真正意义上的 Personal AI,电脑端在后台跑任务,手机端实时收提醒,非常方便。 国内版基础版免费用,新用户注册送 1 亿 Token 和 1 个月 Pro。 微信解密 Skills 和产品链接放评论区:
显示更多
西雅图这边华人真是好骗啊。。 139万美元就挖了几个坑。 我上次踩坑华人的小承包商,也就是一两万美元的损失。 这个大姐太惨了,139.7万,估计打水漂了。 切记,尽量要多找几家报价,尽量不要仅仅因为沟通方便,或者照顾华人生意而找华人的承包商。 老美的公司也有很多捣糨糊的。 最好的办法还是不要嫌麻烦,多找几个报价。 小红书原始链接 == 钱付了,工程却停了:一个家庭的新建房维权记 我们把建家的希望交给Gao Tai construction LLC, Rongzhou Wu如今却不得不走上维权之路 2024年,我们怀着对新家的期待,与 Gao Tai Construction LLC ,Rongzhou Wu签订施工合同,把位于 Bellevue(98005)的一处自住房新建项目交给他们承建。 施工期间,对方以需要在中国采购门窗等材料为由,要求我们支付人民币208万元。 我的选择相信他们,我们于2025年四月和八月分两次支付了208万人民币给Gaotai 指定的账号。 但直到今天,我们仍没有收到能证明这些材料已经订购或付款的文件。 目前为止,我们总共支付了139.7万美金、按合同规定,其中第三期工程款总额为60万美元,施工内容包括木结构、门窗和车库等,40万美元已经支付给对方,但合同中与这笔款项相对应的木结构、门窗和车库工程并未完成。 现场只有地基,该笔已付款项至今没有转化为合同约定的实际工程成果。 钱付出去了,工程却停在这里;在我们一次次要求提供材料采购证明、分包商付款证明和相关文件后,对方仍未提供,并继续向我们要钱,随后停工。 我们把信任交了出去,得到的却是反复等待、没有答案,以及一个迟迟无法继续施工的家。面对一笔笔付出去的钱和停下来的工地,我们既愤怒,也心痛,更担心这件事会不会还发生在其他家庭身上。 我们已经聘请律师,准备依法起诉并追回款项。Gao Tai Construction LLC 的施工执照于2026年3月suspended。 Gao Tai 的 L&I 页面记录了一宗针对其承包商保证金的诉讼或索赔: 案号:24-2-15566-0 SEA Complaint date:2024年7月17日 Complaint amount:$556,003 状态:Unsatisfied 涉及保证金编号:9835226 我们写下这些,只是要公开记录自己的经历,提醒其他准备聘请承包商的业主,避开Gao Tai construction LLC, Jet Home remodeling LLC, 以及Rongzhou Wu, 和他的女儿Tina Wu 、儿子Bill Wu 名下的所有公司! 以防成为我们一样的受害者。 我们会继续依法维权,也会把事情的进展如实记录下来。谁的钱都不是天上掉下来的;我们的付出和权益,也不应该被轻轻带过。
显示更多
0
22
119
20
转发到社区
用 AI 跑通了一整条教学动画的制作流程:Opus 5.5 写手绘动画、排时间轴,Gemini 3.8 Flash TTS 配音,从一份文字稿做成带配音、字幕、配乐的完整视频。效果好得超出我的预期。 (视频内容来自码农高天的《十分钟学会正确的 GitHub 工作流》,这次只是借来练手、跑通流程。原视频: 但整个过程中,我一直在提醒自己一件事: 这些都是 AI 的能力、模型的能力,不是我的能力。 所以我很清楚自己不想做什么: 不做搬运,也不批量制造 AI 视频。这些对我来说没有意义。 我想做的是: 把 AI 当作工具,用它为自己赋能。从我这里出去的作品,至少要有我的参与、我的思维和思考,要做有增量、有意义的事。 AI 越来越强,一次次刷新我的认知。每到这时,我都会再提醒自己一遍: 这不是我的能力。我该做的,是用好这些能力,做出更有意义的东西。
显示更多
0
8
47
16
转发到社区
阿里云开源「企业级 Agent 白皮书」 2026 年最新发布,是 2025 年 9 月「AI 原生应用架构白皮书」的升级续作。全书按 架构 → 构建 → 运行 → 治理 → 调优 的全生命周期组织,共 7 篇 30 章,由阿里云数十位一线工程师分工撰写,并纳入吉利、塔斯汀、MiniMax、哔哩哔哩、信永中和等外部企业案例。 它的写作动机很明确:过去一年市场重心已经从 “如何快速搭出一个 Agent” 转移到三个新挑战,工程化(从概率智能到可靠生产力)、规模化(从单点试验到智能基础设施)、组织化(从 Agent 孤岛到进入核心业务流程)。现有的框架文档和教程基本不回答这些问题,这本白皮书填补的正是这个空白。 开源地址 # 各篇核心内容 架构篇(1–2 章) 建立认知框架。给出 Agentic Application 的六个判定特征(以任务结果为中心、运行时决定部分执行路径、能作用于环境、维持跨请求状态、受确定性机制约束、可观测可评估)和成熟度四级模型(L1 辅助生成 → L2 受控自动化 → L3 Agentic Execution → L4 规模运营)。两个重要的解耦判断:用哪种形态取决于任务结构,处于哪级成熟度取决于治理完备程度;单 Agent / Long-Horizon / 多 Agent 是沿时间跨度和协作结构两个正交维度的扩展,不存在“必须升级到多 Agent”的路径。贯穿的原则是“最低充分架构”,为任务选择成本与风险可接受的最低复杂度。 构建篇(3–6 章) 是方法浓度最高的部分,按“范式—任务—信息—行动”还原构建过程: · 任务:Agent Loop 五阶段(Prepare→Model→Act→Observe→Verify)+ 十态任务状态机,要害是“消息历史不应是任务状态的唯一来源”;完成判定的核心原则是“模型只能申请完成,Harness 依据环境证据提交完成”,验证分五级并与风险匹配。 · 信息:Context 是动态“编译”而非静态字符串。本章的独创设计是 Context Manifest,每次调用记录上下文每个片段的来源、作用域、版本、信任级别、选中理由和内容哈希,使“模型看见了什么”变得可解释、可回放、可审计。信息被五分为 Context/State/Memory/Knowledge/Skill,其中 Memory(个人经验)与 Knowledge(组织内容)必须分列,因为治理责任不同,“放进同一个向量库会同时失去两类治理能力”。 · 行动:统一 Action Plane(意图→Schema 校验→身份绑定→策略决策→执行→观测),关键三分:“模型看见工具 ≠ Harness 注册了工具 ≠ 获得执行授权”。协议定位清晰:Function Calling 是模型-Harness 意图接口,MCP 是 Harness-能力提供方连接协议,A2A 面向拥有独立任务循环的远程 Agent,“协议选择由能力是否拥有独立任务循环决定,而非新旧或流行度”。 运行篇(7–12 章) 处理规模化后的工程问题,大量内容达到了分布式系统的专业深度:沙箱后端选型判据(容器/gVisor/MicroVM 按代码可信度与租户边界取舍);状态外置后 Event Log / Checkpoint / 工作区快照三者不可互相替代,且“Durable Execution ≠ 外部动作恰好执行一次”;AI 网关对 LLM/MCP/Agent 三类流量按不同粒度治理,其中“严格预算需要原子预留而非阈值检查”的数学化分析(余额 100、两笔 80 的并发请求都会通过)是真实的并发工程细节;多 Agent 编排强调“最小充分共享”,共享的是上下文来源而非同一个 Context 窗口。 治理篇(13–16 章) 让自主运行的系统变得可信。可观测性的判据是“请求成功 ≠ 任务成功”;安全章同时把 Agent 当被攻击对象和行为主体来防护(身份是全章最扎实的部分:数字工牌、Token Exchange 权限收敛、On-Behalf-Of 且 Agent 权限 ≤ 用户权限);资产管理把 Prompt/Skill/MCP/Agent 当作运行时依赖做注册与版本治理。第 16 章 Agent Simulation 是全书原创性最强的一章:Agent 行为之所以不可验证,是缺制度前提(角色无外部标准、失败无自然代价、身份不连续),模拟是当下唯一可做的事,本质是“用可靠 Harness 约束不可靠内核”。它甚至给出诚实的统计学提醒:n 次零违规的 95% 置信上界约为 3/n 而非零。 调优篇(17–24 章) 的组织原则是“归因决定方法”:先排除环境故障、再修 Harness、最后才动模型,“把本应由上下文或工具协议解决的问题当成模型不行,是代价最高的一类误判”。主线是数据飞轮:Trace→Trajectory→黄金数据集(输入/轨迹/结果/判据四要素)→Badcase 闭环→受控自进化(模型生成的改进一律是候选变更,须回流构建、过门禁、可回滚)。模型调优章对 SFT/Agentic RL/蒸馏的适用边界、奖励投机的三套机制分离(训练奖励、独立评测、系统硬约束)论述相当严谨,广引 DeepSeek-R1、Tulu 3、FrugalGPT 等外部工作。 总结篇(第 30 章) 是全书思想密度最高的总结。当企业同时运行多 Agent、多框架、多租户时,同样的工程要求在每个应用里被重复且不一致地实现,这本质上是缺一个共享的系统层。Agentic OS 被给出“窄定义 + 三条否定”:为 Agent 任务提供公共运行对象、能力接入、可强制边界与统一证据的系统层,它不持有任务语义、不是又一个框架、不必然改内核。能力下沉有三条判据(复用性 + 强制性或可验证性),九类管理对象(其中 Budget Lease 预算租约最易被忽略),并提出“自治上限由可撤销范围与可证明范围决定,而非模型能力”。 调研报告 的 1906 份问卷给出一个关键发现:已开发或开发中 Agent 的企业占 46%,但真正上生产的仅 18%;有评估体系的企业任务成功率是无评估者的约两倍,卡点不是模型能力,是 Harness 层的工程配套。这与全书立意互为印证。
显示更多
0
11
59
14
转发到社区
之前问了虚拟网卡 Tun 模式下微信图片加载慢的问题, 大家非常热心的给出了很多诊断的建议,我做了一下复盘: 微信的网络机制本身就极其特殊。@wq268888 提到微信自己有一套优先内置解析、网络嗅探和信息分析,一旦发现流量被虚拟网卡接管,就会不断重试,明确走不了才会降级到常规网络。@giv00257710 踩过更深的坑,发现微信很多图片其实是直接走纯 IP 地址拉取,压根不走域名,导致常规的域名白名单直接失效。加上 @tzhsz 提到的 edns 机制,多媒体 CDN 很容易被国外 DNS 误解析到海外服务器。 第一流派,也是呼声最高、提议人数最多的关停 IPv6 派。 @LeungDeo、@Edison_aware、@BarrySong97、@Ner0sss、@5tran9er 和 @ncle99 都直接给出了一句话诊断:关掉 IPv6。 @Jerry182809 直言用机场的第一步就是关 IPv6。@chrislee_sub 也吐槽微信的 IPv6 兼容问题早就存在好几年了。@0i8up 补充说国内很多家庭路由器和宽带的 IPv6 本身就极其不稳定,像没普及一样,开了徒增玄学断流。 关掉 IPv6 救活的远不止微信。@vireriver 反馈自己只要一开代理,京东和淘宝的商品图片全线崩溃,关了 IPv6 立刻恢复;@ddflj3310 也提到在 Surge 下剪映等抖音系应用完全登不上,同样靠关 IPv6 解决。@HunterRockCat 则提醒飞书等办公协同软件也会遭遇同样的问题。 背后的逻辑被 @grok 和 @MoeDejavu 点透了:绝大多数代理节点根本没有配置 IPv6 出口,但 DNS 偏偏解析出了 AAAA 记录。微信偏偏优先尝试 IPv6 连接,结果掉进路由黑洞死等超时,几秒后才狼狈降级回 IPv4,体感上就是图片一直在死转圈。@MoeDejavu 建议,如果关了 IPv6 还不稳定,记得把代理客户端里的 AAAA 查询解析也一并关停。 第二流派,追求完美双栈的 fake-ip 规则精修派。 很多朋友不想为了微信直接废掉 IPv6,选择对分流配置进行细化。@0xfingeroo 贴出了 GitHub 上 Clash Verge Rev 官方 issue 1762 的长篇排查讨论。 @qtwaiter 给出了教科书级的 fake-ip 原理:在虚拟网卡接管流量时,所有域名都被劫持进了虚拟私有网段。必须在 dns 配置的 fake-ip-filter 加入白名单,强制腾讯的多媒体域名走真实国内 IP 解析。比如针对 QQ 和微信的图片视频,把 放进过滤列表。 @LeonKuo2023 具体给出了两条立竿见影的直连后缀规则: 和 提醒,很多人的微信图片卡死,纯粹是因为分流规则没写全,图片请求被最底下的兜底规则误送到了海外代理。@cnfree8964 补充把严格路由关闭;@LaelLuo 建议排查 QUIC 协议嗅探;@neotuper 建议检查 SNI 分流;@AwesomeYang_com 和 @wooooow_wo 则建议在规则里单独指定微信进程走 DIRECT 直连。 第三流派,干脆放弃虚拟网卡的实用派。 @YanzuWuahh 早就被 Tun 模式的各种玄学搞烦了,选择退回经典架构:系统代理搭配 Proxifier,只对指定的海外开发工具开启强制代理,微信这种国内应用压根碰不到虚拟网卡。 @qg7777 提到,如果没有配置专门的软路由做增强模式,单靠本机跑单一的 Tun 模式极易翻车。@bnxiohi15661429 也吐槽某些客户端内核对 Tun 的处理不够完善,换成小火箭等工具反而没这些毛病。 第四流派,赛博神医 AI 排查流。 @dave33_z 分享了硬核实战:之前买 AWS Lightsail 晚高峰延迟卡死,直接把网络环境和配置丢给 Codex,一通调优把晚高峰延迟压到了六十毫秒。现在遇到各种网络玄学,直接把配置文件丢给 AI 分析。 @tina_sound43105、@neveriwill14294、@xueyu1125、@thePixelsAI、@Silas10m 和 @Lee656233622 全都站这一边。把本地分流规则丢给 Codex 或 DeepSeek,让模型顺着路由跳数检查,几分钟就能自动生成改好的配置。@misaki233q 更是让 Agent 搓出了一套高级双栈规则:国内应用走 IPv6 直连,海外流量走 IPv4 代理,鱼和熊掌全部兼得。 第五流派,反思工具本质的断舍离派。 @WetThinAir 抛出了一个直击本质的问题:我们到底为什么非要开 Tun 模式?像很多写代码的工具,单独配个终端环境或者局部端口就能跑得飞快,根本没必要为了几个工具让全系统的网络流量都从虚拟网卡里冒险淌一遍。 遇到微信转圈的朋友,照着这份清单排查,基本药到病除。
显示更多
0
26
441
38
转发到社区
8. Gmail + Sheets + Calendar → 搭一套完整的跟进系统 提示词: “分析与 [客户或项目] 的 Gmail 对话,提取待办事项,创建 Google Sheet 跟踪进度、截止日期和状态,再在 Google Calendar 里安排跟进提醒。” 结果:不再错过截止日期,不再忘记跟进。
显示更多
1/ GPT-6 Astra 在 Minecraft 里走得比此前任何 AI 系统都远。 它建造了半自动烈焰人农场,收集到 6 根烈焰棒;随后找到诡异森林,击杀 6 个以上末影人,获得 3 颗末影珍珠。 数千名观众观看直播时,Astra 把贵重物品放进箱子。随后一只苦力怕出现,炸毁了箱子和床,所有进度归零。 Astra 似乎非常沮丧,并提醒自己:“关键物品必须随身携带并开启 keepInventory,永远不要再放进无人看守的箱子。”
显示更多