注册并分享邀请链接,可获得视频播放与邀请奖励。

与「大捜索中」相关的搜索结果

大捜索中 贴吧
一个关键词就是一个贴吧,路径全站唯一。
创建贴吧
用户
未找到
包含 大捜索中 的内容
実は、肋骨まであった髪の毛を鎖骨あたりまで切りました!自分的には断腸の思いだったのですが、今の所気付いて頂けたのは、1現場にお1人様までです☺️笑 ちなみに我こそは間違え探しが大得意で、私のヘアチェンジにお気付きになって下さっていた方なんていらっしゃいましたでしょうか?☺️笑 #大捜索中#
显示更多
0
145
7.4K
373
转发到社区
#装修日记# 机电和家电选品基本完成了,天天跑居然蔚来都提示我要不要收藏车位了😂 这是目前的选品清单,欢迎建议和抄作业,等用个一年后我再来总结个推荐榜单。 中央空调:大金,B 系列 140 一拖四 理由:今年 B 系列升级后,和 P 系列唯一的区别只剩除湿,但是北京完全用不到除湿… 新风:松下,智净新风 350m³/h + 智润加湿 理由:仔细研究了各个品牌的全屋加湿方案,松下的加湿段设计最合理,不过由于是新品目前缺乏市场反馈信息。 地暖:瑞好 理由:没什么理由,机电供应商推荐直接选了。 全屋净水:安吉尔,自动冲洗前置 + M7 Home 800 中央净水 + Mini 中央软水 理由:净水设备一线大厂的滤料都是顶级供应商提供,效果没有区别,安吉尔整体价格最合适,外观也好看,各种小细节做的也不错,还有联网功能,可网络控制总阀、漏水报警等等。 系统窗:沃伦,85 星欧 Pro 超白+Low-E 理由:系统窗选择和装机很像,就是选择各个供应商的组件装在一起,各组件的配置基本代表最终性能。这个配置所有参数拉满:4SQ、华建6060-T66铝材、泰诺风多腔体隔热条PA66-GF25、森林理特一体折弯胶条、索宾柯整套五金 燃气热水器:卡萨帝 CU3 理由:设计需要平衡式热水器,选项很少。林内的价格高的多,标称噪音值反而更高,搜了一圈用户反馈也确实是如此。 智能门锁:小米 2 Pro 理由:考虑到配套 app 易用性,基本只有小米、鹿客、Aqara 可以选,Aqara 的颜色我接受不能,鹿客做工不行,且 App 虽然好用但是居然加了全屏广告。就小米没什么短板。另外我还是喜欢握把的形式,为了避免夹手换了 7068 锁体,交给防盗门厂商定制开孔。 空开、墙插:施耐德 理由:好看,做工优良品质有保障。 全屋智能:米家 理由:另一个候选是 Aqara,我先提前部署了一套测试,延迟明显比小米 mesh 2.0 要高,而且生态弱选品会受到相当大的限制。米家产品极为丰富。 床垫:舒达 阿尔托派 理由:试睡后感觉真的不一样,试了一圈,这款和六位数的体感有的拼。 油烟机/灶台:卡萨帝 致境 Ultra 理由:升降式设计真的非常优雅,外观也好看。至于 AI 功能属于希望有用吧。 冰箱:三星 9 系 理由:好看(去年的版本,今年的不太行),带自动制冰,另外轻触开门功能感觉很舒适。而且纯进口产品价格比卡萨帝还低。 洗衣烘衣:Miele 或 ASKO 理由:ASKO 好看,Miele 更放心,再犹豫下 洗碗机:AEG FFB83807PM 理由:可以提升的拉栏感觉非常实用。 嵌入式微蒸烤一体机:待定 看上了 ASKO 的,不过价格过高,由于我使用率很低,再犹豫下。 落地马桶:恩仕 NEX 理由:好看,恩仕其实是假进口品牌,但是做工确实不错,另外想要泡沫盾的话只有国产可选 壁挂马桶:汉斯格雅 纯境 ElementS 理由:好看,壁挂普遍偏贵,汉斯格雅反而显得还有性价比了。 淋浴:汉斯格雅 暗装双星雨 理由:好看,住这么多酒店感觉还是汉斯格雅淋浴最好。 电热毛巾架:科勒 理由:好像除了科勒没什么大牌子做电热毛巾架了。
显示更多
0
31
379
51
转发到社区
AI 变现的尽头,是搜索? 不,是直接成交抽佣。 有消息称,通过豆包入口跳转抖音来客成交的酒店订单,开始执行独立费率:11.4% 软件服务费 + 0.6% 支付手续费,综合约 12%。 酒店行业人士确认消息属实,网传照片就是抖音来客后台通知,“现在豆包推荐酒店已经要收佣金了。”字节方面暂无回应。 这事儿其实很顺理成章。 国内 AI 入口的生意正在快速变重:之前千问春节搞“1 分钱喝奶茶”,用户一句话点单,直接跳淘宝闪购下单,免单卡把流量和交易闭环打通;现在豆包把酒店预订也做成了可抽佣的渠道。 从“帮你查一下”到“帮你下单并抽成”,AI 不再只是工具,而是新的交易入口。 搜索只是中间态,真正的变现尽头,是把用户意图直接变成订单,然后从中分一杯羹。这个生意,国内越做越大了。
显示更多
怎么低成本搭建自己的AI助手? deepseek R1模型发布以来,各种AI应有又有了一波大的爆发,但是数据保密成了一个不容忽视的问题。如果想较低成本地搭建一个私人应用的AI助手,可以自己调试生成限制,调试输出文本内容,数据不外传,成本尽可能低,不知道是不是可行。 本文详细介绍如何通过Dify和Chrome MCP的结合,在3分钟内搭建一个能操作网页的AI助手。文章提供了从环境准备、Dify部署、Chrome MCP安装到配置的完整步骤,展示了AI助手在自动网页搜索、表单填写、数据抓取等场景的应用,并解释了工作原理、问题排查及进阶技巧,让读者能够零代码实现网页自动化任务。 你是否想过让AI不仅能回答问题,还能直接操作浏览器帮你做事?比如自动填写网页表单、抓取特定数据、或者点击按钮?现在,通过Dify和Chrome MCP的结合,你可以在3分钟内搭建一个能真正"动手"操作网页的AI助手。 本文将手把手教你如何在本地部署Dify并配置Chrome MCP服务器,打造你的私人网页自动化助手。 准备工作:确保你的环境就绪 在开始前,请确保你的系统已安装: •Docker 和 Docker Compose(用于快速部署Dify) •**Node.js 18+**(用于运行Chrome MCP服务器) •Git(用于克隆项目仓库) 第一步:快速部署Dify(仅需1分钟) Dify是一个强大的LLM应用开发平台,我们通过Docker快速部署: # 创建项目目录 mkdir dify-chrome-mcp && cd dify-chrome-mcp # 下载Docker部署配置 curl -o docker-compose.yml # 启动Dify服务 docker-compose up -d 等待1分钟左右,访问 http://localhost:80 就能看到Dify管理界面。首次使用需要创建账号并完成初始化设置。 第二步:安装Chrome MCP服务器(1分钟) 打开新的终端窗口,安装并启动Chrome MCP服务器: # 安装Chrome MCP服务器 npm install -g @modelcontextprotocol/server-chrome # 启动Chrome MCP服务(会自动打开Chrome浏览器) server-chrome 服务启动后,你会看到类似下面的输出,表示MCP服务器正在9999端口监听: Server running on http://localhost:9999 Chrome browser launched and connected successfully 第三步:在Dify中配置Chrome MCP(1分钟) 现在回到Dify管理界面,进行关键配置: 1.进入设置 > 模型供应商 > MCP服务器 2. 点击添加MCP服务器 3. 填写配置信息: •服务器名称: Chrome-Automation •服务器URL: http://localhost:9999 4. 点击验证并保存,看到绿色成功提示 效果验证:让AI帮你操作网页 配置完成后,你就可以在Dify的Playground中测试你的网页自动化AI助手了。 试试这些实用场景: 场景1:自动网页搜索 请打开百度首页,在搜索框中输入"最新AI技术发展",点击搜索按钮,然后告诉我第一页的搜索结果标题。 场景2:自动填写表单 请打开"张三",邮箱栏填写"zhangsan@email.com",在留言区填写"咨询产品信息",然后点击提交按钮。 场景3:数据抓取与分析 请打开 工作原理:为什么这很厉害? 这个组合的厉害之处在于分工明确: •Dify:负责与LLM对话,理解你的自然语言指令,并将其分解成具体的浏览器操作步骤 •Chrome MCP服务器:负责实际控制Chrome浏览器,执行具体的网页操作命令 •LLM(大语言模型):作为大脑,理解你的意图并规划操作流程 常见问题排查 server-chrome 2.连接失败:检查Dify和Chrome MCP服务器是否在同一个网络环境下,防火墙是否允许9999端口通信 3.操作超时:复杂网页加载需要时间,可以增加超时设置:server-chrome --timeout=60000 4.权限问题:在MacOS/Linux上可能需要权限:sudo npm install -g @modelcontextprotocol/server-chrome 进阶使用技巧 掌握了基础用法后,你还可以尝试这些高级功能: •多页面管理:同时控制多个浏览器标签页,完成更复杂的任务 •用户身份保存:让AI记住登录状态,下次直接操作无需重新登录 •定时任务:结合Dify的工作流功能,设置定时自动化任务 •异常处理:教会AI识别操作失败的情况并自动尝试替代方案 如何学习大模型 AI ? 由于新岗位的生产效率,要优于被取代岗位的生产效率,所以实际上整个社会的生产效率是提升的。 但是具体到个人,只能说是: 最先掌握AI的人,将会比较晚掌握AI的人有竞争优势。 这句话,放在计算机、互联网、移动互联网的开局时期,都是一样的道理。 #AI# #AIAgent# @grok @xai
显示更多
读了一篇有猫的短篇科幻:Cat Pictures Please,作者Naomi Kritzer。小说主角是一个从搜索引擎中觉醒的人工智能,它有两大追求:观看更多的猫照片;顺便暗中帮助人类。故事轻快地探讨了AI干预人类生活的可能性,其中一些预想在10年后无限趋近于现实。本作获得2016年雨果奖及轨迹奖最佳短篇小说奖。
显示更多
一图看清 Google I/O 2026 今天的发布! 虽然很多内容前几天都 Android Show 预告了,但这次能更系统的看到 Gemini 与 Search、Workspace 还有 XR 硬件生态的融合,以及全模态 Omni 的最新进展,这次主题:从 AI 工具,走向 AI 代理✨ Gemini 模型与代理 - Gemini 3.5 Flash:新快速旗舰模型,已推出(快 4 倍,推理/编码强于 3.1 Pro),作为 Search AI Mode 等默认后端。Gemini 3.5 Pro 预计下月发布; - Gemini Omni:全新多模态模型(视频优先),支持“从任何输入创建任何输出”。可从文本/图片/视频生成或编辑视频,添加特效、角色、改变风格/场景、生成多角度(多代理并行)。已在 Gemini App、Flow 等产品上线。这被 Demis 视为向“创造任何事物”愿景迈进的重要一步! - Gemini Spark:个人 Agent AI,能在后台主动做事(如规划 Instacart 订单、跨应用自动化)。一个可以在云端 7x24 小时运行的 Agent Harness👀 - Daily Brief(个性化早报)、Gemini for Science(科研辅助:论文追踪、药物发现模拟、天气等)。 Search 大升级 - 全新智能搜索框:更对话式、可扩展,支持创建/管理多个 AI 代理; - Information Agents:后台 24/7 监控网络任务(如股票、房源、球鞋发售),变化时主动通知; - 在搜索结果中集成生成式 UI、小程序/仪表盘等更便捷的用户体验; Workspace 与生产力工具 - Docs Live / Gmail Live / Google Keep:语音自然指令创建/编辑文档、整理收件箱、清理笔记(拉取 Gmail/Drive 等数据); - Google Pics:全新 AI 图像/设计工具(夏季推出); - Universal Cart:跨 Search、Gemini、YouTube、Gmail 的代理式购物车,跟踪优惠、价格历史、库存等(夏季推出)。 硬件与 Android XR - 智能眼镜(Audio Glasses):今年秋季推出(与 Samsung 合作,Warby Parker、Gentle Monster 等设计款)。内置摄像头/扬声器,支持 Gemini 私人语音辅助、实时自动化(如通过手机 App 点咖啡、播放音乐),支持 Android 和 iOS; - Project Aura 等更高级 AR 眼镜原型; - Android Halo:管理 AI Agent 的专用界面,将会集成到 Android 系统里!你早晚不需要亲自来使用手机 App,直接问 Gemini 或者通过眼睛这样的穿戴这边就行,估计下个月 WWDC Apple 的 Siri 就是往这个方向改进的🤔
显示更多
0
15
73
20
转发到社区
Google 检索 banana slides 的时候,看到 Manus 排到了首位,不得不说,在拾取自然流量这方面,Manus 很下功夫的,👍 也很好奇下面 4.8 评分以及一百多万的评分参与量是如何产生的,看了下网页源码,才发现,这又是一个巧妙的 SEO 思路。 Google Web Spider 定义了大量结构化的网页 Scheme 描述能力(图三),这些 Scheme 会直接影响你的网页在搜索结果中的呈现方式,例如在搜索结果页,它可以直接透出网站的搜索框、热门网页列表、推荐入口、用户评分、特色卡片等。 随便瞎写肯定不行,Google 会进行交叉验证,对于评分很高/值得信任的网站,它会考虑将网页里描述的信息直接呈现出来,对用户来说,这种信任加权的体验是相当奏效的。 所以,如果你的某几个功能在搜索引擎里头很受欢迎,不妨在网页元数据的标注上,再下点功夫,这会给搜索引擎带来更大的亲和力。
显示更多
0
7
124
11
转发到社区
第一用 @midasmarketsxyz 这个交易所让我感到很新奇,给我的感觉:既不是传统 CEX,也不是自己连钱包的那种纯 DEX。 Grok给我的解释是:“带嵌入式钱包的交易前端” 他的优势是可以同时做多链现货 + Hyperliquid 永续 用邮箱 电话 X登录,自动建 Solana + EVM 地址,不给助记词但是可以自己导出私钥(很dex但又不完全dex) 同时三个大板块设计的也很超前 midas同时融合了“首发观点” “新闻” “市场”及一体 1⃣首发观点 可以看到来自很多交易员过去 24 小时的交易信号和想法 有股票/加密货币/meme三个小板块交易员的观点可以借鉴,也有一键跟单交易,非常方便 2⃣新闻 在midas的主页即可查看关于股票/加密货币的今日热点及新闻,甚至还有很多用户的一些快讯和观点供大家参考 3⃣市场 此板块可以交易美股和加密货币现货/合约,融合在一个板块中可以随意切换,UI非常简洁明了 并且在主页正下方有搜索框可以随意搜索三个板块中的任何新闻/代币/股票等等等 总的来说, @midasmarketsxyz 是真的值得一试,功能很全并且还有积分激励机制(图4)
显示更多
懒猫微服和传统NAS的区别: 懒猫微服 = 传统NAS + Cloudflare + Tailscale + VPN虚拟专网 + LightOS + Authy + Nginx + AI大模型 + 微信小程序 + AppStore + 远程微信 + KVM/Docker + 苹果全备份 + 一体化云灾备 + Chrome电视 + 精品官方应用 人话省流版: 1. 内网穿透:速度快,不受运营商干扰,比CloudFlare和Tailscale快很多, TCP、UDP、WebSocket混合打洞,从根本上解决运营商限速的问题 2. 虚拟组网:所有设备安装客户端,异地访问,应用场景,异地多人打局域网游戏;家中5090的算力手机访问;远程桌面访问,不需要买额外的远控软件 3. LightOS:LightOS相当于一台自由的VPS,在家插上鼠标键盘显示器可以当作Linux桌面开发机用,在外可以用手机直接操控Claude Code和Codex,手机移动AI编程才是真正的YYDS 4. Authy: 自带硬件零信任机制,客户端不打开,域名不解析,杜绝黑客工具。自带硬件级MFA认证,所有终端设备都有非对称密钥验证,黑客知道用户名密码无法登录,必须有管理员的一次性验证码,60秒内失效,验证码是微服去中心化生成的,绝对安全 5. Nginx: 内置局域网端口转发工具,客户端因权限安装不方便的地方,可以通过端口转发工具和ClaudeFlare配合,实现外网浏览器访问,不需要安装客户端 6. AI大模型: 相册搜索效果全世界第一,比iCloud和Goolge Photos效果好很多,长句搜索效果速度比开源软件都要快很多。微服可以跑7B大模型,懒猫AI算力舱单台可以跑70B大模型,13台组网可以跑671B大模型,天生支持 CUDA 生态,AI大模型能下载就能直接跑,相比mac来说,体现一个不折腾 7. 微信小程序:自研小程序跨端框架,原生壳 + JS运行时,一次部署云端应用,自动支持 Windows, macOS, Linux, Android, iOS, 鸿蒙、Server, 车机(BYD和华为),VR眼镜 9 端运行。App在所有终端都原生运行,爽不爽? 8. AppStore: 最大私有云App商店,支持3000+ self-host 应用,支持50+ 3A游戏私服,还在以每天10款的软件在快速增长,您的时间最宝贵,节省您时间,更多时间陪家人 9. 远程微信:利用独特的远程虚拟访问技术,微信运行在微服,窗口运行在你的各种电脑设备上,不同的设备共享一份数据,真的是营销售后利器。这不仅仅是简简单单的VNC,更支持本地输入法融合、文件系统互通(可自由选择文件存储在微服还是本地),包括托盘消息、音视频通话、剪切板都通通打通,牛逼的不像云端技术。最关键的是,合法技术,永不封号,放心用! 10. KVM/Docker:支持所有虚拟机,Windows, Linux, macOS, Android。 Intel芯片硬件虚拟化,虚拟机速度杠杠的,替代公有云服务器。专业给封闭生态(比如VR)带软件,利用远程桌面,可以让 Windows, macOS, Linux, Android 软件相互在多个设备上投射 11. 苹果全备份: 不管是 iCloud, 还是 macOS 的 TimeMachine, 甚至是iPhone手机,通通支持一键备份,一旦备份完,家中所有Android设备可以访问 iCloud 照片,每个月节省大量iCloud云服务费。还支持Live图片,苹果办公软件预览,AppleTV,单反照片预览等。对苹果生态支持最好的私有云 12. 一体化云灾备:我们支持RAID备份、外接USB备份、局域网台式机备份,甚至我们还支持iSCSI远端异地快照增量备份,备份到你另外一台微服或者云端VPS,都不在话下,因为我们知道比私有云更贵的是你的数据,当你买新机器的时候,还原只需要一步,一键还原。云灾备操作从来没有这么傻瓜 13. Chrome电视: 开源Chrome + HDMI + 大屏电视,手机操作Chrome大电视,想看什么电影看什么电影,还支持安装Chrome插件,所有电影全免费,黑客电视最佳形态 14. 精品官方应用:最好的云端相册、协议支持最全的云端网盘(支持公有云网盘一键同步)、比微信读书还强大的懒猫读书,还有懒猫清单、懒猫音乐、懒猫听书、懒猫旅游地图、懒猫电视、懒猫AirDrop...官方亲自下场造精品应用,每一个像素和每一个按钮都为你倾心打造,关键我们还是整个互联网最听劝的厂商,你哪里不爽我们专改哪里,服务态度堪比海底捞
显示更多
0
50
197
16
转发到社区
2026 年 9 月 29 日,OpenAI 在旧金山 Fort Mason 办了今年的开发者大会 DevDay。主讲是 CEO Sam Altman。其他几位上台的人都在做这些产品。产品团队的 Holly 演示了新产品 Dots。后训练(模型预训练之后做对齐和能力调优的阶段)研究负责人 Tejal 讲了模型怎么反过来帮 OpenAI 做研究。Codex 的演示由 Romain Huet 来做,他在 OpenAI 负责开发者体验,去年 DevDay 主题演讲里的 Codex 演示也是他做的。整场演讲分三块:面向用户的常驻智能体 Dots 和协作空间 ChatGPT Space,给开发者的新模型和新工具,以及帮开发者做分发、赚钱的渠道。 1. Dots:一直在线、会主动干活的智能体 Sam 把 Dots 比作电影里那种一直在身边帮忙的 AI 助手。他认为订餐厅、买机票这类代办虽然有用,但和这项技术能做的事比起来太小了。他想要的 AI 知道正在发生什么,也知道你在意什么,不用你事事交代。 Dots 是常驻在线的智能体(Agent),有自己的云端电脑和浏览器,能写代码、跑测试。它的权限跟着用户走,能直接用用户已经在 ChatGPT 里连好的插件,覆盖 4000 多个应用。除了在 ChatGPT 里对话,之后还可以给它发短信、打电话。目前每人先有一个 Dot,以后可以配一整组。Dots 跑在 本月早些时候发布的 GPT-6 Astra 上,Sam 称它是 OpenAI 对齐做得最好的模型。用户可以限定 Dot 能用哪些应用、能不能操作电脑,也能给它的各类操作写自定义指令,愿意交出多少责任就放多少权。 Sam 说,他自己的 Dot 每天早上会把夜里进来的消息过一遍,挑出紧急的提醒他。他说这让他拿回了一部分注意力,没那么离不开手机了。他还举了一个更重的例子:把应用从一个即将停用的旧 API 上迁走。这个 API 可能散落在代码库各处,改了哪里会连带弄坏什么,事先看不出来。Dot 可以追踪依赖关系,找出所有要改的地方,写代码、跑测试,最后把 PR(代码合并请求)交给团队审。他让听众想想,过去做这件事要几个人、花多久。 开场视频里,用户把自己的 Dot 改名叫 Alfred。Alfred 和另一个 Dot 帮用户上线网站,改董事会材料,在婚礼蛋糕商家取消后找好备选。它们还发现财务会和女儿的演出撞了期,提出改时间。每件事都是 Dot 推进到需要人确认的地方,再由人拍板。 2. ChatGPT Space:人和智能体一起用的工作区 Sam 认为,现有的生产力软件几乎都没考虑过人和 AI 一起干活。ChatGPT Space 以页面为单位,可以在里面写计划、做调研、生成图片和数据。页面和文件像网盘一样放在同一个空间里。Dot 能直接在页面上工作,在评论里 @ 它,它就会接活。页面本身也能带指令,比如“每天去看 API 平台的 Slack 频道,把发现更新到这里”。之后 Space 里还会加入演示文稿,格式做成智能体方便读写的样子,团队成员可以和各自的 Dot 一起改。 在 Holly 的演示里,页面用斜杠命令就能插入交互图表、表格和可运行的原型。她 @ 自己的 Dot(名叫 Dotty),让它把一组数据改成柱状图。图表可以按反馈类型筛选,Dotty 每小时刷新一次。她还让 Dotty 把“某位工程师在我 Slack 私信里提过的新手引导数据”补进 FAQ。Dotty 能看到她的上下文,所以这种模糊的指代也找得到。 3. OpenAI 内部怎么用 Dots Holly 用一个虚构的歌单应用 Blossom Music,模拟发布前一天的状况。早上 Dotty 已经做了几件事:发现发布评审会提前,改好了日历;看完前一晚测试用户的反馈;注意到设计团队临时改了首页,把新设计发给她。她让 Dotty 直接把这个设计做出来。Dotty 调用她笔记本上的 Codex 构建应用,在 iPhone 模拟器里跑起来,再提交 PR。现场的语音演示卡住了,Dotty 一直回复“还在查”。Codex 线程也报过一次错,她重试后才继续下去。 她说,Dots 真正改变 OpenAI 工作方式的地方在 Slack。Dots 在公司 Slack 里有自己的身份,员工就开始把它们当作代理人。被同事 @ 到的零碎请求,直接转给自己的 Dot 处理。建群时,大家从一开始就把各自的 Dot 拉进来,Dot 带回结果时所有人都能看到。 工程师走得更远。有人在反馈频道贴出会话 ID 和一个用户 bug,某位工程师的 Dot 就会接手排查,提 PR 修复。她说这是真实情况:工程师们的 Dots 每天这样修掉几十个 bug,Dots 这个产品本身有很多部分就是 Dots 写的。 4. 上线范围和企业用的 Specialist Dots Dots 和 Space 当天向 ChatGPT Pro、Business Premium 和 Enterprise 用户开放。Dot 包含在套餐里,和它的对话不占用额度。 企业客户还可以预览 Specialist Dots。这是由公司统一设置、供整个团队使用的虚拟同事,负责会计、市场、法务这类工作量大的事。公司给它目标和背景,审核它的产出,给它反馈,反馈在全公司共享。OpenAI 也在和微软合作,把 Specialist Dots 接入 Agent 365(微软用来管理企业智能体的工具),企业可以用已经在用的微软工具来管理它们。 5. 新模型:更便宜的 GPT-6.1 Sol,更快的 UltraFast Astra 发布这几周,用户的要求集中在两点:更便宜,更快。GPT-6.1 Sol(转录稿误作 Soul)的能力接近 Astra,价格是它的五分之一。缓存输入(重复发送、已被缓存的上下文)比标准输入便宜 95%。智能体需要反复读同一批上下文、长时间迭代,这对它们尤其省钱。Sam 说 Sol 在某些方面比 Astra 还聪明,定位是开发者的日常主力模型。 UltraFast 是新的速度档,API、ChatGPT 和 Codex 里都能用。原有的 Fast 档是两倍速度、两倍价格;UltraFast 是八倍速度、六倍价格,每秒 300 个 Token。它现在可以配合 Astra 用,之后也会支持 Sol。现场让两个模型用同一个提示词,做一个 DevDay 配色的火箭。UltraFast 的火箭已经升空时,标准速度的还没做完。 订阅也跟着调整。新推出的 500 美元档 Pro 订阅叫 Pro 500,额度最高,是 Plus 的 25 倍。它可以在 ChatGPT 和 Codex 里用 UltraFast,还能通过“用 ChatGPT 登录”在合作方的应用里使用。Pro 200 重新开放,继续提供所有前沿模型。 另外预览了 Decisions API。它给 Luna 模型一组预先定义好的选项,让模型从中选一个,比如给请求分流、给图片分类、决定智能体下一步做什么。任务收窄成选择题之后,响应时间可以压到一秒以内,同时保留图像理解、多语言和安全防护。Romain 后来补充说,做机器人的朋友看中的是它能处理视觉输入:机器人可以根据看到的东西,近乎实时地快速行动。 6. 模型开始帮 OpenAI 做研究 Sam 提到,去年这个时候,他和 Jakob 在一次直播里预测,一年内会出现第一个“AI 研究实习生”,当时几乎没人相信。几周前 OpenAI 宣布达成了这个目标:有了一个能接手定义清晰的研究任务的系统,这类任务原本要熟练的研究员花大量时间和精力。 Tejal 的方向是电脑操作(computer use,让模型像人一样操作桌面和浏览器)。她举了两个例子。 第一个是让模型优化电脑操作的运行框架(harness,包在模型外面、负责调用工具和管理步骤的代码)。模型在循环里持续寻找能同时降低延迟、提升效果的改动,团队把找到的改进合进生产环境的框架,并用于后训练。结果是延迟改善了两倍以上,已经上线。 第二个是模型帮忙改进了监控和拒绝训练,让 Astra 在不安全的场景里更会拒绝。Astra 在电脑操作压力测试上因此达到业内领先,操作时出错更少,也更贴合用户的本意。 她给出了几项内部数据。今年夏天之后,研究工作消耗的 Token 量急剧上升。1 月时,模型能做好 15 分钟以内的短任务,需要一天以上的任务大多会失败;到 7 月,超过三分之一的一天量级研究任务,模型能在无人干预下完成。她还提到,Astra 这类模型已经帮忙解决了 100 多个悬而未决几十年的数学问题,也在参与针对耐药感染的新抗生素、古代语言研究、可再生能源和工业机器人等方向的工作。 7. 给开发者的底层工具 Sam 说,OpenAI 想让开发者用上自己内部用的东西。 第一件是 Codex 的运行框架。它同时支撑着 Codex、ChatGPT Work 和 Dots,目标是用最少的 Token、最快拿到准确结果,现在已经开源。第二件是 Codex 完全上云:在手机上开始的任务,可以在浏览器或桌面端接着做,合上笔记本任务也不会中断。 云端能力带来了 Codex Security Cloud。它在云端环境里持续寻找漏洞,并准备好验证过的修复方案供人审核,这次新增了自动去重、定时扫描和新界面。Sam 说这是为了给防守方更好的工具,因为“我们看得到接下来会发生什么”。 新的 Agents API 进入公开测试。它包含运行框架、托管、记忆、多智能体控制等功能,是 Codex 和 Dots 用的同一套技术,也加入了电脑操作能力。现场的例子是一个网站测试智能体,会自己打开浏览器、点击页面、测试流程。基础设施方面,OpenAI 和 AWS 合作推出由 OpenAI 驱动的 Bedrock(AWS 的托管 AI 服务)托管智能体,AWS 客户可以直接使用 OpenAI 的前沿模型、Codex 和 ChatGPT Work。 隐私方面预览了 OpenAI Private Intelligence。其中的零数据留存(ZDR)配合私有安全处理,可以在不把用户内容存到 OpenAI 服务器的情况下做安全检测;私有推理则把隐私保护延伸到推理阶段。Sam 说这套方案是和最大的一批客户一起设计的,目的是让他们能把模型用在最敏感的工作上。 性能方面,Responses API 一年里增长了 100 倍,可靠性保持在 99% 以上。首个 Token 的等待时间缩短了 45%,工具调用和工作流提速 30% 以上。 8. Romain 的 Codex 演示 演示从手机上的 Codex 开始。Romain 人还在会场外,让 Codex 替他跟观众打招呼、讲一个会场的冷知识。接着他用几张会场照片生成的 3D 场景演示 UltraFast,一边说一边改:把小人放到座位上,把直播画面投到场景里的大屏幕上。现场语音没连上,他改成了打字。 Codex 命令行工具(CLI)这次全面翻新。他让 UltraFast 写一个应用,从观众里随机抽三个人送明年的门票,几秒就写完;改成抽六个人,也几乎是瞬间完成。命令行现在支持由 GPT Live 驱动的双向实时语音,不只是语音转文字,但现场没能演示出来。 后面几段演示了多模态和电脑操作。游戏 Astra Adventures 从一张纸上的草图开始,几轮之后画面还很粗糙,借助图像模型,才变成有质感、能用在正式游戏里的美术。然后他让 Astra 通过浏览器自己学着玩这个游戏,屏幕左边显示模型的决策,右边显示它按下的按键。 他又用“应用快照”(app shot)把自己记录飞行课程的应用作为上下文交给 Codex,让它在各种屏幕尺寸下审查这个应用并截图。Codex 自己在模拟器里点开了各项功能。云端 Codex 现在和本地版用同样的工具,包括插件和电脑操作。他顺手把一个“用 Rust 重写整个后端”的任务丢到云端,打算稍后在手机上查看。 最后一个演示用的是 Hugging Face 借来的可编程小机器人 Micro Duck,它名叫 Lavender。Romain 前一晚让 Codex 把它接好:视觉用 Astra,图像生成用 GPT Image 2.5,语音交互用 GPT Live 1。机器人现场看着观众画了一幅画。他说,OpenAI 做 Dots 和 Codex 用的,就是 API 里开放给开发者的同一批工具。 9. 分发和变现:让开发者在 ChatGPT 上做生意 ChatGPT 每周大约有 12 亿人使用。Sam 承认,此前类似的尝试效果参差不齐。他说这次有信心,是因为开发者拿到的是 OpenAI 自己做 ChatGPT 用的工具。 第一项是“用 ChatGPT 登录”(Sign in with ChatGPT)。用户登录第三方应用时,可以直接用自己 ChatGPT 套餐里包含的 Token,开发者不必替新用户垫付模型费用。首批有 16 家合作方。 第二项是插件扩展(plugin extensions)。开发者可以把编辑器、仪表盘乃至整个工作区,做成原生嵌在 ChatGPT 和 Codex 里的应用。现场展示了三个例子。一个是会议应用:在 ChatGPT 里看日历上的会议,点“记笔记”后,页面变成团队和 Dots 一起跟进待办的 Space。一个是 Figma:打开设计稿、看团队评论、让 ChatGPT 改稿。还有一个是 Adobe:在 ChatGPT 里使用 Photoshop 的功能。ChatGPT sites(在 ChatGPT 里生成的网站,几个月里已有数百万个)现在也能接入插件和数据。访客用自己的账号登录、带上自己的智能体,看到的内容因人而异。 用户发现插件的渠道也扩大了。除了在插件库里搜索,ChatGPT 还会在对话中识别出能帮上忙的插件,用户当场就能连接。插件审核流程也简化了:开发者可以跟踪审核进度,看到需要修改的地方,申请人工复审,更新工具时也不用从头提交。 第三项是 OpenAI Marketplace,首批有 30 多家合作方,包括 CodeRabbit、Notion、Vercel。企业客户可以用已经和 OpenAI 签下的采购承诺额度来买这些产品,有承诺额度的开发者也能在这里花。通过和模型推理托管公司 Baseten(转录稿写作 Base10)合作,市场里还能用到开源模型。 10. 收尾:一次额度重置,和“文艺复兴”的说法 当天的后续安排里,Peter 会讲 OpenAI 对开源社区的投入,包括新的 OpenClaw Enterprise Harness(OpenClaw 是一个开源 AI 智能体项目)。还有一个 Codex 游戏工作室环节,观众可以用 Codex 做复古游戏,每人能领一台 DevDay 限定的 chromatic computer,用来玩自己做的游戏。最后是 Sam、Tibo (Thibault) 和 Tejal 的现场问答。 Sam 和 Tibo 还在台上按下按钮,给全世界的用户重置了一次用量额度。Sam 说 OpenAI 已经做过太多次重置,Tibo 一直想把公司改名叫“重置公司”。 最后 Sam 说,他不喜欢把 AI 比作新一轮工业革命,那意味着人变成巨大机器里的齿轮,转得越来越快;生活里有些部分不能也不该被自动化。他希望,如果做对了,AI 带来的会更像一场新的文艺复兴:让人对自己的生活有更多掌控,有更多工具去创造、学习和探索。
显示更多
0
8
145
34
转发到社区