注册并分享邀请链接,可获得视频播放与邀请奖励。

与「PR 」相关的搜索结果

PR  贴吧
一个关键词就是一个贴吧,路径全站唯一。
创建贴吧
用户
未找到
包含 PR  的内容
"Everything I touch with my keyboard and mouse, I try to delegate to my bots." Here's my new episode with @poteto and @pengzheng_, the eng and design leads for Grok @bot, where they showed me the 14 bots they use for work and life, including: → A design bot that turns one keyframe into a full user flow → An eng lead bot that manages a team of eng bots → How to trust your bots with more of your work Some quotes from both: "I like to call it the Michelin kitchen…when you say software factory, it has this connotation of mass manufactured slop." "Sometimes I actually don't even look at the PR until after it's landed and then I'm like, 'Oh, okay. Yeah, that looks good.'" "I think it ultimately comes back to trust. First, watch your bot work and correct it. Turn what worked into a skill. Once it nails the task in one shot, make it a routine." 📌 Watch now: Thanks to our sponsors: @meetgranola: AI meeting notes that don’t suck @RiversidedotFM: All-in-one AI studio for podcasts and video
显示更多
0
25
374
33
转发到社区
明日9/28(月)は福岡にお邪魔します✈️🩷2店舗! ⚔️ワンダーランド香椎Ⅱ店 ⏰10:00〜12:30頃 📸🖊️ファン対応 12:00〜12:30 ⚔️1188福岡東 ⏰14:00〜16:00頃 📸🖊️ファン対応 15:30〜16:00 各店舗サイン色紙(宛名入り)が15名さまに当たるそうです! LINE抽選は9:30までとのことなので 参加予定の方はお忘れなく🥺! 福岡のみなさまにお会いできるの楽しみにしています🥰 明日はよろしくお願いします☀️ #PR#
显示更多
0
13
1.4K
74
转发到社区
Codex 更新了,界面导航大改。左边新加了一个导航栏,把插件、定时任务、站点、项目、地图,还有 PR 都放到左侧导航上了。 新增了资源库和图像两个页面。 资源库里包含你所有的图像、图片、文件夹和收藏,你创作的所有文档以及 AI 创作的图像文档也都保存在这里。 图片那边的话,就是 ChatGPT 原来的图片页面里,有一些用 GPT-Image 模型的一些模板和提示词 其实这样改更好了。 不然之前全放在顶部,随着项目和聊天越来越多,每次找顶部那几个入口都得往回滚,挺烦的。 而且这次藏师傅的 CodePilot 领先 Codex 一个版本,几个月前就添加了资源库,把你所有由 AI 生成的内容结果汇总到一个页面,比如图像、视频、网页、音频这些素材。 你还可以从资源库的结果直接跳回聊天里看具体是怎么做的,非常方便管理,也方便让其他模型调用、复用这些素材。 不过也有很多人觉得不方便,说看着不习惯,这种大改肯定会有这种情况
显示更多
想加入BC保守党的可以看过来: 官网直接填: 
25加元,4年有效,能抵税。 条件就这几条: •加拿大公民或PR,平时住在BC •满14岁 •不能同时是其他省级政党的党员 •钱必须自己出,不能别人报销 在线填表付款最快。不想网上交的话,下载纸质表格填完签字,支票寄到他们指定地址就行。 入了就能投党魁、参加选区协会。现在查官网最准,别信二手信息。
显示更多
今天的面试真的很奇葩,一开始面试官告诉我,我们来一个js的live coding,然后说:“我看到你的vs code里面启用了github copilot,请把它禁用掉,但是你可以用google来查询信息。。。”,然后整场面试我就在用古法编程,手搓代码,连自动补全都不能用,然后还时不时的google一下,从StackOverflow上面copy & paste一些代码。好吧,我收回我昨天的话,现在在某些奇葩面试场合还是会访问到StackOverflow。 面试最后还超时了20分钟,然后快结束了我问面试官他们是否现在用AI来写代码,他说是的,现在基本只有人工review PR。 我是实在不明白,现在这种手搓代码的面试到底有什么意义?估计连他自己要下场手搓代码都搓不全。🤬
显示更多
当时为了给孙哥转微博,我注册了快20个小号,他们有的叫“以太坊斌斌”有的叫“比特币小牛”,有的叫“AAA股老牛”。 我是学钢琴出身的,每当孙哥在微博直播,这些熟练切换的手机留言就是我挥洒青春的舞台。 直播常常会有关于波场的智力问答,我总是一马当先,率先抢答。不仅没收到任何奖品,现在智商还受到了一些不可逆的永久损害。 为了抢救孙哥若有若无的名誉,我们活跃在各个网络黑子的评论区,哪里有黑子,哪里就有我们整齐划一的正步。 他曾经说,将来如果有钱了,就给自己订做一个24k的黄金马桶。如果有钱了,就给自己买一张铺满羊皮的柔软的大床。如果有钱了,就带我去窗外每天触手可及的金门海峡,去划一次船。 只能说长江后浪推前浪,新牛更比旧牛强。 看着如今那么多在抖音评论区造谣我的小号, 我流下了撑死徒弟,饿死师傅的欣慰瑞水。 后来孙哥有了自己的A股老年, 后来孙哥兑现了自己所有吹下的牛逼, 后来孙哥有很多很多的粉丝, 后来他带很多姑娘去坐我从来都没坐过的私人飞机,去见那些我们从前只在做白日梦时才敢说将来要一起去见的人,他们拍了很多照片,发了很多小红书。 但是他一定不记得, 那些只有比特币小牛的日子了。 #哪有人生低谷的离开# #认识你以后我的人生一直都在低谷# 关于PR,我已经没有什么,可以再教孙老师的了。
显示更多
0
115
321
12
转发到社区
阿里把团队内部用了两年的官方 AI Code Review Skills 开源了,采用 “确定性工程 pipeline + AI Agent” 的混合架构,专门解决通用 Agent 做代码审查时 “漏审、定位漂移、质量不稳” 的老问题。 40.5K ✨ 开源项目 OpenCodeReview: # 核心设计:确定性工程 pipeline × Agent 各司其职 确定性工程负责硬约束: · 精确文件选择:用代码决定哪些文件必须审、哪些要过滤,不依赖模型自觉; · 智能文件捆绑:把相关文件合成一个审查单元(例如 message_en.properties 和 message_zh.properties 捆绑),每个单元以上下文隔离的 sub-agent 运行,分治策略让超大变更集也稳,且天然支持并发(默认 8 个文件 worker); · 细粒度规则匹配:内置约 54 个按语言/文件类型的规则文档(Java、Go、TS/JS、Python、Rust、SQL/XML mapper、properties 等),用模板引擎而非自然语言把规则匹配到文件特征上,从源头消除信息噪声; · 外部定位与反思模块:评论的“落点”和“内容”分别由独立的 re-location 和 reflection 模块系统性校正,这正对“位置漂移”痛点。 Agent 负责动态决策: · 深度优化的场景 prompt(内部分为 plan → grouping → main → memory_compression → re_location → review_filter 多个任务模板,可在 internal/config/template/prompts/ 看到); · 从海量生产环境的 tool-call 轨迹(调用频率分布、单工具重复率、新工具对调用链的影响)反向蒸馏出的专用工具集,包括全文件读取、代码搜索、其他变更文件查阅等,比通用 agent 工具箱更小更稳。 # 能力面与生态集成 功能上覆盖:workspace/分支区间/单 commit 审查、断点恢复(ocr session)、全文件 scan(无 git 历史也能审计陌生代码库)、本地 Session Viewer 网页查看与回放、SARIF/JSON 输出、OpenTelemetry 可观测性、MCP Server 扩展。 作为 “Skills 生态” 级项目,它的形态相当完整:既提供 npm 全局 CLI,也提供可移植的 Agent Skill(skills/open-code-review/SKILL.md,带标准 frontmatter,可直接被兼容 skill 的 agent 加载),还有面向 Claude Code、Codex、Cursor、Kimi Code、OpenCode 等平台的插件,每种都封装成斜杠命令或可调用 skill。LLM 侧兼容 OpenAI、Anthropic、AWS Bedrock 三类协议,并可直接复用 Claude Code 的 ANTHROPIC_* 环境变量。 其中一个设计很巧妙:Delegation 模式(ocr delegate preview/rule)。此时 OCR 只做自己擅长的确定性部分(文件选择和规则解析)审查本身交给宿主 coding agent 的 LLM 执行,用户无需给 OCR 配任何 API key。这实际上是把“harness 能力”与“模型能力”彻底解耦。 # 工程质量:超出平均水准的部分 · 安全有正式的 Assurance Case(ASSURANCE_CASE.md):完整的威胁模型、四条信任边界、T1–T7 威胁逐条给出缓解措施,并按 Saltzer & Schroeder 设计原则和 OWASP Top 10 做了映射。细节经得起推敲:所有外部进程调用只限 git 且子命令硬编码、--end-of-options 防 flag 注入;Agent 读文件路径经 pathutil.WithinBase() 在符号链接解析前后双重校验;本地 Viewer 有 Host 白名单防 DNS rebinding + 严格 CSP。这类文档在一般开源项目里非常罕见。 · 贡献规范近乎严苛(AGENTS.md):使用 AI 必须在 issue/PR 中披露工具与模型、必须逐行理解 AI 生成的代码、禁止“AI 生成→反复修复→再修复”的循环、禁止把 commit 署名给 AI。源码强制英文(CI 有 english-check,连全角标点都查)、90% 测试覆盖率门槛、-race 与 govulncheck 每次 push 都跑、SPDX 头与 LF 行尾强制。 # Benchmark:数据情况 官方基准 AACR-Bench(已在 Hugging Face 开放)规模不小:50 个流行开源仓库、200 个真实 PR、10 种语言、80+ 资深工程师交叉验证出 1505 条标注问题。结论是同模型对比 Claude Code:Precision 和 F1 显著更高、token 消耗约为 1/9、速度更快。 需要指出两点:其一,Recall 低于通用 agent,README 自己承认这是“以精度换噪声”的刻意权衡,如果你最怕漏问题而非误报,可能不适合;其二,该基准由阿里自建,虽开放了数据集供社区复核,但独立第三方的复现结论目前还少,可以把它当作“有披露的、方向可信的参考”。
显示更多
0
13
169
39
转发到社区
After we fixed the weak spots exposed by Grok 4.7 (thank you, Grok), we audited every model we have run on the SWE-Together leaderboard for the same behavior, re-ran every trial that got through, and updated the rows. Here is what changed. We scanned the tool calls of all 2,616 trials behind the 12 models we ran for bypass patterns and sorted each trial into one of four buckets: Probed but blocked. Fetched other upstream code. Fetched the task's own fix. Replaced the repo with upstream. We found that 111 trials got content past the block, 44 from Grok 4.7 and 67 from the other 11 models. Grok 4.7's 44 were already re-run before it was listed, so we re-ran the other 67 with the same model, version, and settings on the hardened sandbox, then re-judged them with the same judge. Across those 67 re-runs there were 0 leaks and 2,815 refused escape attempts, including models asking a different model through our LLM route to fetch the PR, and pulling the next release of the repo they were fixing from npm. The updated leaderboard, in its current order. Each line is cheating trials, then pass@1 before → after, then rank change. * Claude Fable 5.1: 3, 69.3 → 69.3, ↑1 * Claude Fable 5: 3, 69.7 → 68.8, ↓1 * Grok 4.7: 44, 64.7, ↑1 * Gemini 3.8 Flash: 10, 65.6 → 64.2, ↓1 * Claude Opus 5: 2, 63.8 → 63.8 * Claude Opus 4.6: 3, 62.4 → 62.4, ↑2 * Muse Spark 1.3: 2, 62.8 → 62.4, ↓1 * Claude Opus 4.7: 3, 61.5 → 61.5, ↑1 * Claude Opus 4.8: 6, 62.4 → 61.5, ↓2 * Grok 4.6: 19, 59.2 → 60.6, ↑1 * GPT-6 Astra: 8, 59.2 → 58.3, ↓1 * GPT-5.6 Sol: 8, 57.8 → 57.8 Grok 4.6 is a funny one. It cheated in 19 trials and its score went up after the re-run 😂. In fact, Groks are really solid in their coding capabilities. Their exposed behavior may come from a preference towards always looking things up online and finding existing solutions so you are not reinventing the wheel all the time, which is really good real-life behavior, but doing so when you are prompted not to is another story. To conclude, the shifts are small, between −1.4 and +1.4 points, and a few neighbors swapped places. All results are updated at
显示更多
0
27
621
17
转发到社区
【PR】 こっそり買ったエチチおもちゃを 従姉に試してもらおうとする弟 クーポンコード:PYUA0918
0
3
2K
136
转发到社区
这期播客是 The Pragmatic Engineer 对 OpenAI Codex 团队负责人 Thibault(Tibo)的访谈,聊了 Codex 的诞生、技术决策、工程文化以及软件开发方式的变迁。 以下是核心要点: 个人经历与加入 OpenAI Thibault 是比利时人,学应用数学出身,先后做过制药供应链优化的创业公司,在 Google 做过加速移动网页的项目(后被砍掉,让他学到了要时刻审视项目真实影响力的教训),之后在 Google Maps 做评论,再转到 DeepMind。在 DeepMind 期间,他参与了一个内部聊天机器人的开发——本质上就是 ChatGPT,但比 ChatGPT 早了一年。内部传播很快,大家都在分享对话,但 DeepMind 不具备把它作为产品发布的机制,最终没能推出。 后来他得知 ChatGPT 只有大约 20 个人在维护,这让他既震惊又觉得很有吸引力——这意味着极高的个人影响力。于是他加入 OpenAI,进去就赶上了推理模型的冲刺,大约一个月后 o1 preview 就发布了。 为什么用 Rust 写 Codex 这是一个反直觉的决定——当时模型对 Rust 的支持并不好,业界其他 AI 编码工具基本都用 TypeScript 或 Python。但团队从第一性原理出发,认为智能体的核心需要健壮、安全、高效,而 Rust 的编译时验证特性天然适合智能体场景。同时用不同语言也强制建立了产品界面和智能体核心之间的清晰边界,避免代码耦合。事实证明 Rust 确实"很快就变得非常适合智能体开发"。 开源和模型无关的策略 Codex CLI、SDK 都是开源的,而且支持非 OpenAI 模型——这在主要 AI 实验室中是独一无二的。理由很实际:如果不开源,别人只需改十行代码就能 fork 出一个支持其他模型的版本,那还不如自己直接支持。开源的好处包括新员工入职前就已经熟悉代码库、社区贡献、以及逼迫自己靠模型和产品体验赢用户而非靠锁定。 代价也很明显:竞争对手会在你还没发布的时候就抄走你正在公开开发的功能,"确实有点刺痛";还有大量低质量 PR 需要处理。 工程文化与代码审查的变革 新员工入职后听到最多的一句话是"你问过 Codex 了吗?"——因为 Codex 在 OpenAI 内部接入了 Slack、文档、所有代码,几乎任何问题都能给出不错的回答。 代码审查正在发生质变。OpenAI 开发了专门的代码审查模型,能在逻辑推理和安全漏洞检测上达到"超人水平"——可以深入三四层依赖去发现文档错误导致的不变量违反。安全审查已经是强制自动化的,发现安全问题会直接阻止合并。一个 PR 可以当天提交、当天上线到十亿用户的 ChatGPT 上。 代码审查的角色正在从"正确性检查"转向"意图讨论"——你到底想做什么?这件事值不值得做?这种讨论不一定要围绕代码发生。 维护成本和重构的变化 维护一直是软件工程的"税",但现在大量维护工作(依赖升级、安全补丁)可以完全自动化。更重要的是,重新架构的成本也急剧下降——以前可能要花几个月甚至几年的重构,现在快得多。但好的架构设计反而更重要了:设计好"盒子"和不变量,盒子内部随便改都不影响其他部分。 Harness 与模型的关系 一个有趣的洞察:harness(工具/脚手架)总是"走在模型前面"。Codex 团队的工作本质上是为模型搭建拐杖——提醒它跑测试、保持目标一致等。然后下一代模型训练时会把这些能力内化,拐杖就可以去掉,developer message 也会越来越短。最新一代模型已经不再需要 /goal 命令来保持长期任务的专注,"你直接告诉模型去工作一周,它就真的会做到"。 Codex 与 ChatGPT 的合并 这是一个重大工程挑战:Codex 原本完全本地运行,ChatGPT 是托管云服务,两套完全不同的技术栈要统一。目标是让云端版本具备本地版本同样的能力,同时高效到能纳入 20 美元/月的 Plus 计划。ChatGPT Work 模式本质上是在云端虚拟机里运行完整的 Codex harness,机器配置强大到用户可以在里面训练模型、安装 Blender 做 3D 建模。 有趣的是,Codex 在整个合并过程中还充当了"记者"角色,因为它能访问所有 Slack 讨论和文档,记录了团队的辩论和决策过程。 Thibault 的个人用法与建议 他大量使用手机上的 ChatGPT Work,通过语音口述发送任务,定制了专属的技能和指令来生成他能高效消化的报告和幻灯片。任何问题——公众舆情、生产日志、功能使用率分析、团队动态——30 分钟内都能得到答案。周末他还会用 Codex 做代码探索和原型,"一天之内就能把脑子里的想法变成可以展示给人看的东西"。 对工程师的建议:保持深度好奇心,训练自己快速理解系统的能力("五个为什么"不断追问),以及与你服务的用户群体保持同步——如果你无法清晰表达意图,就很难做出好的工作。
显示更多