注册并分享邀请链接,可获得视频播放与邀请奖励。

与「GQ」相关的搜索结果

GQ 贴吧
一个关键词就是一个贴吧,路径全站唯一。
创建贴吧
用户
未找到
包含 GQ 的内容
Dillon Thieneman. First career INT 🚨 @PHIvsCHI on ESPN Stream on @NFLPlus
0
43
261
42
转发到社区
"8 called timeout!" The @Ravens gave Rio one of the great endings we've ever seen. @NFLBrasil @insidetheNFL Week 3 Mic'd Up on X
如果我们可以重新理解 Quant Developer。 这并不只是思想实验。 Jane Street 2026 年公开的研究方向包括机器学习、编程语言、编译器、ASIC、FPGA、分布式 shared log、incremental computation、查询优化、分布式存储和形式化验证,而Citadel GQS 则把实时数据、HFT 执行和低延迟 ML 推理放进了同一个 Quantitative Research Engineer 岗位。 再次强调,市场是一个高维、受驱动、耗散的非平衡系统。 订单持续进入、撤销、成交,信息、资本和风险不断注入,异质的参与者相互作用,系统几乎从未达到平衡。 当看到Jane Street 把 graph-structured、incremental computation 列为长期研究方向,我想这是一个值得认真理解的信号。 如果我们发现研究对象持续变化时,计算本身或许也需要围绕变化来组织。 一条报价更新,并不意味着整个市场都需要被重新计算。 它首先改变某些局部状态,再沿着依赖关系,影响相关资产的估值、组合的风险暴露,以及尚未成交的订单。 如果把这些计算关系展开,我们会看到数据连接特征,特征连接预测,预测连接决策,决策通过成交与持仓,反馈到下一轮计算。 这里必须区分两件事。 计算图中的依赖关系,不自动等于市场中的因果关系。但只要我们能够明确哪些结果依赖哪些输入,就有机会在新事件到来时,只更新受到影响的部分。 这正是 incremental computation 最吸引我的地方,它让计算资源跟随变化分配。困难的问题也随之浮现。哪些状态已经过期,筛选必须更新的传播,可以合并的计算。我们开始寻找,在并发和异步执行中,如何避免把不同时间的市场状态拼成一个从未真实存在过的世界? 于是,延迟就不再止于程序运行了多少微秒。判断抵达市场时,你应该着眼于支撑判断的那个市场是否仍然存在。 想想吧,一个离线表现出色的模型,如果依赖陈旧的数据、无法承受行情突发时的排队,或者不能及时更新风险状态,那么它在回测中发现的信息优势,可能在执行之前就已经消失。 因此,Quant Developer 的工作可以被理解为,他们需要在有限的时间、算力和通信预算内,维护一个足够及时、足够一致、能够用于行动的市场内部模型。 编译器、分布式系统、硬件加速和形式化验证,开始汇聚到同一个问题上。 编译器决定计算如何被表达和执行; 分布式系统决定不同节点如何组织事件与状态; 硬件决定数据移动和运算的成本;形式化方法则帮助我们检查,某些关键约束是否会在复杂的执行路径中被破坏。 这些工作共同决定一个数学上的预测,试图成为现实中的有效决策。 而非平衡系统的视角,提供了一组进一步追问的方向:外部事件,内部状态,反馈是抑制还是放大扰动,输入速度和处理能力的关系对于系统的影响。 当然,市场是耗散系统本身并不会自动产生 Alpha。我想,我们只有把这种直觉落实为可观测的变量、明确的机制和能够被数据推翻的预测,它才开始具有研究价值。 它确实改变了我们看待这个职业的方式。 Quant Developer 所构建的一直是一个嵌入市场之中的实时决策系统。 这个系统观察市场,也通过自己的行动改变市场:它必须在变化尚未结束时做出判断,在信息尚不完整时承担后果。
显示更多
这个开源项目系统整理了 35 家 AI 公司的 AI 工程师面试题,全部来自 “公开报告的面试经历” 来自 @outcome_school 团队 @pallavishekhar_ 开源发布,内容几乎涵盖了 OpenAI、Anthropic、DeepMind、xAI、DeepSeek、Kimi、GLM 等 AI Labs,Cursor、Cognition、ElevenLabs 等 AI Native 团队和 Nvidia、Microsoft、Amazon、Apple 等头部大厂。 覆盖的岗位头衔也非常多:AI Engineer、LLM Engineer、Gen AI Engineer、ML Engineer、Research Engineer、Applied Scientist、FDE、MLOps/LLMOps 工程师等。 开源地址: # 内容架构:一个精心设计的双层结构 第一层:跨公司通用题(Common Questions)。 作者把在多家公司反复出现的题目只列一次,标注"Asked at"哪些公司,按十大主题组织: 1. LLM 内部机制与架构 — attention 缩放因子、KV cache 内存公式推导、MQA/GQA/MLA、FlashAttention、BPE、RoPE/YaRN、Chinchilla scaling laws、MoE、解码采样策略、lost-in-the-middle、RMSNorm、SwiGLU 2. 推理、服务与 GPU 性能 — prefill vs decode、continuous batching、PagedAttention、投机解码、量化(FP16→FP4)、五种并行策略、TTFT/TPOT 指标、H100 上的 roofline 计算、vLLM/SGLang/TensorRT-LLM 选型、“如何把服务成本降 10 倍” 3. RAG 与检索 — 分块策略、BM25 vs 稠密检索、重排序器、HyDE、权限感知检索、ANN 索引、索引新鲜度、答案归因 4. Agent 与工具调用 — ReAct、MCP、工具 schema 设计、多智能体编排、Agent 记忆、循环终止条件、人类审批 5. 微调与对齐 — RLHF/DPO/GRPO/RLVR 全谱系、LoRA/QLoRA 数学、灾难性遗忘、“提示 vs RAG vs 微调”决策框架、蒸馏、reward hacking 6. 评估与可观测性 — LLM-as-judge 及其偏差、幻觉检测、基准污染、Agent 评估、回归门禁 7. 安全与负责任 AI — 提示注入(直接/间接)、OWASP LLM Top 10、护栏、Constitutional AI、红队 8. 多模态与语音 — VLM、语音 Agent 延迟预算、barge-in 打断处理、级联 vs 端到端语音、ASR/TTS 评估 9. AI 系统设计 — 十类高频设计题(千万级文档企业 RAG、代码助手、客服 Agent、Text-to-SQL、LLM 网关、数亿用户聊天服务等) 10. 编码题 — 从零实现 attention、KV cache、BPE、采样;LRU 缓存、令牌桶限流器、异步批处理器、SSE 流解析器、最小 Agent 循环 第二层:35 家公司的专属章节,分为五大梯队: 1. 前沿实验室(12 家):Anthropic、OpenAI、Google DeepMind、Meta、xAI、Mistral、Cohere、DeepSeek、月之暗面(Kimi)、智谱(GLM)、阿里(Qwen)、Sarvam AI(印度) 2. 大厂 AI 组织:Microsoft、Amazon、Apple、NVIDIA、Tesla,以及一组消费级 ML 公司(Uber/Netflix/LinkedIn/Airbnb/Pinterest/Spotify) 3. AI 基础设施公司:Databricks、Groq、Together AI、Hugging Face、Scale AI、Perplexity 4. AI 原生产品公司:Cursor、Cognition(Devin)、Sierra、Harvey(法律)、Glean、 AI(机器人)、Waymo 5. 前向部署/企业 AI:Palantir # 题目分布透露的行业信号同样值得关注 1. 公司的差异化考察方向,和它的商业模式严丝合缝。 这是最能体现整理功力的地方: · DeepSeek、月之暗面、智谱、Qwen 的题目深度绑定自家论文——MLA、auxiliary-loss-free 负载均衡、Multi-Token Prediction、MuonClip、DualPipe、长上下文扩展、GLM 的 thinking 模式。面试这些公司等于面试它们的论文,还要求 PyTorch 从零实现 MoE 路由。 · Groq 的题全是 SRAM-only 架构下的 roofline 重推演:“没有 HBM,decode 的 roofline 论证哪里变了”、“确定性在 p99 层面到底买到什么”。 · Apple 清一色端侧:3B 模型在手机上跑、PTQ vs QAT、不采集用户内容的前提下用设备信号改进模型、30+ 语言区无法记录用户内容的评估方案。 · CharacterAI 是推理经济学:“我们的服务成本被 KV cache 而非权重主导,降一个数量级,代价是什么”。 · Harvey(法律)和 Abridge(医疗) 考的是领域约束下的工程:200 页信贷协议里第 140 页的条款依赖第 8 页的定义术语怎么检索、生成的病历中出现了患者没提过的药怎么当作安全事故处理、PHI 如何约束整个架构。 · Palantir 的招牌是 "decomposition" 轮:把“一家货运铁路公司每年因机车非计划停机损失数千万”分解成工程计划。 2. 编码轮的形态正在发生实质性变化。 文档里反复出现的一类题,与传统 LeetCode 明显不同: · “实现一个内存 KV 存储:先 SET/GET/DELETE,再加事务 BEGIN/COMMIT/ROLLBACK,包括嵌套事务”(OpenAI、xAI 都问) · “给你一个 LLM 推理引擎的调度器类,其中一个方法是空壳,没有规格没有文档。说说你头三十分钟干什么”(xAI) “重构这 120 行能跑但很乱的代码,不许破坏测试”(OpenAI) · “对 5 万个文档跑 LLM 调用,API 限 100 并发、偶发 429 和超时,把 Python 写出来”(Anthropic) 考察重心从算法记忆转向增量需求下的代码演进能力、并发正确性、真实工程约束下的取舍。 3. “AI 协作轮”作为新题型已经进入正式面试流程。 这是文档里最前沿的信号: · Anthropic 部分机器学习岗有 AI-collaboration 轮:现场给你 Claude,考察的是你如何指挥它和验证它的产出,而不是你自己写。 · Meta 2026 年的流程新增三阶段 AI 辅助编码轮(探索修复 → 实现新功能 → 扩展改进)。 · Cursor 的 onsite 是两天在真实 Cursor 代码库上做一个功能(或 8 小时远程版),明确考核你对 AI 工具的使用效率和自主 scoping 能力。 · Sierra 给你两小时和任意 AI 工具,看你选择做什么。 xAI 有四小时限时产品构建。 4. FDE 成为一级岗位类别。 Anthropic、OpenAI、Databricks、Scale、Together、Sierra、Harvey、ElevenLabs、Palantir 的章节里都有 "Applied and Forward-Deployed Scenarios" 专属题库——典型题目如“企业客户说 Claude 幻觉太多,你是驻场工程师,头 48 小时做什么”。这对应了 AI 公司向企业交付方式的转变:模型能力差距收窄后,落地能力成为差异化。 5. 硬核系统题的普及。 "H100 上 70B 模型 batch size 1 的 roofline 计算"、"估算 70B 模型的 GPU 显存(权重 + KV cache + 激活 + 碎片)"、"p99 延迟在部署后翻倍但模型没变,走一遍诊断”——这类题横跨 NVIDIA、Together、OpenAI、Perplexity 等多家,说明推理性能的量化直觉已成为 AI 工程师的通用素养,而非基础设施工程师的专属。
显示更多
终于解决了gpt-6-astra降智问题 感谢群友! 感谢开源!
Google Pics integrations are rolling out now with Docs & Slides, and coming soon to Drive. Lean more ↓