
💡 核心要点 (Key Takeaways)
- DoorDash MLE 不能只讲推荐模型,要把地理位置、营业状态、ETA 和配送容量讲进去。
- 推荐系统要分 retrieval、ranking、reranking、feature store、serving 和反馈闭环。
- 实验指标要同时看用户、商家、配送员和平台侧 guardrail。
免费获取轮次诊断正在备战 DoorDash MLE 面试?免费获取 DoorDash MLE 轮次诊断:发你的当前轮次与倒计时,我们先定位卡点,再决定下一步。
DoorDash 推荐题的业务约束
餐厅推荐不同于普通内容推荐。候选人必须考虑距离、营业状态、库存、配送 ETA、store capacity、用户偏好、促销、冷启动和区域供需。只说 two-tower + ranker 会显得离业务太远。
系统链路怎么拆
建议按 candidate generation、retrieval、ranking、reranking、business rules、serving、logging、training loop 来回答。每一层都要说明输入、输出、延迟和失败路径。
- Retrieval:地理半径、 cuisine、历史订单、相似用户、热门店。
- Ranking:CTR、conversion、ETA、质量、价格、配送费、容量。
- Feature:实时 ETA、距离、营业状态、用户画像、store quality。
- Serving:cache、fallback、feature freshness、latency budget。
ETA 特征怎么讲清楚
ETA 不是一个静态字段。它依赖准备时间、距离、交通、司机供给、订单堆积、天气和时段。MLE 候选人要说明 ETA 特征如何生成、多久更新、线上缺失时如何 fallback,以及错误 ETA 会如何影响排序和用户体验。
实验指标和 Guardrail
推荐实验不能只看点击率。Primary metric 可以是下单转化或用户满意度,但 guardrail 要覆盖取消率、ETA 误差、商家分布、配送员等待时间、投诉和长期留存。
💡 DoorDash 的完整准备路线:OA / Phone / VO 各轮考什么、怎么练,公司攻略页整理成了清单。
DoorDash 面试全攻略 →合成复盘:从模型回答改成系统回答
候选人常见问题是先讲 embedding 和 loss,再被追问“商家爆单怎么办”“ETA 变差怎么办”。训练后应先建立业务约束,再讲模型如何服务约束,这样回答更适合 DoorDash MLE 场景。
冷启动怎么答
冷启动是 DoorDash 推荐轮的高频追问,要分三种情况分别回答,不要混在一起讲。新店冷启动:没有订单历史,协同信号不可用,此时主信号是店铺属性(菜系、价格带、评分、菜单完整度)加区域热度基线,用 content-based 模型或区域热门兜底,目标不是精准而是不漏掉,等它积累到最低订单量后再逐步把权重移向协同信号。新用户冷启动:没有偏好历史,先靠位置、时段、天气这类上下文信号做粗排,再用前几单快速更新画像,并明确说明画像更新的速度和置信度如何控制。新区域冷启动:供给本身稀疏,候选集小,此时要主动说会放宽距离约束、优先保证基础供给覆盖,而不是追求排序精度。回答的关键是每一段都讲清「这个阶段用什么信号、什么条件触发切换到下一阶段」。练习方法:把三种冷启动各画一条切换路径——初始信号、触发条件、目标信号,练到 2 分钟内讲完。
离线评估和线上线下一致性怎么讲
模型讲完之后,面试官的下一问通常是「你怎么评估它」。回答分两层。离线层:推荐模型用分用户分组的 GAUC 比整体 AUC 更有说服力,因为用户间偏好差异大,整体指标会掩盖分组差异;同时必须说明时间切分方式——用较早数据训练、较晚数据评估,防止标签泄漏;排序质量可以补 top-k hit rate 和 NDCG,更贴近线上展示位。线上线下一致性层是 MLE 候选人最容易露怯的地方:离线提升不落到线上,常见原因要能主动列出——实时特征在线分布和训练分布不一致、标签回流延迟导致训练样本不完整、线上日志来自旧策略存在选择偏差。讲完原因再给监控方案:线上特征分布对比、打分分布监控、A/B 结果分层看。练习方法:挑自己一个项目书面回答三个问题——用了哪个离线指标、怎么切分数据、线上离线差距多大以及怎么解释。答不上来的,优先补这块。
面试现场怎么展开:45 分钟节奏分配
推荐轮一般是 45 分钟,稳定的结构是:前 5 分钟澄清——优化目标是什么(点击率、下单转化、留存还是长期目标)、已有哪些数据和信号、当前 baseline 方案长什么样,这三个问题决定回答的天花板;接下来 10 分钟讲数据和特征——特征来源(用户侧、物品侧、上下文侧)、在线离线怎么算、实时特征从哪来;中间 15 分钟讲模型——先给召回加排序的两段式结构,再挑一个排序模型深入(特征交叉、负采样、多目标权重),冷启动的答案就嵌在召回环节里;再 10 分钟评估——离线指标、A/B 设计(看哪个指标、跑多久、怎么分层读结果)、线上线下一致性;最后 5 分钟讲取舍——延迟预算、资源成本、必须牺牲时先砍什么。三个高频减分点:不澄清目标直接上模型架构;全程没提冷启动;只谈 AUC 说不出线上看哪个指标。练习方法:把完整 45 分钟答案在白纸上走一遍,每段计时,标出哪段超时。
📋 资料来源与审校说明
首次发布,提供面试准备方法、题型拆解和复盘建议。 2026-08-21:新增「冷启动怎么答」「离线评估和线上线下一致性怎么讲」「面试现场怎么展开:45 分钟节奏分配」三个 section,补充可执行备考方法。
- 公开面经信号和岗位能力模型:用于归纳题型和常见追问,不复刻候选人私人信息。
- Interview Support Pro 模拟面试复盘:用于总结候选人在表达、项目深挖和 follow-up 中的高频卡点。
💼 完整服务与价格我们提供 OA 代写($199 起)、VO 辅助($299 起)、VO 代面($499 起) 与 30 分钟免费咨询:按目标岗位、公司与轮次匹配具备相关经验的导师,覆盖 Coding、System Design、ML Design 与 BQ;具体导师与背景以接单前书面确认为准。
