🎯 AI应用开发 / Agent方向 面试题库 · 按频次与考察价值排序
4148 words
21 minutes
🎯 AI应用开发 / Agent方向 面试题库 · 按频次与考察价值排序
🎯 AI应用开发 / Agent方向 面试题库 · 按频次与考察价值排序
📅 生成日期:2026-06-12
📚 数据来源:工作区 63 份面经文档(含真实面试复盘、技术整理、复习笔记)
📊 统计口径:真实面试中出现频次 + 面试深度(是否可作为追问起点)+ 岗位区分度
📖 使用说明
- 频次星级:⭐=出现过1-2次 ⭐⭐=3-5次 ⭐⭐⭐=5-10次 ⭐⭐⭐⭐=10+次 ⭐⭐⭐⭐⭐=几乎每场必问
- 考察价值:分为 A/B/C/D 四级,A 为最高价值(深挖题+区分度大),D 为基础送分题
- 掌握要求:⭐
⭐⭐ 建议能讲出概念;⭐⭐⭐⭐⭐⭐⭐⭐ 必须能完整展开 + 结合项目
一、🔥 核心梯队(考察价值 A 级 · 必问深水区)
【A+ 级 · 几乎每场必问,且能深挖3层以上】
| 排名 | 题目 | 频次 | 考察价值 | 出现公司 | 说明 |
|---|---|---|---|---|---|
| 1 | Agent 的四大核心组件是什么?分别做什么? | ⭐⭐⭐⭐⭐ | A+ | 字节/阿里/腾讯/滴滴/美团 | 面试起手式,追问可延伸到每个组件的实现细节 |
| 2 | ReAct / Tool Use / Plan-and-Execute / Multi-Agent 四种范式对比?是线性进化关系吗? | ⭐⭐⭐⭐⭐ | A+ | 字节/阿里/腾讯/滴滴/多家中小厂 | 高区分度题,面试官考的是”层次关系”认知 |
| 3 | Agent 的短期/长期记忆怎么设计?写入和检索的策略是什么? | ⭐⭐⭐⭐⭐ | A+ | 字节/阿里/腾讯/滴滴 | 面试官必深挖:写入时机、检索策略、遗忘机制 |
| 4 | RAG 的完整链路是什么?每个环节的关键优化点? | ⭐⭐⭐⭐⭐ | A+ | 字节/阿里/腾讯/滴滴/美团 | 不仅是流程,追问:chunking 策略、检索优化、rerank |
| 5 | 怎么减少 Agent 的幻觉?请从多个层面说明。 | ⭐⭐⭐⭐⭐ | A+ | 字节/阿里/腾讯/滴滴 | 经典多层防御体系题,好回答能体现工程深度 |
| 6 | 会话压缩/上下文管理怎么做?什么时候触发? | ⭐⭐⭐⭐ | A+ | 阿里淘天/字节/JR公司 | 阿里淘天高频追问,“为什么这么设计”是关键 |
| 7 | MCP 协议是什么?它的工作原理是怎样的? | ⭐⭐⭐⭐ | A+ | 滴滴/秋招高频/多家中小厂 | 2026 新热点,滴滴直接考了 15 道 MCP 相关题 |
【A 级 · 高频必问,决定面试深度】
| 排名 | 题目 | 频次 | 考察价值 | 出现公司 | 说明 |
|---|---|---|---|---|---|
| 8 | 什么是 Agent?它与普通 LLM 应用的本质区别? | ⭐⭐⭐⭐⭐ | A | 字节/阿里/腾讯/滴滴/美团/中小厂 | 概念题但决定面试第一印象,必须能用公式表述 |
| 9 | 请介绍你做过的一个 Agent 项目(完整叙事) | ⭐⭐⭐⭐⭐ | A | 所有公司 | 决定性题目,用”痛点→方案→踩坑→收益”结构 |
| 10 | Prompt 是怎么构建和优化的?结构化 Prompt 原则? | ⭐⭐⭐⭐ | A | 字节/阿里/腾讯/多家中小厂 | 不能只说”写了 prompt”,要讲模块化/版本管理 |
| 11 | Multi-Agent 架构什么时候需要?通信模式有哪些? | ⭐⭐⭐⭐ | A | ML公司/秋招高频/中小厂 | 追问:每个 Agent 能不能访问对方记忆? |
| 12 | MCP 和 Function Calling 有什么区别和联系? | ⭐⭐⭐⭐ | A | 滴滴/秋招高频/中小厂 | 2026 新趋势,理解”标准化 vs 私有协议” |
| 13 | MCP 和 Skill 机制的区别是什么? | ⭐⭐⭐⭐ | A | 滴滴/阿里淘天 | 高频混淆点,注意粒度差异 |
| 14 | Tool Calling 的完整链路是怎样的? | ⭐⭐⭐⭐ | A | 字节/腾讯/秋招高频 | 注册→筛选→决策→校验→执行→回传,讲全流程 |
| 15 | Agent 的评测体系怎么设计?评估哪些维度? | ⭐⭐⭐ | A | 字节/阿里/JR公司/HQ公司 | 四层评测体系是杀手锏,体现工程闭环思维 |
| 16 | 上下文压缩质量不行/LLM能力不够怎么办? | ⭐⭐⭐ | A | JR公司 | 追问深水区,考察兜底策略 |
| 17 | RAG 和微调(Fine-tuning)的适用场景区别? | ⭐⭐⭐ | A | 腾讯/秋招高频/多家 | 经典对比题,重点说清楚”什么时候不应该上RAG” |
| 18 | OpenClaw 的 Compaction 策略的核心流程? | ⭐⭐⭐ | A | 阿里/字节/多家 | 4步流程:分块→逐块摘要→合并摘要→摘要增强 |
| 19 | Context Window 里到底塞了哪些内容?为什么容易爆? | ⭐⭐⭐ | A | 字节/阿里/腾讯 | System Prompt + 工具定义 + 对话历史三层拆解 |
| 20 | System Prompt 在 Agent 系统中承载了哪些职责?越来越长怎么处理? | ⭐⭐⭐ | A | 字节/阿里/大中型公司 | 职责划分 + 模块化管理策略 |
二、📦 核心模块(考察价值 B+ ~ B 级 · 分类必答)
【Agent 架构与设计 · 7题】
| 排名 | 题目 | 频次 | 考察价值 | 说明 |
|---|---|---|---|---|
| 21 | 为什么需要 Agent?为什么不直接用 Workflow? | ⭐⭐⭐⭐ | B+ | 校招生高频追问,考察”动态决策”的理解 |
| 22 | Agent 的四大范式技术选型优先级怎么排? | ⭐⭐⭐⭐ | B+ | 复杂度→延迟→可观测性三部曲 |
| 23 | 主 Agent 与子 Agent 如何通信?能否访问对方 Memory? | ⭐⭐⭐ | B+ | 一般不能直接访问,通过消息传递 |
| 24 | agent.md / memory.md / skills.md 的职责区分是什么? | ⭐⭐⭐ | B+ | 阿里淘天高频考察,体现架构能力 |
| 25 | 工具和 Skill 位置互换会有什么后果? | ⭐⭐⭐ | B+ | 阿里淘天专属深水区题,考察架构权衡理解 |
| 26 | Multi-Agent 有哪几种通信模式? | ⭐⭐⭐ | B+ | Orchestrator / Peer-to-Peer / Hierarchical |
| 27 | 一个 Agent 系统有哪些关键模块?请画出架构图 | ⭐⭐⭐ | B+ | 字节/阿里考察开放设计能力 |
【RAG 检索增强 · 6题】
| 排名 | 题目 | 频次 | 考察价值 | 说明 |
|---|---|---|---|---|
| 28 | RAG 的 chunking 策略有哪些?怎么选? | ⭐⭐⭐⭐ | B+ | 固定大小/语义分块/递归分块,用评估集对比 |
| 29 | RAG 检索优化有哪些手段? | ⭐⭐⭐⭐ | B+ | 多路召回/查询改写/重排序/上下文压缩/反馈循环 |
| 30 | RAG 常见失败原因有哪些? | ⭐⭐⭐ | B+ | 召回不足/相关性低/上下文干扰/问题表述不规范 |
| 31 | 怎么确认 RAG 召回数据的准确性? | ⭐⭐⭐ | B+ | JR公司/政策文件场景高频考察 |
| 32 | RAG 评估方案有哪些? | ⭐⭐⭐⭐ | B+ | 离线benchmark/在线评估/LLM-as-Judge |
| 33 | Embedding 模型怎么选?需要考虑哪些因素? | ⭐⭐⭐ | B | 维度/成本/语言支持/领域适配 |
【MCP 协议与工具 · 5题】
| 排名 | 题目 | 频次 | 考察价值 | 说明 |
|---|---|---|---|---|
| 34 | MCP 的通信协议有哪些?有什么区别? | ⭐⭐⭐ | B+ | STDIO / SSE / 未来WebSocket |
| 35 | MCP 怎么处理并发调用? | ⭐⭐⭐ | B+ | 滴滴高频 |
| 36 | MCP 给你最大的感受是什么?解决了什么问题? | ⭐⭐⭐ | B+ | 标准化/动态发现/Server级隔离 |
| 37 | A2A 协议和 SSE 协议了解吗? | ⭐⭐⭐ | B | Google A2A vs SSE 各自场景 |
| 38 | 你还知道哪些工具协议,除了 MCP? | ⭐⭐⭐ | B | 滴滴常问,Function Calling / A2A / OpenAPI |
【工程实践与可靠性 · 8题】
| 排名 | 题目 | 频次 | 考察价值 | 说明 |
|---|---|---|---|---|
| 39 | API 超时和报错怎么排查解决? | ⭐⭐⭐⭐ | B+ | 字节高频,三层策略:重试→降级→上报 |
| 40 | Token 消耗过快怎么排查和优化? | ⭐⭐⭐⭐ | B+ | 上下文压缩/缓存/批处理/模型选择 |
| 41 | Agent 优化后有什么可量化的效果? | ⭐⭐⭐⭐ | B+ | 小厂/中厂高频,准确率/响应速度/Token成本 |
| 42 | Agent 任务恢复/断点续跑怎么做的? | ⭐⭐⭐ | B+ | 状态快照 + 上下文恢复 + 重新初始化 |
| 43 | Agent 的鲁棒性设计有哪些要点? | ⭐⭐⭐ | B+ | 输入校验→意图识别→敏感词过滤→错误兜底 |
| 44 | 怎么节约 AI 成本?做了哪些优化? | ⭐⭐⭐ | B+ | 高频追问,模型缓存/上下文压缩/批处理 |
| 45 | Harness 是什么?在你的项目里怎么体现? | ⭐⭐ | B | 字节考察,四层评测体系 |
| 46 | 用户发一条指令后,系统完整处理流程是怎样的? | ⭐⭐⭐ | B | 解析→上下文组装→LLM规划→工具调用→反馈 |
【LLM 基础 · 8题】
| 排名 | 题目 | 频次 | 考察价值 | 说明 |
|---|---|---|---|---|
| 47 | Transformer 的基本结构是什么? | ⭐⭐⭐⭐ | B | 算法岗必问,应用岗也要知道流程 |
| 48 | Self-Attention 的计算流程?为什么除以 √d_k? | ⭐⭐⭐⭐ | B | 高频基础题 |
| 49 | KV Cache 是什么?为什么只缓存 K 和 V 不缓存 Q? | ⭐⭐⭐⭐ | B | 超高频,推理优化核心 |
| 50 | MHA / MQA / GQA 的区别? | ⭐⭐⭐ | B | LLaMA-2/3 选 GQA 的理由 |
| 51 | RoPE 旋转位置编码是什么?为什么主流都用它? | ⭐⭐⭐ | B | 统一绝对+相对位置编码 |
| 52 | 大模型训练流程是什么?(预训练→SFT→RLHF/DPO) | ⭐⭐⭐ | B | 三步走,RLHF 和 DPO 对比 |
| 53 | LoRA 的原理是什么? | ⭐⭐⭐ | B | 低秩补丁,训练 0.1% 参数 |
| 54 | 大模型的幻觉根本原因是什么? | ⭐⭐⭐ | B | 概率语言模型不是知识库 |
三、🏢 各厂特色高频题(考察价值 B ~ C 级)
【字节跳动 · 特色题】
| 题目 | 频次 | 说明 |
|---|---|---|
| 为什么要自己搞 code agent?挑战是什么? | ⭐⭐⭐⭐ | 项目动机 + 技术深度 |
| Claude Code 源码泄漏有关注吗?有什么看法? | ⭐⭐⭐ | 考察技术视野 |
| 同一个模型不同 context 长度下表现差异? | ⭐⭐⭐ | 上下文工程实践 |
| pico 项目里有什么工具? | ⭐⭐⭐ | 项目真实性验证 |
| 有没有用过 Claude Code 的 /btw 功能? | ⭐⭐ | 考察产品使用深度 |
| 整个项目中 AI coding 的占比? | ⭐⭐⭐ | 面试官判断你的角色定位 |
| 什么是好的 code agent 应具备的特质? | ⭐⭐ | 开放题,体现认知高度 |
【阿里淘天 · 特色题】
| 题目 | 频次 | 说明 |
|---|---|---|
| 会话压缩怎么做的?长期记忆写入时机? | ⭐⭐⭐⭐ | 必问深水区 |
| 上下文结构怎么组织的?长度约束策略? | ⭐⭐⭐⭐ | Prompt工程+Token控制 |
| agent.md vs memory.md vs skills.md 职责区分? | ⭐⭐⭐⭐ | 架构理解 |
| 工具和 skill 位置交换的后果? | ⭐⭐⭐ | 架构权衡 |
| 怎么看 AI?平时怎么用 AI 工具? | ⭐⭐⭐ | 综合考察 |
| 如果要从 Skill 升级为 AI Agent,关键设计点? | ⭐⭐⭐ | 架构演进能力 |
| Agent 输出不稳定,优先排查哪些方面? | ⭐⭐ | 工程排查思路 |
| OpenClaw 核心解决什么问题?边界和局限在哪? | ⭐⭐⭐ | 技术视野 |
【腾讯 · 特色题】
| 题目 | 频次 | 说明 |
|---|---|---|
| 什么是 Agent / RAG / Prompt Engineering?(一面概念题) | ⭐⭐⭐⭐ | 一轮概念,二轮系统设计 |
| Planner 怎么设计?(二面系统设计) | ⭐⭐⭐ | 考察深度思考 |
| 上下文优先级怎么排?(二面) | ⭐⭐⭐ | 设计权衡 |
| 可审计 Agent 怎么设计?(二面) | ⭐⭐ | 审计目标:能追责/能定因/能复现 |
| ”为什么不这么做”层面的追问 | ⭐⭐⭐⭐ | 腾讯特色深度追问 |
【滴滴 · 特色题】
| 题目 | 频次 | 说明 |
|---|---|---|
| MCP 怎么运作的?有哪些协议?区别? | ⭐⭐⭐⭐ | MCP深度系列 |
| MCP 怎么处理并发调用? | ⭐⭐⭐ | 技术深度 |
| MCP 和 Skill 区别? | ⭐⭐⭐⭐ | 高频混淆点 |
| 你对 AI coding tools 了解多少? | ⭐⭐⭐ | 技术视野 |
| 智能体三要素是什么? | ⭐⭐⭐ | Agent基础 |
| 两个机器人对话怎么实现? | ⭐⭐ | 多Agent通信 |
【通用 · 高频追问型题目】
| 题目 | 频次 | 说明 |
|---|---|---|
| 这个设计你是怎么考虑的?有没有考虑过其他方案? | ⭐⭐⭐⭐⭐ | 面试官最爱追问,考察技术选型能力 |
| 遇到过什么问题?怎么解决的? | ⭐⭐⭐⭐⭐ | 区分”做过”和”看过”的关键题 |
| 如果 XX 情况发生,系统会怎么样? | ⭐⭐⭐⭐ | 边界情况思考能力 |
| 有量化的效果吗? | ⭐⭐⭐⭐⭐ | 必须要有指标,不能用”感觉”回答 |
| 为什么这么设计?Trade-off 是什么? | ⭐⭐⭐⭐⭐ | 架构权衡能力 |
| 做这个项目之前有没有看过成熟方案?差在哪? | ⭐⭐⭐⭐ | 技术视野+判断力 |
| 系统为什么不会失控? | ⭐⭐⭐⭐ | 稳定性设计理解 |
| 上下文和 memory 到底怎么管? | ⭐⭐⭐⭐ | Agent核心深水区 |
四、📋 项目面试话术题(考察价值 A 级 · 决定Offer的关键)
| 排名 | 题目 | 频次 | 考察价值 | 说明 |
|---|---|---|---|---|
| 55 | 请用”业务痛点→初版方案→踩坑迭代→量化收益”介绍项目 | ⭐⭐⭐⭐⭐ | A+ | 决定面试走向的题,公式化准备 |
| 56 | 你这个项目到底在解决什么问题? | ⭐⭐⭐⭐⭐ | A+ | 区分”toy project”和”真实工程”的关键 |
| 57 | 为什么这里要做成 Agent?不是直接用现成方案? | ⭐⭐⭐⭐ | A | 校招生最怕的追问,答案要有深度 |
| 58 | 自己做 Code Agent 的动机?和 Claude Code 比差异? | ⭐⭐⭐ | A | 字节高频 |
| 59 | 你怎么看待 AI 编程?如何把握自己的能力和边界? | ⭐⭐⭐ | A | 滴滴/多家中小厂常问 |
| 60 | AI 工具出现后,对传统研发工作流造成了什么冲击? | ⭐⭐⭐ | A | 考察深度思考 |
| 61 | 你知道这个方向上已经有什么成熟方案吗?差在哪? | ⭐⭐⭐ | A | 技术敏感度+判断力 |
五、🛠 算法/CS基础(考察价值 C 级 · 但不过不行)
【手撕代码 · 高频题】
| 排名 | 题目 | 频次 | 考察价值 | 说明 |
|---|---|---|---|---|
| 62 | 单例模式(双检锁+volatile) | ⭐⭐⭐⭐ | C+ | 手写级,字节/阿里/滴滴都考过 |
| 63 | 合并两个有序数组 | ⭐⭐⭐ | C | 字节考过,一秒写完被追问是否刷过 |
| 64 | 字符串相加 | ⭐⭐ | C | 滴滴考过 |
| 65 | 手写一个死锁 | ⭐⭐ | C | 字节考过,候选人没写出来 |
| 66 | Todo Agent 实现(AI Coding 环节) | ⭐⭐ | C+ | 小厂AI Coding环节 |
【Java/语言基础 · 高频八股】
| 排名 | 题目 | 频次 | 考察价值 | 说明 |
|---|---|---|---|---|
| 67 | 线程池核心参数,怎么设计一个合适的线程池? | ⭐⭐⭐ | C+ | 不能只会背,要能设计 |
| 68 | HashMap 底层结构,冲突怎么处理? | ⭐⭐⭐ | C+ | 红黑树转阈值8,扩容机制 |
| 69 | JVM 类加载机制(三大步骤) | ⭐⭐⭐ | C+ | 字节高频 |
| 70 | MySQL undo log / redo log / binlog + 两阶段提交 | ⭐⭐⭐ | C+ | 字节经典组合考法 |
| 71 | 并发:synchronized / ReentrantLock / CAS / AQS | ⭐⭐⭐ | C+ | 字节/阿里 |
| 72 | HTTP 1.0 / 2.0 / 3.0 区别 | ⭐⭐ | C | 滴滴常问 |
| 73 | Python 多进程/多线程/协程区别 | ⭐⭐ | C | 滴滴 |
| 74 | SSE 和 WebSocket 区别 | ⭐⭐⭐ | C+ | FN/HQ公司高频 |
【算法/ML 基础(非训练岗也要知道)】
| 排名 | 题目 | 频次 | 考察价值 | 说明 |
|---|---|---|---|---|
| 75 | 注意力机制(QKV) | ⭐⭐⭐⭐ | C+ | 应用岗也要掌握基础 |
| 76 | 位置编码(绝对/相对/RoPE) | ⭐⭐⭐ | C | 理解RoPE为什么是主流 |
| 77 | 过拟合/梯度消失 | ⭐⭐ | C | 基础概念 |
| 78 | 数据并行/模型并行 | ⭐⭐ | C | Agent实习面经常见 |
六、💡 面试准备策略建议
按公司准备优先级
| 公司 | 重点准备方向 | 独特考点 |
|---|---|---|
| 字节跳动 | Agent 项目深度 + 上下文工程 + 幻觉防御 + Memory | Code Agent 深度+C++/Java基础 |
| 阿里淘天 | Agent 四组件 + 会话压缩 + Memory设计 + Skill机制 | Java基础+架构权衡题 |
| 腾讯 | 一面概念二面系统设计,两个层次都要准备 | ”为什么不这么做”追问 |
| 滴滴 | MCP深度 + AI Coding Tools + 前后端基础 | MCP系列15题必过 |
| 中小厂 | Agent 项目完整叙事 + RAG全流程 + Token优化 | 更关注落地效果量化 |
按面试阶段准备
| 阶段 | 重点内容 | 典型题目 |
|---|---|---|
| 一面·项目深挖 | Agent 项目+核心八股 | 项目介绍/Agent四组件/RAG流程/Memory设计 |
| 二面·系统设计 | 架构设计+工程化+评测 | Planner设计/评测体系/异常处理 |
| 三面·综合/交叉 | 技术视野+架构权衡+学习能力 | OpenClaw理解/AI工具生态/Trade-off分析 |
| HR面 | 职业规划/团队协作 | 3-5年规划/怎么学习新知识 |
🏆 必练 20 道杀手锏题(按 A+ 优先级)
- Agent 四组件 + 四种范式对比(非进化关系)
- 项目介绍:痛点→方案→踩坑→收益 四步公式
- RAG 完整链路 + chunking策略 + 优化六大手段
- 幻觉多层防御体系(5层)
- 短期/长期记忆设计(写入时机+检索+遗忘)
- 会话压缩/上下文管理(触发时机+压缩方法)
- 评测四层体系(保底→Benchmark→记录→回归)
- MCP 协议原理 + vs Function Calling + vs Skill
- Tool Calling 完整链路(注册→筛选→决策→校验→执行→回传)
- Multi-Agent 通信模式 + 适用场景
- 上下文压缩 LLM 能力不够怎么办(兜底策略)
- RAG vs 微调对比 + 什么时候不该上 RAG
- OpenClaw Compaction 4步流程
- 工具设计原则(粒度/Schema/装载/并发)
- Transformer 核心 + KV Cache + RoPE
- MHA / MQA / GQA 区别 + 选型依据
- 异常处理三层策略(重试→降级→上报)
- Token 优化七种手段
- Agent 四大范式技术选型三看(复杂度/延迟/可观测性)
- 项目边界追问准备(失控/设计取舍/量化效果)
🎯 一句话总结:面试官不是在考你会不会背,而是在看你出问题了能不能定位、系统异常能不能兜住、方案落地能不能让它稳定跑起来。
Share Article
If this article helped you, please share it with others!
🎯 AI应用开发 / Agent方向 面试题库 · 按频次与考察价值排序
https://estars-blog.pages.dev/posts/精华-面试题库_按频次与价值排序/ Related Posts Smart
1
🎯 岗位技能要求 · 频次与价值排序分析
求职作战室 第一梯队(必备核心)│████████████████████████████░░│ LLM调用 + Agent + Python + RAG + LangChain
2
🧭 AI应用开发高频技能 · 学习路线指南
求职作战室 - 🔵 第一梯队(技能1-5):必须精通,是面试硬门槛,建议按顺序逐个攻克
3
🚀 速通 · Python 高频面试题
求职作战室 不是让你精通Python所有细节,而是能回答面试中最常考的20个问题,同时展示出你写的是「工程代码」而不是「脚本代码」。
4
🚀 速通 · Java 高频面试题
求职作战室 能回答Java基础核心问题,尤其是面向对象、集合框架、JVM基础。
5
🚀 速通 · 计算机基础高频面试题
求职作战室 能回答计算机网络、操作系统、数据结构与算法、数据库的常见面试题。
Random Posts Random