大模型Agent 面试高频100题
之前发了很多RAG面经发出后,后台直接被“催更”淹没了。很多人说:“Agent的题能不能也来一个全集?”、“面试官一问到多智能体协作我就卡壳”、“ReAct和Function Calling到底怎么区分?”
安排。
我花了整整一周,把近半年各大厂Agent方向的面经题全部扒了一遍,去重、归类、分层,提炼出这100道高频题。
这篇文章有点长,但我保证——你花40分钟看完,面试Agent岗至少多拿30分。
第一部分:基础篇(1-40题)
模块一:Agent基础概念(1-12题) 🔥
【⭐】什么是Agent?和大语言模型有什么区别?
【⭐】Agent的核心组件有哪些?
【⭐】ReAct模式是什么?和CoT有什么区别?
【⭐】Plan-and-Solve模式是什么?比ReAct好在哪里?
【⭐】什么是工具调用(Tool Calling)?大模型怎么知道该调用哪个工具?
【⭐】Function Calling和Tool Calling是一回事吗?
【⭐】Agent如何管理多个工具?工具冲突怎么处理?
【⭐】Agent的“幻觉”问题怎么缓解?
【⭐】什么是Embedding?在Agent里有什么用?
【⭐】Agent的输入输出格式一般怎么设计?
【⭐】多轮对话中如何保持上下文不超限?
【⭐】什么是System Prompt?设计原则有哪些?
模块二:记忆系统(13-24题) 🔥
【⭐】Agent的记忆分为哪几类?
【⭐⭐】向量数据库在Agent里怎么用?选型标准是什么?
【⭐⭐】长期记忆怎么存储和检索?
【⭐】记忆怎么压缩?压缩会丢失信息吗?
【⭐⭐】Agent如何记住用户的个性化偏好?
【⭐⭐】多个Agent之间怎么共享记忆?
【⭐】记忆的时效性怎么处理?
【⭐】什么是Episodic Memory?和Semantic Memory有什么区别?
【⭐⭐】记忆和上下文怎么融合?
【⭐】Agent需要“遗忘”机制吗?怎么实现?
【⭐】向量检索的Top-K怎么选?
【⭐】BM25和向量检索有什么区别?什么时候用BM25?
模块三:规划与执行(25-40题)
【⭐⭐】任务分解(Task Decomposition)有哪些方法?
【⭐⭐】Agent执行过程中遇到错误怎么办?
【⭐】什么是Self-Consistency?怎么用在Agent里?
【⭐⭐】Agent如何知道自己“做完”了?
【⭐】什么是多Agent系统?和单Agent比有什么优势?
【⭐⭐】多Agent的通信方式有哪些?
【⭐⭐】怎么防止Agent陷入死循环?
【⭐】什么是Chain-of-Thought?提示词怎么写?
【⭐⭐】Tree-of-Thoughts比CoT好在哪里?
【⭐】Agent的规划频率怎么设置?
【⭐⭐】什么是GraphRAG的规划能力?
【⭐】Agent怎么处理用户的中途打断?
【⭐⭐】什么是“Chain of Density”?用在什么场景?
【⭐】Agent的能力边界怎么定义?
【⭐⭐】什么是“反思”(Reflection)机制?
【⭐】Agent的Prompt和普通LLM Prompt有什么区别?
第二部分:进阶篇(41-80题)
模块四:工具系统设计(41-55题)
41. 【⭐⭐】MCP(Model Context Protocol)是什么?和Function Calling什么关系?
42. 【⭐⭐⭐】Tool Calling的底层原理是什么?大模型怎么输出JSON?
43. 【⭐⭐】多个工具的参数冲突了怎么办?
44. 【⭐⭐】工具调用超时了怎么处理?
45. 【⭐⭐】工具调用的结果太长超出上下文怎么办?
46. 【⭐⭐】怎么评估一个工具是否“好用”?
47. 【⭐⭐】工具可以调用另一个工具吗?怎么实现?
48. 【⭐⭐】什么情况下应该把多个工具合并成一个?
49. 【⭐⭐】工具的描述怎么写效果最好?
50. 【⭐⭐】工具调用的并行执行怎么实现?
51. 【⭐⭐⭐】工具的版本管理怎么做?
52. 【⭐⭐】用户自定义工具需要支持吗?怎么实现?
53. 【⭐⭐】工具调用的安全边界怎么控制?
54. 【⭐⭐】什么是“沙箱执行”?怎么实现工具隔离?
55. 【⭐⭐】工具调用的Token消耗怎么优化?
模块五:多Agent协作(56-70题)
56. 【⭐⭐】AutoGen、CrewAI、MetaGPT这些框架有什么区别?
57. 【⭐⭐】多Agent的协调机制有哪些?
58. 【⭐⭐】什么是“主从模式”和“对等模式”?怎么选?
59. 【⭐⭐】多个Agent意见不一致怎么办?
60. 【⭐⭐】多Agent怎么避免“互相复读”?
61. 【⭐⭐】Agent之间的任务委托怎么实现?
62. 【⭐⭐】什么场景下适合用多Agent而不是单Agent?
63. 【⭐⭐⭐】多Agent系统的性能瓶颈在哪里?怎么优化?
64. 【⭐⭐】Agent“角色”怎么设计?有哪些经典角色?
65. 【⭐⭐】多Agent的调试比单Agent难在哪里?
66. 【⭐⭐】什么是“辩论式Agent”?怎么实现?
67. 【⭐⭐】Agent如何“模仿”特定人格或风格?
68. 【⭐⭐】LLM-as-Judge的偏见怎么消除?
69. 【⭐⭐】多Agent系统的状态同步怎么处理?
70. 【⭐⭐】Agent的长期记忆在多Agent场景下怎么共享?
模块六:生产环境挑战(71-80题)
71. 【⭐⭐】Agent的延迟怎么优化?
72. 【⭐⭐】Agent的成本怎么控制?
73. 【⭐⭐】流式输出对Agent有什么影响?
74. 【⭐⭐】Agent的并发处理怎么做?
75. 【⭐⭐】Agent的可观测性怎么搭建?
76. 【⭐⭐⭐】A/B测试怎么在Agent上做?
77. 【⭐】Agent的效果怎么评估?有哪些指标?
78. 【⭐⭐】用户反馈怎么用来优化Agent?
79. 【⭐⭐】Agent从开发到上线的流程是什么?
80. 【⭐⭐】Agent的“冷启动”问题怎么解决?
第三部分:实战篇(81-100题)
模块七:经典场景与案例(81-95题)
81. 【⭐⭐】论文阅读Agent怎么设计?
82. 【⭐⭐】代码助手Agent的Tools怎么设计?
83. 【⭐⭐】客服Agent的长期记忆怎么构建?
84. 【⭐⭐】数据分析Agent怎么处理表格?
85. 【⭐⭐】Browser Agent怎么控制浏览器?
86. 【⭐⭐】怎么让Agent主动提问?什么时候应该提问?
87. 【⭐⭐】Agent的多种输出形式(文本、图表、代码)怎么组织?
88. 【⭐⭐】Agent怎么处理模糊需求?
89. 【⭐⭐】Agent怎么利用用户的历史行为数据?
90. 【⭐⭐⭐】OpenAI Swarm是什么?和传统多Agent有什么区别?
模块八:思路题与开放题(96-100题)
96. 【⭐⭐⭐】如果让你设计一个Agent系统,从零开始,你的技术选型和架构是什么?
97. 【⭐⭐⭐】你认为Agent未来3年的发展方向是什么?
98. 【⭐⭐⭐】Agent的“安全性”问题有哪些?怎么防护提示词注入?
99. 【⭐⭐⭐】LLM能力边界在哪里?Agent能突破这个边界吗?
100. 【⭐⭐⭐⭐】面试官反问:你觉得Agent真的“理解”自己在做什么吗?