Agent 面试 · 概念与边界
先分清名词,避免面试一上来把 Chat、RAG、Agent 混着说。
高频问法
- Agent 到底是什么?和 Chatbot 差在哪?
- RAG、Agent、微调分别解决什么?
- 什么时候不该上 Agent?
- Code Agent 和 Worker Agent 有什么区别?
- 「多 Agent」和「一个 Agent 多个工具」怎么理解?
口述参考
1)Agent 一句话
Agent = 目标 + 模型决策 + 工具执行 + 循环,直到完成、失败或触达上限。
不是「模型更聪明」,而是能碰外部世界(API、库、浏览器、代码仓),并且有工程边界。
| Chat / 单次补全 | Agent | |
|---|---|---|
| 输入输出 | 文本进、文本出 | 可多轮,中间有工具结果 |
| 行动 | 基本不碰系统 | 调工具改状态 |
| 失败形态 | 答错、胡说 | 死循环、乱调工具、成本炸 |
2)RAG / Agent / 微调
| RAG | Agent | 微调 | |
|---|---|---|---|
| 问题类型 | 「文档/制度里怎么说」 | 「帮我把事做完」 | 「口吻/格式/领域要长期贴」 |
| 核心动作 | 检索 → 塞上下文 | 规划 → 调工具 → 观察 | 改权重 |
| 知识更新 | 改库 | 靠工具与系统 | 再训练 |
| 默认 | 知识在外部时优先 | 真要多步办事 | 最后才考虑 |
默认顺序(可背): Prompt / 结构化输出 → RAG → Agent → 微调。
3)什么时候别上 Agent
- 单次问答、写摘要、简单分类就够
- 没有可靠工具 / 权限说不清
- 业务规则用 if-else 或工作流引擎更稳、更便宜
- 团队还不会做超时、重试、审计——先别上「自主」
一句话:能流程化的先流程化;Agent 补「决策不确定、要调多种工具」的缝。
4)Code vs Worker
- Code Agent:读仓、改文件、跑命令、出 PR(Cursor、Claude Code、Codex、通义灵码…)
- Worker Agent:办事——文档、表格、浏览器、本地文件(Operator、WorkBuddy…)
面试举例时先说清你做的是哪一类,再讲链路。
5)多 Agent
常见两种说法:
- 一个主 Agent + 多个工具(多数业务够用)
- 多个角色 Agent(规划 / 执行 / 审查)串或并行,要有汇总与权限
别吹「我们上了多智能体」——讲清为什么拆、怎么汇合、失败谁负责。
追问预备
- 「那 LangChain / 自研编排差在哪?」→ 框架是加速器;核心仍是工具契约、状态、观测。
- 「和传统工作流引擎比?」→ 引擎路径确定;Agent 路径由模型动态选工具,不确定性更高,更要护栏。