Agent 面试|第 2 题|什么时候不该用 Agent?
原题
中文常见问法:
什么时候不该用 Agent?请举三个你会明确否决 Agent 方案的场景,并说明你会用什么替代。
英文常见问法:
When would you choose not to use an agent? Give concrete counterexamples.
考察点
(1)有没有「克制」——中高级常见分水岭。
(2)场景是否具体(含失败后果),不是「简单任务不用」这种空话。
(3)替代方案是否说得出:Workflow、规则、单次 LLM、人工。
(4)是否提到成本、延迟、合规、可复现。
过关答
我会先给判断句,再举三个否决场景。
判断句:
任务路径能被可靠写清、失败代价高或必须可复现时,我优先 Workflow / 规则 / 人工;只有路径开放、规则写不全、且失败可回滚或可兜底时,才上 Agent。

场景一:步骤固定、分支很少
例如:发票字段抽取 → 校验税号 → 写入 ERP。
每一步输入输出清晰,异常码也清晰。
用 Agent 让模型自己「探索」流程,只会增加随机性与费用。
**替代:**确定性 Workflow(或普通后端编排)+ 必要时单节点 LLM 做抽取。
场景二:失败不可回滚或强合规
例如:对外付款、删除生产数据、发送监管报送。
Agent 一旦选错工具或参数,损失难逆。
**替代:**人工审批流,或「只读 Agent 提案 + 人点确认执行」;执行层仍是受控 API,不给模型直接终态权限。
场景三:必须可复现、可审计
例如:对账、计价、法务条款比对要留同一条证据链。
Agent 同输入不同路径,审计成本高。
**替代:**固定流水线 + 全量日志;LLM 只做建议,最终以规则引擎结果为准。
三个场景的共性是:控制权不该交给运行时的模型探索。
优秀答
过关答之上,我会补「否决检查表」和「灰色地带」。
1. 上线前五问(任一「是」就慎重)
(1)步骤是否已能画成稳定流程图?
(2)最坏失败是否不可逆或违法?
(3)是否要求同输入同路径可复放?
(4)延迟/成本预算是否紧到扛不住多步循环?
(5)可用工具是否少到「循环」没有意义?
2. 灰色地带怎么处理
「客服里 80% 标准问答 + 20% 开放问题」:
标准路径走 Workflow/检索问答;开放路径再进 Agent,并加步数与权限顶。
这比「全部 Agent」或「全部死流程」都更像生产设计。
3. 用亲历口吻(可替换成你的项目)
加分示例:「上次有人提议用 Agent 自动改生产配置,我否决了——配置变更必须走变更单与双人复核。我们改成 Agent 只生成变更草案。」
面试官听的是判断,不是勇气。
4. 和经济性绑在一起
即使任务「能」用 Agent,若单次多步把毛利打穿,也应降级为单次调用或模板。
「技术上可行」≠「产品上该用」。
追问清单
Q1:那 Demo 阶段能不能先上 Agent?
期望:可以,但要标明是探索原型;上线门禁单独过否决清单,不把 Demo 架构直接当生产。
Q2:开源 Coding Agent 为什么到处都是 Agent?
期望:写代码任务路径高度开放,环境反馈密(编译/测试),失败常可回滚(git)。符合 Agent 优势区;不等于所有业务都能照搬。
Q3:否决后怎么说服鼓吹 Agent 的同事?
期望:对齐失败成本与指标(差错率、审计、成本),给替代方案与试点边界,而不是道德批判。
Q4:工具很多但权限都很大,怎么办?
期望:先砍权限与 HITL,再谈 Agent;否则是否决「裸 Agent」,不是否决自动化。
翻车红旗
(1)「简单任务不用 Agent」——没有定义什么叫简单。
(2)举不出第三个具体场景,或三个场景其实是同一句换皮。
(3)否决 Agent 后给不出替代,只剩「那就人工吧」且无流程。
(4)为显得新潮,坚持「我们全部 Agent 化」。
(5)把「模型不准」当成唯一否决理由——不准可以用评测与护栏;真正硬否决往往是控制权与后果。
白板提示
画两列:
可用 Agent 不要 Agent
开放目标 固定 SOP
失败可回滚 失败不可逆
反馈密(测/日志) 必须同路径复现
有预算与步数墙 无护栏 / 权限过大
中间写一句:先问控制权与后果,再问用不用模型。
一句话收束
不该用 Agent 的时候,通常不是模型不够聪明,而是你不该把下一步决策权交给它。
能清晰否决,比会喊 Agent 更像工程师。