Agent 面试|第 2 题|什么时候不该用 Agent?

原题

中文常见问法:

什么时候不该用 Agent?请举三个你会明确否决 Agent 方案的场景,并说明你会用什么替代。

英文常见问法:

When would you choose not to use an agent? Give concrete counterexamples.

考察点

(1)有没有「克制」——中高级常见分水岭。
(2)场景是否具体(含失败后果),不是「简单任务不用」这种空话。
(3)替代方案是否说得出:Workflow、规则、单次 LLM、人工。
(4)是否提到成本、延迟、合规、可复现。

过关答

我会先给判断句,再举三个否决场景。

判断句:
任务路径能被可靠写清、失败代价高或必须可复现时,我优先 Workflow / 规则 / 人工;只有路径开放、规则写不全、且失败可回滚或可兜底时,才上 Agent。

何时不上 Agent:快速否决清单

场景一:步骤固定、分支很少

例如:发票字段抽取 → 校验税号 → 写入 ERP。
每一步输入输出清晰,异常码也清晰。
用 Agent 让模型自己「探索」流程,只会增加随机性与费用。
**替代:**确定性 Workflow(或普通后端编排)+ 必要时单节点 LLM 做抽取。

场景二:失败不可回滚或强合规

例如:对外付款、删除生产数据、发送监管报送。
Agent 一旦选错工具或参数,损失难逆。
**替代:**人工审批流,或「只读 Agent 提案 + 人点确认执行」;执行层仍是受控 API,不给模型直接终态权限。

场景三:必须可复现、可审计

例如:对账、计价、法务条款比对要留同一条证据链。
Agent 同输入不同路径,审计成本高。
**替代:**固定流水线 + 全量日志;LLM 只做建议,最终以规则引擎结果为准。

三个场景的共性是:控制权不该交给运行时的模型探索。

优秀答

过关答之上,我会补「否决检查表」和「灰色地带」。

1. 上线前五问(任一「是」就慎重)

(1)步骤是否已能画成稳定流程图?
(2)最坏失败是否不可逆或违法?
(3)是否要求同输入同路径可复放?
(4)延迟/成本预算是否紧到扛不住多步循环?
(5)可用工具是否少到「循环」没有意义?

2. 灰色地带怎么处理

「客服里 80% 标准问答 + 20% 开放问题」:
标准路径走 Workflow/检索问答;开放路径再进 Agent,并加步数与权限顶。
这比「全部 Agent」或「全部死流程」都更像生产设计。

3. 用亲历口吻(可替换成你的项目)

加分示例:「上次有人提议用 Agent 自动改生产配置,我否决了——配置变更必须走变更单与双人复核。我们改成 Agent 只生成变更草案。」
面试官听的是判断,不是勇气。

4. 和经济性绑在一起

即使任务「能」用 Agent,若单次多步把毛利打穿,也应降级为单次调用或模板。
「技术上可行」≠「产品上该用」。

追问清单

Q1:那 Demo 阶段能不能先上 Agent?
期望:可以,但要标明是探索原型;上线门禁单独过否决清单,不把 Demo 架构直接当生产。

Q2:开源 Coding Agent 为什么到处都是 Agent?
期望:写代码任务路径高度开放,环境反馈密(编译/测试),失败常可回滚(git)。符合 Agent 优势区;不等于所有业务都能照搬。

Q3:否决后怎么说服鼓吹 Agent 的同事?
期望:对齐失败成本与指标(差错率、审计、成本),给替代方案与试点边界,而不是道德批判。

Q4:工具很多但权限都很大,怎么办?
期望:先砍权限与 HITL,再谈 Agent;否则是否决「裸 Agent」,不是否决自动化。

翻车红旗

(1)「简单任务不用 Agent」——没有定义什么叫简单。
(2)举不出第三个具体场景,或三个场景其实是同一句换皮。
(3)否决 Agent 后给不出替代,只剩「那就人工吧」且无流程。
(4)为显得新潮,坚持「我们全部 Agent 化」。
(5)把「模型不准」当成唯一否决理由——不准可以用评测与护栏;真正硬否决往往是控制权与后果。

白板提示

画两列:

可用 Agent          不要 Agent
开放目标            固定 SOP
失败可回滚          失败不可逆
反馈密(测/日志)    必须同路径复现
有预算与步数墙      无护栏 / 权限过大

中间写一句:先问控制权与后果,再问用不用模型。

一句话收束

不该用 Agent 的时候,通常不是模型不够聪明,而是你不该把下一步决策权交给它。
能清晰否决,比会喊 Agent 更像工程师。

关联