· 6 min read
意图识别不能全丢给大模型——面试这么答,基本就掉到「只会调 API」那一档了。
- 三大问题:全丢大模型 → 延迟 500ms-3s / 成本 / 稳定性全面崩盘。
- 规则层:35% 高频走关键词 / 正则 / 状态机,规则数量严控。
- 上下文层:55% 走小模型或语义匹配,难 点是 DST。
- 工具层:仅 10% 复杂请求兜底走 LLM,必须配超时降级。
- 核心思想:能用规则解决的不走模型,能用小模型解决的不走大模型。
- 面试模板:先点三大问题 → 再讲三层漏斗 → 最后落观点。
- 关键数字:90% 请求前两层解决掉,根本不需要惊动大模型。








