Skip to main content

11 posts tagged with "Agent Basics"

View All Tags
· 5 min read

SSE 和 STDIO 是 MCP 的两种传输方式,区别不在通信模式,在进程边界——STDIO 面向本地进程,SSE 面向远程服务。

  • STDIO:客户端 fork 子进程,通过 stdin/stdout 收发 JSON-RPC,零网络开销
  • SSE:客户端连远程 HTTP 端点,服务端推送事件,需处理鉴权和网络延迟
  • 选择逻辑:本地工具用 STDIO,远程共享服务用 SSE,场景决定选型
  • 核心差异:STDIO 进程由客户端管理生命周期,SSE 服务端独立部署
  • MCP 演进:原始 HTTP+SSE 已被 Streamable HTTP 替代,不再需要双通道拆分
  • 关键提醒本地工具用 SSE 是自找麻烦,多了端口、CORS、鉴权,收益为零
· 4 min read

AI 模型的流式输出本质是单向长文本推送,SSE 比 WebSocket 更合适,多数场景不需要双向通道。

  • SSE:基于 HTTP,服务端到客户端单向推送,内置自动重连,零额外握手成本
  • WebSocket:全双工双向通信,需要协议升级,实现复杂、资源开销大
  • 选择逻辑:AI 问答是客户端发一条请求、服务端流式返回文本,单向通道完全够用
  • 双向需求:语音对话、实时协作编辑才需要 WebSocket,纯文本问答不需要
  • 坑 ①:HTTP/1.1 下同一域名最多 6 个 SSE 并发连接,多标签页可能占满
  • 坑 ②:组件卸载时忘记手动关闭 EventSource,连接不会自动释放,导致内存泄漏
· 6 min read

意图识别不能全丢给大模型——面试这么答,基本就掉到「只会调 API」那一档了。

  1. 三大问题:全丢大模型 → 延迟 500ms-3s / 成本 / 稳定性全面崩盘。
  2. 规则层35% 高频走关键词 / 正则 / 状态机,规则数量严控
  3. 上下文层55% 走小模型或语义匹配,难点是 DST。
  4. 工具层:仅 10% 复杂请求兜底走 LLM,必须配超时降级
  5. 核心思想:能用规则解决的不走模型,能用小模型解决的不走大模型。
  6. 面试模板:先点三大问题 → 再讲三层漏斗 → 最后落观点。
  7. 关键数字90% 请求前两层解决掉,根本不需要惊动大模型。