模型上下文协议(MCP)
模型上下文协议(MCP)是一项连接 AI 应用与外部工具和数据的开放标准,服务器可向兼容客户端提供工具、资源或提示。
Anthropic 于 2024 年 11 月以开源协议形式发布 MCP。服务器用统一接口封装问题跟踪系统、数据库或浏览器等服务,让支持 MCP 的客户端无需为每个系统单独开发集成。Claude Code 和 Codex CLI 都能连接 MCP 服务器,两者都可通过 /mcp 查看配置。
从 token 用量看,关键是工具如何被介绍给模型。每个工具都有名称、说明和输入模式;模型只有在请求中获知工具信息后才能调用它。如果完整定义预先载入,每个已连接服务器都会增加每轮请求的输入,即使当前任务完全不用它。
代理处理定义的方式并不相同,也会随版本变化。截至 2026 年 9 月,Claude Code 默认延后载入 MCP 工具定义:起初进入上下文的只有工具名称和服务器指令,模型决定使用某个工具时才取得完整模式。其文档仍指出,gh 等命令行工具通常比 MCP 服务器少占上下文,因为它们无需逐项列出工具。
结果也有成本。MCP 工具的输出会像其他工具结果一样加入对话,并在后续每一轮重新发送。截至 2026 年 9 月,Claude Code 在单次输出超过 10,000 token 时发出警告,默认上限为 25,000 token,可用 MAX_MCP_OUTPUT_TOKENS 调整。通过 /mcp 禁用项目不用的服务器,可减少这两部分开销。