Quick answer: 将AI智能体接入多个模型上下文协议(Model Context Protocol, MCP)服务器时,模型在阅读用户意图的首个字符前,每轮交互都会被迫吞下数千个输入Token。每个注册的工具都会附加包含函数名称、参数描述、枚举定义和类型约束的完整JSON...

控制智能体MCP工具定义造成的Token冗余税

Updated September 19, 2026 · first published September 19, 2026

将AI智能体接入多个模型上下文协议(Model Context Protocol, MCP)服务器时,模型在阅读用户意图的首个字符前,每轮交互都会被迫吞下数千个输入Token。每个注册的工具都会附加包含函数名称、参数描述、枚举定义和类型约束的完整JSON Schema。在连接了6个MCP服务(GitHub、Postgres、Slack、Jira、Brave搜索、本地文件系统)的企业工作区中,静态工具前言在每次API调用中就吃掉4,500到12,000个输入Token。在一次30轮的典型任务中,仅模式重复传输就会产生0.35至1.20美元的纯冗余支出。

消除MCP开销的三大架构防线

Related


Want this applied to your own LLM spend? FinOps LLM runs a free audit of your AI costs and shows where the savings are. Book free audit →

Back to research