Quick answer: Conectar um agente de IA a múltiplos servidores Model Context Protocol (MCP) introduz milhares de tokens de entrada a cada turno antes mesmo de processar o pedido do utilizador. Cada ferramenta...

Controlar o custo de tokens em esquemas MCP em agentes de IA

Updated September 19, 2026 · first published September 19, 2026

Conectar um agente de IA a múltiplos servidores Model Context Protocol (MCP) introduz milhares de tokens de entrada a cada turno antes mesmo de processar o pedido do utilizador. Cada ferramenta registada anexa um esquema JSON com nomes de funções, descrições de parâmetros e restrições. Num ambiente com 6 servidores MCP, este cabeçalho consome entre 4.500 e 12.000 tokens por chamada.

Porque é que as definições de ferramentas MCP consomem tantos tokens?

Cada ferramenta MCP requer especificações completas em formato JSON Schema para orientar o modelo na execução de chamadas. Uma ferramenta complexa consome facilmente 400 a 600 tokens, acumulando um custo fixo que penaliza todas as iterações.

Soluções de engenharia

As equipas de engenharia resolvem este problema recorrendo a pontos de cache de prompts após as declarações das ferramentas, encaminhamento semântico em duas fases para carregar apenas as ferramentas necessárias e minificação de esquemas.

Related


Want this applied to your own LLM spend? FinOps LLM runs a free audit of your AI costs and shows where the savings are. Book free audit →

Back to research