Sobre contexto de LLM, onde o ruído se acumula e o que fazer com ele.
Testei os dois caminhos de leitura em produção: via MCP direto e via um redutor determinístico. Um deu erro de teto de tokens. O outro cortou 84%.