技术文章、实战教程、经验心得
Agent 的成本大头在哪里?本文用四个对比实验覆盖核心优化策略:系统提示 Token 成本拆解(含 Prompt Caching 原理)、模型路由(直接 LLM vs 完整 Agent)、并行工具调用(实测 3.0x 加速)、工具结果缓存(0ms vs 100ms)。附反直觉结论:延迟优化别只看 2 次采样,模型路由有隐藏开销,测量先于优化。