📚 Wiki 知识库

🏷️ Cost Optimization

2 篇

如何在 Claude Code 中集成 Kimi K3 以降低成本

文章指出在 Claude Code 中使用昂贵模型处理基础任务是浪费。作者介绍了三种方法将 Kimi K3 集成到工作流中:使用 Kimi Code、通过 CC Switch 在 Codex 中配置 K3,或使用 Codex Orchestration 插件进行角色级路由。通过将繁琐的代码实现交给便宜的 K3,仅将推理留给高级模型,可在保持质量的同时将成本降低 10 倍以上。

技术工具与效率 ✍ Rahul🕐 2026-07-21

LLM 提示词缓存原理与实战应用

文章深入探讨了LLM中的提示词缓存技术。通过区分静态前缀(如系统指令)和动态后缀(如用户消息),利用KV Cache机制避免重复计算,大幅降低长上下文任务的成本。文章以Claude Code为例,展示了如何通过保持92%的缓存命中率将成本降低81%。同时,强调了Hash缓存的脆弱性,任何微小的前缀变动都会导致缓存失效,并给出了在开发Agent时维持缓存热度的具体工程建议。

技术LLM ✍ Avi Chawla🕐 2026-04-16