其实 system prompt 算小头,agent 场景里的大头是 history ,每一轮相比上一轮的历史都是重复的,而且缓存命中率直接决定结算单价,最终影响的是完成一件事的成本,大家会用脚投票,所以当然会特别在意。
正确的,本身缓存率就是个和实际工作负载类型强相关的东西,服务端的影响也很大; Harness 只要做好稳定前缀,别像之前某个 harness 在系统提示词开头插当前精确到分钟的时间就行了(虽然现在有些模型的 template 把系统提示词放在最后了)
这有啥难理解的,好比游泳,人的水平当然是核心因素,但是同一个人, 穿 A 牌的泳衣就是游的比 B 牌的快;agent 缓存命中优化是同一个道理, 同样的任务,同样的模型,用 opencode 和 claude code 缓存命中率就是不一样, 换你你用哪一个?
因为没什么可吹的了,大差不差的,只能强行说点啥,刚刚还看到一个帖子,说把 agent 装进你的电脑,然后有个唐式对比: 其他 AI 助手工具 XiaoyaoClaw 数据上传到云端,归别人管 本地优先,配置、聊天记录、API 密钥都在你电脑里 我寻思着 hermes openclaw pi 哪个不是本地?