非常正常。相比涨价之前,v4f 的谷价大约是 2 倍,峰价大约是 4 倍。v4p 的谷价大约是 3.5 - 4.5 倍,峰价大约是 7 - 9 倍。 不仅仅是 ds ,其他家模型也是一样,除了分析,设计,讨论,审查这种发散性任务要用高级模型,其他明确的,重复的,低复杂度任务,都建议用快速模型。
1. 看下缓存占比是不是很低,以 deepseek v4flash 为例,90%的缓存占比成本是 98%换成占比的 3 倍 https://imgbed.5l6d54s2.cn/file/1788334991048_deepseek_cache_perdollar.png 2. 优化缓存占比可减少断对话,进行长对话或者开对话分支以继承上下文 3. 规划,讨论,设计用 Pro ,写入,调试,测试用 flash 4. 如果对业务很熟悉,提示词写好,直接用 flash 其实也没什么事