全部建议
>
建议详情
- 预审中
- 预审通过
- 3 已采纳
- 4 已实现
【产品缺陷】DeepSeek模型API上下文缓存命中率异常偏低 已采纳 编辑 删除
- AI基础平台
- MaaS模型即服务
场景描述:近期在用deep seek harness调用华为云平台的 DeepSeek 模型(deepseek-v4.1-flash)时,发现上下文缓存命中率极低。在多轮对话和长文本任务中,缓存命中率长期维持在较低水平(如截图所示,1.3M token下缓存命中仅42%),导致推理成本大幅增加。



建议方案:请技术团队协助分析,当前 42% 的低命中率,是我调用方式的问题,还是平台侧缓存路由策略导致的?麻烦提供针对deep seek harness的官方最佳实践。
湘兔
发布于 2026-09-17 00:16:36
2026-09-17
57 1
0%
0%
取消
发表
0/1000
+ 插入图片0/4
仅支持JPG、JPEG、PNG、GIF,数量不超过4张且每张大小不超过2MB
0%
0%
删除建议
全部评论(1)
评论(1)
感谢您的反馈,您的建议已提交相关团队评估,结果将尽快告知。请您持续关注云声平台了解处理进展。感谢您对华为云的支持!