全部建议 > 建议详情
  • 预审中
  • 预审通过
  • 3 已采纳
  • 4 已实现

【产品缺陷】DeepSeek模型API上下文缓存命中率异常偏低 已采纳 编辑 删除

  • AI基础平台
  • MaaS模型即服务

场景描述:近期在用deep seek harness调用华为云平台的 DeepSeek 模型(deepseek-v4.1-flash)时,发现上下文缓存命中率极低。在多轮对话和长文本任务中,缓存命中率长期维持在较低水平(如截图所示,1.3M token下缓存命中仅42%),导致推理成本大幅增加。

屏幕截图 2026-09-17 001205.png

屏幕截图 2026-09-17 000941.png

屏幕截图 2026-09-17 000852.png

 

 

 

建议方案:请技术团队协助分析,当前 42% 的低命中率,是我调用方式的问题,还是平台侧缓存路由策略导致的?麻烦提供针对deep seek harness的官方最佳实践。

 

 

湘兔 湘兔 发布于 2026-09-17 00:16:36 2026-09-17

57 1

0%
0人赞同
0%
0人不赞同

全部评论(1)

评论(1)

  • 【云声小管家】 子规 2026-09-17 11:12:34

    感谢您的反馈,您的建议已提交相关团队评估,结果将尽快告知。请您持续关注云声平台了解处理进展。感谢您对华为云的支持!

登录后可评论,请 或 注册

0/1000

+ 插入图片0/4

仅支持JPG、JPEG、PNG、GIF,数量不超过4张且每张大小不超过2MB

评论
发表评论...
取消 发表

0/1000

评论成功

+ 插入图片0/4

仅支持JPG、JPEG、PNG、GIF,数量不超过4张且每张大小不超过2MB

删除建议

设置昵称

在此一键设置昵称,即可发表云声建议!

*长度不超过10个汉字或20个英文字符,设置后3个月内不可修改。

*长度不超过10个汉字或20个英文字符,设置后3个月内不可修改。