全部建议 > 建议详情
  • 预审中
  • 预审通过
  • 3 未采纳

【用户体验】Modelarts调用GLM5流式返回卡顿优化 未采纳 编辑 删除

  • AI基础平台
  • ModelArts Studio

场景描述:

在线调用和通过API调用ModelArts Studio上的GLM5模型时流式返回卡顿

接口:https://api.modelarts-maas.com/v2/chat/completions

建议方案:

按照返回的信息可以看出模型侧每个token的生成时间是正常的,问题应该是出在网络侧,在流式返回的合并等待时间过长。每次合并返回了10+data包,导致用户体验较差。建议调整

data: {"id":"66ca04b14d0c4a678859c5b5bfab199f","object":"chat.completion.chunk","created":1773116272,"model":"glm-5","choices":[{"index":0,"delta":{"role":"assistant","content":"","reasoning_content":"   **"}}],"service_tier":"default","first_token_return_time":1773116274.9187264,"usage":null}

data: {"id":"66ca04b14d0c4a678859c5b5bfab199f","object":"chat.completion.chunk","created":1773116272,"model":"glm-5","choices":[{"index":0,"delta":{"role":"assistant","content":"","reasoning_content":"签名:"}}],"service_tier":"default","first_token_return_time":1773116274.9774923,"usage":null}

 

 

yd_241769108 yd_241769108 发布于 2026-03-10 12:28:11 2026-03-10

258 2

0%
0人赞同
0%
0人不赞同

全部评论(2)

评论(2)

  • 【云声小管家】 子规 2026-03-13 18:07:26

    您好,关于您提交的建议产品和研发团队进行了评估,未复现,建议您提交工单确认,综合考虑整体需求与产品规划,很抱歉未能采纳,还请您谅解。
    对您造成困扰深表歉意!希望以上可以解决您的疑虑,感谢您的反馈,若在使用还有其它建议,可在云声平台继续反馈,我们收到后会尽快处理。感谢您对华为云的支持!

  • 【云声小管家】 子规 2026-03-10 14:35:41

    非常感谢您的反馈,您的建议和诉求已经收到,并已提交至相关产品团队进行核查评估,评估完成后对于建议是否采纳会尽快给您答复,也请您持续关注云声平台,了解反馈建议处理进展,感谢您对华为云的支持!

登录后可评论,请 或 注册

0/1000

+ 插入图片0/4

仅支持JPG、JPEG、PNG、GIF,数量不超过4张且每张大小不超过2MB

评论
发表评论...
取消 发表

0/1000

评论成功

+ 插入图片0/4

仅支持JPG、JPEG、PNG、GIF,数量不超过4张且每张大小不超过2MB

删除建议

设置昵称

在此一键设置昵称,即可发表云声建议!

*长度不超过10个汉字或20个英文字符,设置后3个月内不可修改。

*长度不超过10个汉字或20个英文字符,设置后3个月内不可修改。