- 预审中
- 预审通过
- 3 未采纳
【用户体验】Modelarts调用GLM5流式返回卡顿优化 未采纳 编辑 删除
- AI基础平台
- ModelArts Studio
场景描述:
在线调用和通过API调用ModelArts Studio上的GLM5模型时流式返回卡顿
接口:https://api.modelarts-maas.com/v2/chat/completions
建议方案:
按照返回的信息可以看出模型侧每个token的生成时间是正常的,问题应该是出在网络侧,在流式返回的合并等待时间过长。每次合并返回了10+data包,导致用户体验较差。建议调整
data: {"id":"66ca04b14d0c4a678859c5b5bfab199f","object":"chat.completion.chunk","created":1773116272,"model":"glm-5","choices":[{"index":0,"delta":{"role":"assistant","content":"","reasoning_content":" **"}}],"service_tier":"default","first_token_return_time":1773116274.9187264,"usage":null}
data: {"id":"66ca04b14d0c4a678859c5b5bfab199f","object":"chat.completion.chunk","created":1773116272,"model":"glm-5","choices":[{"index":0,"delta":{"role":"assistant","content":"","reasoning_content":"签名:"}}],"service_tier":"default","first_token_return_time":1773116274.9774923,"usage":null}
yd_241769108
发布于 2026-03-10 12:28:11
2026-03-10
258 2
0/1000
仅支持JPG、JPEG、PNG、GIF,数量不超过4张且每张大小不超过2MB
删除建议
全部评论(2)
评论(2)
您好,关于您提交的建议产品和研发团队进行了评估,未复现,建议您提交工单确认,综合考虑整体需求与产品规划,很抱歉未能采纳,还请您谅解。
对您造成困扰深表歉意!希望以上可以解决您的疑虑,感谢您的反馈,若在使用还有其它建议,可在云声平台继续反馈,我们收到后会尽快处理。感谢您对华为云的支持!
非常感谢您的反馈,您的建议和诉求已经收到,并已提交至相关产品团队进行核查评估,评估完成后对于建议是否采纳会尽快给您答复,也请您持续关注云声平台,了解反馈建议处理进展,感谢您对华为云的支持!