全部建议 > 建议详情
  • 预审中
  • 预审通过
  • 已采纳
  • 4 已实现

【功能建议】【CodeArts代码智能体产品体验官】单智能体、串行框架的局限性 已实现 编辑 删除

  • 华为云码道(CodeArts)代码智能体
  • 软件开发生产线 CodeArts

场景描述:

一个比较简单的贪食蛇开发要求,只不过要求换用rust语言进行编码,却历经三轮完整迭代(三轮to do list修改)仍然会出现明显可见的问题。

 

 

我认为这不是简单的模型能力问题,因为:

①大模型每轮都是在提醒强调后才注意到仅仅三百行rust代码中的特定逻辑问题,这对于开源SOTA级别大模型的注意力水平来说是失常的;

 

②每轮大模型的反馈迭代都要读取完整的代码文件——这说明要么是大模型上下文能力不行(GLM4.7大概率不是)要么是该智能体的工作流缓存架构设计有问题,无论哪个都是上下文管理低效、工作流不够智能的体现;

 

③每个小问题反馈后(屏闪问题、边界问题),大模型都要重写整个代码文件(共三百余行rust代码,修改三百余行)来修复,这说明大模型每轮接受问题时很可能收到的是反复堆积的提示词,即codearts agent很可能没有对用户需求进行足够科学的任务结构化拆分、多智能体分工头脑风暴、预规划(plan)面向用户答辩、防御性编码策划等环节(主从智能体“会诊”博弈架构)。远未能发挥出GLM4.7大模型的真实能力。

 

 

 

建议方案:

编码智能体不仅仅是一种prompt软件,本质上是一个系统工程的科研项目。

希望能学习(甚至逆向)claude code的multi-agent工作流逻辑,否则千篇一律的VSCODE 智能体IDE到最后只会变成同质化竞争和价格战。

Anthropic的Claude Code Agent效果很好,有没有人深入分析其技术原理?

yd_213045597 yd_213045597 发布于 2026-02-14 00:38:37 2026-02-14

3203 4

75%
3人赞同
25%
1人不赞同

全部评论(4)

评论(4)

  • 【云声小管家】 子规 2026-09-03 16:25:45

    您好,您提出的建议已优化上线,感谢您的支持与信任。如有其他建议,欢迎通过云声平台提出,我们会尽快确认并回复。再次感谢您的关注!

  • 【云声小管家】 子规 2026-02-24 09:29:54

    非常感谢您的反馈,您的建议已同步至相关产品团队,若有进展我们会及时同步给您,也请您持续关注云声平台,了解建议处理进展,感谢您对华为云的支持!

  • yd_213045597 2026-02-14 18:52:03

    一点个人浅见,华为作为老牌硬件公司,擅长为toB toG硬件稳定低频地迭代系统级软件,但不像进军硬件业务的其他巨头那样同时有消费者互联网平台应用(谷歌卖手机也有油管gemini、X卖特斯拉也有推特GROK、字节卖豆包手机也有抖音seedance、阿里卖平头哥芯片也有淘宝qwen),华为没有消费者流量平台、在消费者互联网应用的高频迭代竞争经验和用户反馈交互速度方面是初学者甚至局外人,面对字节跳动、阿里巴巴、腾讯和谷歌、马斯克这些手握互联网平台的用户流量推送打法时是占尽下风、十分劣势、很难竞争地过的,当前只有像Anthropic那样对智能体的系统工程方面发力科研、优化编码智能体本身才是正道,并且未来有必要有自己的消费者互联网平台应用获取高质量消费者数据。

    回到编程智能体IDE(编码智能体本身是编码的世界模型,AGI模型的入场券),但IDE本身的商业终点一定是消费级应用(面向非软件专业的业务开发者),而不是面向软件工具开发公司(未来AI大模型公司——往往也是当前的互联网平台公司,反而会占据当前软件工具开发公司的生态位),因为世界没有重写C/C++/python经典功能库的需求(只有新功能的需求,但已不需要新的软件工具公司了),所以编程IDE是和字节的豆包开放seedance以及阿里的千问一键奶茶的终点是一样的——挖掘并抢占互联网用户通过自家智能体实现自然语言需求的流量入口(试想一下编程IDE的终点版本——用户在鸿蒙小艺的入口给出需求:帮我定制一个合家欢小游戏、定制一个出行功能)。

    另外抛砖引玉,编码智能体工作流缓存架构设计的一个有价值的参照——医院诊疗系统,多级科室分诊,实时缓存共享病历。具体来说:
    1、结构化问卷细分问题构型/评估任务期望(先到分诊台,挂号分配科室/创建子问诊agent);
    2、问诊agent规划plan子任务面向用户答辩(问诊医生列出子问题,与患者一一确认病症与检查方案征求同意或修改);
    3、分工多个子工具agent运行商定的子任务方案(检验科/放射科医生/检查agent负责调用抽血/CT/检查工具,对抽血/CT/工具结果出具报告/分析/编码等)
    4、多智能体会诊头脑风暴(问诊医生拿到报告/编码,寻找其中的漏洞,提交新/改进的子任务,检查医生结合更新病历订正检查报告/编码;迭代直至无误)
    5、分诊主agent评估成果/领药并返回优化命令/防御性编程

  • 【云声小管家】 子规 2026-02-14 09:46:51

    非常感谢您的反馈,您的建议和诉求已经收到,并已提交至相关产品团队进行核查评估,评估完成后对于建议是否采纳会尽快给您答复,也请您持续关注云声平台,了解反馈建议处理进展,感谢您对华为云的支持!

登录后可评论,请 或 注册

0/1000

+ 插入图片0/4

仅支持JPG、JPEG、PNG、GIF,数量不超过4张且每张大小不超过2MB

评论
发表评论...
取消 发表

0/1000

评论成功

+ 插入图片0/4

仅支持JPG、JPEG、PNG、GIF,数量不超过4张且每张大小不超过2MB

删除建议

设置昵称

在此一键设置昵称,即可发表云声建议!

*长度不超过10个汉字或20个英文字符,设置后3个月内不可修改。

*长度不超过10个汉字或20个英文字符,设置后3个月内不可修改。