# 48小时,两个国产开源大模型把牌桌掀了

举报
yd_218587850 发表于 2026/08/29 21:12:57 2026/08/29
【摘要】 48小时,两个国产开源大模型把牌桌掀了同一周,腾讯混元 Hy4 preview 和智谱 GLM-5.3 先后开放权重。770B 参数、1M 上下文、Apache 2.0 协议——放在两年前,这是任何一家大厂都不会拿出来的东西。现在,48 小时内出现了两个。先看发生了什么8 月 28 日,腾讯混元发布新一代旗舰模型 Hy4 preview:总参数 770B,激活参数 49B,上下文长度 1M,...

48小时,两个国产开源大模型把牌桌掀了

同一周,腾讯混元 Hy4 preview 和智谱 GLM-5.3 先后开放权重。770B 参数、1M 上下文、Apache 2.0 协议——放在两年前,这是任何一家大厂都不会拿出来的东西。现在,48 小时内出现了两个。

先看发生了什么


AA2b5Q2S.png


8 月 28 日,腾讯混元发布新一代旗舰模型 Hy4 preview:总参数 770B,激活参数 49B,上下文长度 1M,直接以 Apache License 2.0 开源,权重挂在 HuggingFace 和 GitHub 上,谁都能下载。腾讯云 TokenHub、OpenRouter、OpenCode Go 同日上线推理服务。

几乎是同一天,智谱 Z.ai 宣布 GLM-5.3 开放权重,HuggingFace 可下载,硅基流动和 OpenRouter 提供 Day-0 支持。GLM-5.3 沿用 GLM-5.2 的基座——总参数 744B、激活 40B,规模一点没加,全靠后训练把智能拉了上来,定位是智能体编码和网络防御,同样支持 1M 上下文和可配置推理强度。

一天之内,两个 700B 级 MoE、1M 上下文的模型,以宽松协议送到了所有人手里。

Hy4:为智能体而生的生产力模型

AA2b608g.png

Hy4 的关键词是「生产力」。它不追求刷榜式的通用对话,而是瞄准三个场景:长时编码、多文件办公、科学研究。

最有意思的是官方公布的智能体研究能力:Hy4 可以并行协调多个 Codex 会话,自己评估各路结果、调整研究方向。在八项基准测试上,这种「编排多个智能体」的玩法超过了 Codex 单独运行的成绩。也就是说,模型自己开始当「小领导」了——把一群编码智能体组织起来干活,比单打独斗强。

官方盲测里,Hy4 与 GLM-5.3、Kimi K3 的分差不足 0.1。这个数字本身就说明:开源第一梯队的头部已经挤成什么样了。

GLM-5.3:不堆参数,堆后训练

如果说 Hy4 走的是「新旗舰」路线,GLM-5.3 的打法更值得琢磨。

基座和 GLM-5.2 完全一致:744B 总参数、40B 激活。没有扩规模、没有换架构,纯靠后训练把能力往前推了一大截。结果是它在 AA 综合智能指数拿到 60 分,和 Claude Fable 5、GPT-5.6 Sol 这些闭源旗舰同级,并与 Kimi K3 并列开源第一。

这对从业者是个重要信号:预训练撞墙之后,后训练才是当前的胜负手。数据质量、强化学习策略、任务设计,比多烧几万张卡堆参数更能拉开差距。

还有一个容易被忽略的细节:GLM-5.3 的许可条款里,只有年营业额超过 100 亿美元的机构把它作为外部模型服务提供时才需要安全审查。自部署、中小团队商用,实际上不受影响。这个门槛卡的是巨头,放行的是所有人。

对开发者的现实影响

这波开源对普通开发者最实际的变化有三个:

第一,私有化部署的天花板一夜抬高了。 之前想在本地/私有云跑一个接近闭源旗舰水平的模型,选择面很窄。现在 700B 级、1M 上下文、智能体能力齐全的权重可以直接下载,编码智能体、安全防御这类需要数据不出域的场景,可行性完全不同了。

第二,推理平台 Day-0 就位。 硅基流动和 OpenRouter 当天上线,不需要自己攒 GPU 集群,API 直接切换。顺带一提,GLM-5.2 此前在 OpenRouter 上的 token 份额排名第一,GLM-5.3 是把这个用户基本盘直接平移过去。

第三,自主可控不再是妥协项。 同一周的另一条大新闻:OpenAI 宣布因 SpaceX 收购 Cursor 带来的合规风险,将于 11 月 12 日终止向 Cursor 提供模型。依赖单一闭源 API 的团队, suddenly 要在两个月内重找工作流。开源权重的价值,在这一刻被解释得明明白白。

写在最后

国产开源模型从「能用」到「第一梯队」,花了不到两年;从第一梯队到「48 小时双发 700B 级旗舰」,可能只用了一个夏天。

对闭源 API 阵营来说,护城河正在从「模型能力」退守到「产品体验和生态」。而对我们开发者来说,问题已经从「开源模型够不够用」变成了「这么多开源模型,选哪个」。

【声明】本内容来自华为云开发者社区博主,不代表华为云及华为云开发者社区的观点和立场。转载时必须标注文章的来源(华为云社区)、文章链接、文章作者等基本信息,否则作者和本社区有权追究责任。如果您发现本社区中有涉嫌抄袭的内容,欢迎发送邮件进行举报,并提供相关证据,一经查实,本社区将立刻删除涉嫌侵权内容,举报邮箱: cloudbbs@huaweicloud.com
  • 点赞
  • 收藏
  • 关注作者

评论(0

0/1000
抱歉,系统识别当前为高风险访问,暂不支持该操作

全部回复

上滑加载中

设置昵称

在此一键设置昵称,即可参与社区互动!

*长度不超过10个汉字或20个英文字符,设置后3个月内不可修改。

*长度不超过10个汉字或20个英文字符,设置后3个月内不可修改。