Space Bunny 评测

举报
GrayParis 发表于 2026/10/04 12:08:48 2026/10/04
【摘要】 Space Bunny(中文社区称“太空兔”)是2026年9月23日由匿名厂商同时上线于OpenRouter和OpenCode平台的一款Flash档位大模型。它在上线后三天内便冲上双平台调用量日榜第一,OpenCode日调用量一度达到约8.3万亿Token。核心卖点非常清晰:100万token上下文、原生多模态输入、极快的推理速度,以及限时免费。 核心规格速览项目Space Bunny (S...

Space Bunny(中文社区称“太空兔”)是2026年9月23日由匿名厂商同时上线于OpenRouter和OpenCode平台的一款Flash档位大模型。它在上线后三天内便冲上双平台调用量日榜第一,OpenCode日调用量一度达到约8.3万亿Token。核心卖点非常清晰:100万token上下文、原生多模态输入、极快的推理速度,以及限时免费。


核心规格速览

项目 Space Bunny (Space Bunny Alpha)
上线日期 2026年9月23日
定位 Flash档位轻量快速模型
上下文窗口 100万 token
单次最大输出 524,288 token
输入模态 文本、图像、视频
输出模态 文本
推理档位 low / high / max(多档可调)
工具调用 支持 Function Calling、Tool Choice、JSON Schema
数据留存 匿名期间零数据留存
定价 限时免费(原定一周,后延长至10月5日)
可用平台 OpenRouter、OpenCode

模型的参数规模、是否采用MoE架构等核心技术细节完全未公开,社区流传的“约4280亿总参数、230亿激活参数”属于第三方推测,并非官方数据。多家开发者通过分词器分析(24组探针字符串测试)发现Space Bunny的token计数行为与MiniMax M系列一致,推测其可能是MiniMax M3.1 Flash Preview的匿名版本。


性能表现:速度是最大标签

速度数据:多个独立测试显示,Space Bunny的流式吞吐在74到94 token/秒之间,首字延迟最低可做到380毫秒。有开发者对比测试中,Space Bunny仅用3分钟完成火箭发射场景的构建,效果被认为“能和Opus 5相比”,且明显领先GPT-6 Sol和Gemini 3.8 Flash。

速度的边界:在更复杂的任务中,速度优势会收窄。有开发者用相同提示词让Space Bunny制作简易版《我的世界》,耗时约40-94分钟。这表明在需要长程推理和多次迭代的任务中,“火箭速度”会回归到正常Flash模型水平。

3D与前端能力突出:大部分用户反馈Space Bunny在3D输出方面能力突出,前端生成质量在Flash档位中属于第一梯队。在体素花园、灯塔风暴等场景对比中,其生成效果与GPT-6 Astra“远观差距并不明显”,但在桃花树精度、水池自然度、阁楼门窗等细节上存在可感知的差距。

基准测试参考:在OrcaRouter的评测中,Space Bunny在高推理模式下10分制得分7.0,尝试通过率62.1%,可靠性评分10.0,平均响应时间27秒。可靠性满分而通过率中等,说明它“不常出错,但复杂任务的成功率有上限”。


实战评测:前端审美在线,自我核验是亮点

前端与视觉生成

多位开发者的实测反馈集中在前端审美上。一位开发者用GLM-5.3 Flash、DeepSeek-V4.1 Flash和Space Bunny同时做了一款中文3D书房探索解谜游戏,Space Bunny的美术取向被评价为“森系色调,完全没有很多模型写Three.js时那种刺眼的塑料感”。在潮玩品牌官网的测试中,它把“抽盒的惊喜感”通过暗色背景、粉紫蓝色光晕和荧光黄按钮落地到了页面上。

一个特别的行为引起了开发者注意:如果有浏览器工具可用,Space Bunny会主动打开页面截图检查效果,在宣布任务完成前先修复自己发现的问题。这种“自我核验”行为在同类免费/匿名模型中并不常见。

长程任务与Agent场景

在Claude Code中接入Space Bunny后,有开发者仅用一句提示词“帮我手搓一个自动麻将机的3D小程序”,模型主动反问三个问题(工程形态、自动化程度、麻将规则),然后自主设计、开发和测试,最终用不到3000行代码完成。这表明它在Agent工作流中具备不错的长程调度能力。

多模态理解

Space Bunny的视觉理解能力被开发者评价为“很强,设计品味在线”。一个典型场景是:把一张手绘草图(圆圈代表唱片、波浪线代表介绍、框写“买”、打叉卡片表示售罄)丢给模型,不到5分钟就生成了一个可打开的网站,准确理解了草图中的视觉意图。


定价与可用性

当前状态:Space Bunny在OpenRouter和OpenCode上均为限时免费。原定免费一周(至9月30日),后因模型在周末进行了升级,免费期延长5天至10月5日。

接入方式:

  • OpenCode:按下 /models,在模型列表中选择“Space Bunny Free”即可,无需API Key。
  • OpenRouter:注册后搜索 stealth/space-bunny-alpha,创建API Key即可调用,支持网页端直接对话或代码调用。

需要注意的限制:OpenCode的免费层只能在OpenCode平台内使用,第三方工具接入可能受限流影响(频繁429需要IP代理池轮询)。匿名模型的数据处理方式需遵守Stealth Model Terms,提示词和输出可能被厂商保留,但不会用于训练。


争议与局限性

Space Bunny并非一边倒的好评。社区反馈中存在明显的两极分化:

正面:速度快、3D/前端能力突出、免费、100万上下文、Agent场景可用。

负面:

  • 幻觉问题:部分开发者反映“幻觉重、生成效果一般、指令遵循有毛病,小模型味道重”。
  • 结果一致性差:有开发者用相同提示词复现他人测试时,生成结果差异较大。
  • 长文本推理不是强项:虽然上下文窗口达100万token,但在需要深度推理的长任务中,表现会明显回落。
  • 匿名模型的可持续性风险:不公开训练数据、不透露团队背景,哪天突然关停或涨价,用户缺乏保障。

选型建议

适合使用Space Bunny的场景:

  • 前端原型与视觉探索:需要快速生成3D场景、交互页面、动效原型时,它的速度和审美在Flash档位中属于第一梯队。
  • 日常编程辅助:对于95%的日常编程任务,它“可以秒杀”,且完全免费。
  • 多模态理解任务:从草图生成页面、从图片提取代码等场景表现良好。
  • Agent工作流中的执行层:适合作为长程任务中的快速执行模型,而非最终决策模型。

不适合使用Space Bunny的场景:

  • 需要严格可靠性的生产环境:匿名预览模型不应被当作成熟的生产依赖。
  • 深度推理与长文本分析:它的定位是Flash快速模型,不是推理旗舰。
  • 对供应商身份和数据合规有硬性要求的企业:厂商身份未公开,长期稳定性不明。
  • 需要结果一致性的任务:相同提示词可能产生差异较大的输出。

一句话总结

Space Bunny是一只“快到不讲道理”的Flash模型——它用3分钟能做出别人半小时的东西,前端审美在线,还免费;但你永远不知道它下一分钟会不会突然关停,也不知道它下一轮生成会给你什么惊喜(或惊吓)。作为尝鲜和原型工具,它是当前性价比最高的选择之一;作为生产依赖,它还不合格。

【声明】本内容来自华为云开发者社区博主,不代表华为云及华为云开发者社区的观点和立场。转载时必须标注文章的来源(华为云社区)、文章链接、文章作者等基本信息,否则作者和本社区有权追究责任。如果您发现本社区中有涉嫌抄袭的内容,欢迎发送邮件进行举报,并提供相关证据,一经查实,本社区将立刻删除涉嫌侵权内容,举报邮箱: cloudbbs@huaweicloud.com
  • 点赞
  • 收藏
  • 关注作者

评论(0)

0/1000
抱歉,系统识别当前为高风险访问,暂不支持该操作

全部回复

上滑加载中

设置昵称

在此一键设置昵称,即可参与社区互动!

*长度不超过10个汉字或20个英文字符,设置后3个月内不可修改。

*长度不超过10个汉字或20个英文字符,设置后3个月内不可修改。