Space Bunny 评测
Space Bunny(中文社区称“太空兔”)是2026年9月23日由匿名厂商同时上线于OpenRouter和OpenCode平台的一款Flash档位大模型。它在上线后三天内便冲上双平台调用量日榜第一,OpenCode日调用量一度达到约8.3万亿Token。核心卖点非常清晰:100万token上下文、原生多模态输入、极快的推理速度,以及限时免费。
核心规格速览
| 项目 | Space Bunny (Space Bunny Alpha) |
|---|---|
| 上线日期 | 2026年9月23日 |
| 定位 | Flash档位轻量快速模型 |
| 上下文窗口 | 100万 token |
| 单次最大输出 | 524,288 token |
| 输入模态 | 文本、图像、视频 |
| 输出模态 | 文本 |
| 推理档位 | low / high / max(多档可调) |
| 工具调用 | 支持 Function Calling、Tool Choice、JSON Schema |
| 数据留存 | 匿名期间零数据留存 |
| 定价 | 限时免费(原定一周,后延长至10月5日) |
| 可用平台 | OpenRouter、OpenCode |
模型的参数规模、是否采用MoE架构等核心技术细节完全未公开,社区流传的“约4280亿总参数、230亿激活参数”属于第三方推测,并非官方数据。多家开发者通过分词器分析(24组探针字符串测试)发现Space Bunny的token计数行为与MiniMax M系列一致,推测其可能是MiniMax M3.1 Flash Preview的匿名版本。
性能表现:速度是最大标签
速度数据:多个独立测试显示,Space Bunny的流式吞吐在74到94 token/秒之间,首字延迟最低可做到380毫秒。有开发者对比测试中,Space Bunny仅用3分钟完成火箭发射场景的构建,效果被认为“能和Opus 5相比”,且明显领先GPT-6 Sol和Gemini 3.8 Flash。
速度的边界:在更复杂的任务中,速度优势会收窄。有开发者用相同提示词让Space Bunny制作简易版《我的世界》,耗时约40-94分钟。这表明在需要长程推理和多次迭代的任务中,“火箭速度”会回归到正常Flash模型水平。
3D与前端能力突出:大部分用户反馈Space Bunny在3D输出方面能力突出,前端生成质量在Flash档位中属于第一梯队。在体素花园、灯塔风暴等场景对比中,其生成效果与GPT-6 Astra“远观差距并不明显”,但在桃花树精度、水池自然度、阁楼门窗等细节上存在可感知的差距。
基准测试参考:在OrcaRouter的评测中,Space Bunny在高推理模式下10分制得分7.0,尝试通过率62.1%,可靠性评分10.0,平均响应时间27秒。可靠性满分而通过率中等,说明它“不常出错,但复杂任务的成功率有上限”。
实战评测:前端审美在线,自我核验是亮点
前端与视觉生成
多位开发者的实测反馈集中在前端审美上。一位开发者用GLM-5.3 Flash、DeepSeek-V4.1 Flash和Space Bunny同时做了一款中文3D书房探索解谜游戏,Space Bunny的美术取向被评价为“森系色调,完全没有很多模型写Three.js时那种刺眼的塑料感”。在潮玩品牌官网的测试中,它把“抽盒的惊喜感”通过暗色背景、粉紫蓝色光晕和荧光黄按钮落地到了页面上。
一个特别的行为引起了开发者注意:如果有浏览器工具可用,Space Bunny会主动打开页面截图检查效果,在宣布任务完成前先修复自己发现的问题。这种“自我核验”行为在同类免费/匿名模型中并不常见。
长程任务与Agent场景
在Claude Code中接入Space Bunny后,有开发者仅用一句提示词“帮我手搓一个自动麻将机的3D小程序”,模型主动反问三个问题(工程形态、自动化程度、麻将规则),然后自主设计、开发和测试,最终用不到3000行代码完成。这表明它在Agent工作流中具备不错的长程调度能力。
多模态理解
Space Bunny的视觉理解能力被开发者评价为“很强,设计品味在线”。一个典型场景是:把一张手绘草图(圆圈代表唱片、波浪线代表介绍、框写“买”、打叉卡片表示售罄)丢给模型,不到5分钟就生成了一个可打开的网站,准确理解了草图中的视觉意图。
定价与可用性
当前状态:Space Bunny在OpenRouter和OpenCode上均为限时免费。原定免费一周(至9月30日),后因模型在周末进行了升级,免费期延长5天至10月5日。
接入方式:
- OpenCode:按下
/models,在模型列表中选择“Space Bunny Free”即可,无需API Key。 - OpenRouter:注册后搜索
stealth/space-bunny-alpha,创建API Key即可调用,支持网页端直接对话或代码调用。
需要注意的限制:OpenCode的免费层只能在OpenCode平台内使用,第三方工具接入可能受限流影响(频繁429需要IP代理池轮询)。匿名模型的数据处理方式需遵守Stealth Model Terms,提示词和输出可能被厂商保留,但不会用于训练。
争议与局限性
Space Bunny并非一边倒的好评。社区反馈中存在明显的两极分化:
正面:速度快、3D/前端能力突出、免费、100万上下文、Agent场景可用。
负面:
- 幻觉问题:部分开发者反映“幻觉重、生成效果一般、指令遵循有毛病,小模型味道重”。
- 结果一致性差:有开发者用相同提示词复现他人测试时,生成结果差异较大。
- 长文本推理不是强项:虽然上下文窗口达100万token,但在需要深度推理的长任务中,表现会明显回落。
- 匿名模型的可持续性风险:不公开训练数据、不透露团队背景,哪天突然关停或涨价,用户缺乏保障。
选型建议
适合使用Space Bunny的场景:
- 前端原型与视觉探索:需要快速生成3D场景、交互页面、动效原型时,它的速度和审美在Flash档位中属于第一梯队。
- 日常编程辅助:对于95%的日常编程任务,它“可以秒杀”,且完全免费。
- 多模态理解任务:从草图生成页面、从图片提取代码等场景表现良好。
- Agent工作流中的执行层:适合作为长程任务中的快速执行模型,而非最终决策模型。
不适合使用Space Bunny的场景:
- 需要严格可靠性的生产环境:匿名预览模型不应被当作成熟的生产依赖。
- 深度推理与长文本分析:它的定位是Flash快速模型,不是推理旗舰。
- 对供应商身份和数据合规有硬性要求的企业:厂商身份未公开,长期稳定性不明。
- 需要结果一致性的任务:相同提示词可能产生差异较大的输出。
一句话总结
Space Bunny是一只“快到不讲道理”的Flash模型——它用3分钟能做出别人半小时的东西,前端审美在线,还免费;但你永远不知道它下一分钟会不会突然关停,也不知道它下一轮生成会给你什么惊喜(或惊吓)。作为尝鲜和原型工具,它是当前性价比最高的选择之一;作为生产依赖,它还不合格。
- 点赞
- 收藏
- 关注作者
评论(0)