作者小头像 Lv.3
更多个人资料
405 成长值
0 关注
1 粉丝
+ 关注 私信

个人介绍

这个人很懒,什么都没有留下

感兴趣或擅长的领域

暂无数据
个人勋章
TA还没获得勋章~
成长雷达
390
15
0
0
0

个人资料

个人介绍

这个人很懒,什么都没有留下

感兴趣或擅长的领域

暂无数据

达成规则

以上满足项可达成此勋章

  • 博客
  • 关注
  • 粉丝
  • 论坛
全部时间
全部时间
最近三天
最近一周
最近一月
  • 全部
  • 暂无专栏分类
Space Bunny 评测
Space Bunny(中文社区称“太空兔”)是2026年9月23日由匿名厂商同时上线于OpenRouter和OpenCode平台的一款Flash档位大模型。它在上线后三天内便冲上双平台调用量日榜第一,OpenCode日调用量一度达到约8.3万亿Token。核心卖点非常清晰:100万token上下文、原生多模态输入、极快的推理速度,以及限时免费。 核心规格速览项目Space Bunny (S...
Flash 开发者
作者小头像 GrayParis 2026-10-04 12:08:48
3
0
0
2026-10-04 12:08:48
3
0
0
GPT-6 Sol——价格与性能的平衡产品
GPT-6 Sol是OpenAI于2026年9月22日发布的GPT-6系列中端模型,定位在旗舰Astra与廉价Luna之间,核心策略是以Astra五分之一的 token 价格提供接近其水平的代理与编码能力。与上一代GPT-5.6 Sol相比,GPT-6 Sol的API价格直接砍半(输入从$4降至$2,输出从$20降至$10),在多个基准上却出现了“降价不降分”甚至“降价反超”的局面。但深入看...
API
作者小头像 GrayParis 2026-10-03 13:34:19
5
0
0
2026-10-03 13:34:19
5
0
0
Gemini 4.0 Argon vs Claude Opus 5.5 深度测评
跑分冠军与实战选手:Gemini 4.0 Argon vs Claude Opus 5.5 深度测评 核心结论先行Gemini 4 Argon在长周期软件工程和网络安全基准上取得了令人瞩目的领先,但内部员工反馈其实际编码表现与跑分存在落差;Claude Opus 5.5则以更均衡的实战表现和更低的综合任务成本,仍是当前最稳妥的生产力选择。 一、基准测试:Argon的“账面胜利” 长周期软件...
作者小头像 GrayParis 2026-10-02 11:17:37
8
0
0
2026-10-02 11:17:37
8
0
0
Gemini 4 Pro 评测
Gemini 4 Pro 评测:跳代旗舰的碾压姿态,与一次精心策划的“匿名钓鱼”2026年9月中旬,LMArena竞技场上悄然出现了一个名为“gemini-3.8-flash”的匿名模型。社区起初以为这只是Google对Gemini 3系列的一次常规微调——毕竟Gemini 3.8 Flash刚在9月初正式发布,同名模型再次出现极不寻常。但当全球开发者用极其刁钻的Prompt对其进行压力测...
开发者
作者小头像 GrayParis 2026-10-01 10:33:35
14
0
0
2026-10-01 10:33:35
14
0
0
GPT-6 Astra 评测
GPT-6 Astra 评测:执行型 Agent 的跃迁,与一次失控的落地2026年9月3日,OpenAI 发布 GPT-6 Astra,官方称之为“迄今最智能、对齐最好的模型”,总裁 Greg Brockman 在发布会上直言“欢迎来到 AGI 时代”。Astra 的叙事重心不在“回答得多好”,而在“活干得多完整”——它被定义为一款执行型 Agent,能够自主操作浏览器、办公软件和开发工...
作者小头像 GrayParis 2026-09-29 10:22:05
17
0
0
2026-09-29 10:22:05
17
0
0
Opus 5.5 评测
Opus 5.5 评测:Anthropic 的“经济适用型”旗舰,跑分登顶但账单暗藏玄机2026年9月22日,Anthropic 正式发布 Claude Opus 5.5,这是全新 Claude 5.5 家族的首款模型。发布时间点耐人寻味——就在三天前,路透社刚报道称随着 GPT-6 Astra 开始抢回企业市场,Anthropic 正考虑提前推出新模型应战。Opus 5.5 的定位非常清...
开发者
作者小头像 GrayParis 2026-09-28 10:54:33
18
0
0
2026-09-28 10:54:33
18
0
0
Step 5 Preview 评测
Step 5 Preview 评测:600B 参数打到 K3 级性能,但“便宜”的代价藏在细节里2026年9月20日,阶跃星辰发布新一代旗舰基座模型Step 5 Preview,直接跳过Step 4系列进入Step 5阶段。这是一款专为真实世界Agentic任务打造的模型,总参数量600B、激活参数仅27B,支持100万Token上下文窗口和原生视觉输入。在Artificial Analy...
机器学习
作者小头像 GrayParis 2026-09-21 00:31:17
80
0
0
2026-09-21 00:31:17
80
0
0
GLM-5.3-FlashX 评测
GLM-5.3-FlashX 评测:不换引擎的“涡轮增压”,值不值 2.5 倍差价?2026年9月18日,智谱正式推出GLM-5.3-FlashX。官方给这款产品的定位极其克制:基座模型一字未改,只改推理效率。它的前身GLM-5.3-Flash以“Ox Alpha”之名在OpenRouter上匿名测试时,曾6天处理超20万亿Tokens,双平台调用量登顶,上线首日即刷新平台单日Token用...
Flash
作者小头像 GrayParis 2026-09-19 11:14:58
121
0
0
2026-09-19 11:14:58
121
0
0
Qwen3.8-Max 评测
Qwen3.8-Max 评测:2.4 万亿参数的“长程 Agent 豪赌”2026年8月3日,阿里巴巴正式发布 Qwen3.8-Max,这是 Qwen 家族迄今规模最大的模型,也是 Qwen-Max 级别首次宣布开源权重。2.4 万亿总参数、950 亿激活参数、100 万 Token 上下文窗口——这些数字足以让它在发布时占据头条。但真正值得关注的,是这代 Max 把叙事重心从“参数规模”...
作者小头像 GrayParis 2026-09-18 09:36:20
85
0
0
2026-09-18 09:36:20
85
0
0
GLM-5.3-flash 评测
GLM-5.3-Flash 评测:18B 激活参数的“越级”与代价2026年8月26日晚,智谱正式上线并开源GLM-5.3-Flash(320B-A18B),这是GLM-5系列首个原生多模态模型。此前它以“Ox-Alpha”的匿名身份在OpenRouter上进行了数天测试,中文社区称之为“牛来”,上线首日即登顶调用量榜单,刷新了平台单日Token用量历史纪录。智谱在发布公告中写道:“同样智...
Flash
作者小头像 GrayParis 2026-09-17 10:00:59
168
0
0
2026-09-17 10:00:59
168
0
0
总条数:39
10
10
20
50
100
  • 1
  • 2
  • 3
  • 4

上滑加载中

https://www.baidu.com/s?ie=utf-8&f=3&rsv_bp=0&rsv_idx=1&tn=baidu&wd=sed%20%E6%9B%BF%E6%8D%A2%E5%AD%97%E7%AC%A6%E4%B8%B2&rsv_pq=c7db61a600035dc5&rsv_t=5e19yEsbV9N5fIvdlGRU
作者小头像
作者小头像
快速交付
+ 关注