『效率提升 2 倍』写进质量报告之前,先立三条口径规矩
周报里那行『测试效率提升 3 倍』,在会上被总监问了一句:分子是什么,分母是什么?办公室安静了下来。写这行的人并不心虚——他是真觉得,用 AI 辅助之后,写用例的手感快了。但总监问的不是手感,是测量口径。效率倍数这种东西,进质量报告的那一刻起,规矩就只有一条:数字本身不值钱,口径才是全部。
这个话题最近又被推了一把:据媒体报道,今年服贸会期间公布的『2026 AI+软件「银弹」优秀实践』名单(CCSA TC602 主办、中国信通院承办)里,有入选方案公布了一组效率数字——据媒体报道、厂商口径:用例设计效率约 2 倍、人效约 2.6 倍、脚本固化平均约 8 分钟一条。这些数字能不能在你的环境里复现,是工程验收的事;而对天天写质量报告的人来说,更直接的问题是:这样的数字要进报告了,怎么写才算没写错。三条口径规矩,管外引,也管你自家周报里的『美化』。
一、规矩一:分子分母先于结论——你到底在说哪种『倍』
结论:同样是『效率提升一倍』,至少存在三种倍法,口径不同,指向完全不同的决策。
日历时间的倍:一个需求从评审到可发布,七天缩到三天半——业务方感知最强,但它掺着等环境、等联调、等审批;人时的倍:五人天做到两人半——团队内部算得清,但它可能只是把等待悄悄挪给了别人;产出件数的倍:人均每周产出用例从 200 条到 400 条——最响亮,也最容易注水,单位一松动数字直接翻倍:一条用例算一条,还是一个步骤算一条?一个断言算一条,还是一整个文件算一条?
所以规矩一执行起来最机械:报告里每个倍数,后面必须紧跟一行口径注——『分子是X,分母是Y,统计窗口Z』。就一行字,它是报告的氧气面罩:开场那行『提升 3 倍』被问倒,不是因为数字造假,而是因为在场三个人各自脑补了三种『3 倍』,却没有任何一种落在纸上经得起追问。
还有一种最常被顺手带过的口径注水:统计窗口不定起止。『翻倍』可能是工具磨合三个月后的稳态值,也可能是上手两周的蜜月峰值;窗口一含糊,同一个流程能被讲出两种命运。口径注里『窗口』两个字不是摆设:从哪天起、到哪天止、排除项(插单日、大促日)去哪了,三个点都要能指着出处。
二、规矩二:基线先行——没有改造前的测量,倍数只是修辞
结论:任何一句『提效 X%』,只要给不出改造前的基线,就还不配进结论区。而基线的成本,远比想象的低。
最低成本的做法:抽 5 个近期需求,从需求单系统、代码提交记录、用例管理平台里回溯它们本来的排期和工时——全是已有数据,不用新增任何填报流程,一个下午能出一版;注明统计窗口和缺项(哪个需求中途插队过,就诚实写出来),这份基线就能用了。锚回你的老本行:性能测试为什么要长期保存基线曲线?因为『没变慢』和『变快了』是两个命题,只有对照才能同时证。效率改造本质上是同一个命题——『AI 辅助让写用例快了』,它就应得一份和性能基线同等级的对待。
这条规矩真正防的,是内部版的美化。『本迭代 AI 辅助省下 20 人时』这句话,写了基线和分子分母,就是一条可以拿去推经验的好结论;没写,就是一颗会被追溯的雷——等到复盘那天没人认这个数,你的报告是整体打折的,打折的不止这一行。
回溯基线也有两个坑值得提前点名。一是取样偏甜:抽的 5 个需求全是顺风小需求,基线被调得格外『干净』,之后怎么改造都像进步——跨两个迭代取,宁可留一个带插单返工的在里面。二是单位偷换:改造前按人时算、改造后按日历日算,两行数字各自诚实,相减出来的倍数全是谎。基线法的价值不在精确,在于它可被复核:换一个人按同样的回溯路径,应该能算出同一组数。
三、规矩三:自报数字限口径、分行呈现、永不合并平均
结论:引用外部效率宣称,三个动作的目的只有一个——让读者永远分得清『别人说的』和『你测的』。
第一,口径限定写死:『据厂商口径』『据媒体报道』这几个字,摘要里不许省、转发里不许掉。数字是会漂的,一条结论抄三站之后,剩的一定是最好看的部分;把限定词焊死在数字旁边,是引用方的职业义务。第二,分行呈现:厂商的 2.6 倍和你自己的 18%,各占一行、各标来源,视觉上并排放,逻辑上永不混。第三,不做合并平均:这是三条里最锋利的一条——把厂商口径和自家实测加权成一个『综合提效翻倍』,等于拿自己的签名给别人的宣称做了担保;合并一次被看穿,之后你报告里所有诚实的实测数字,都会被连带地问一句『这个又是和谁平均出来的』。
| 口径规矩 | 违反时的报告症状 | 修正动作示例 |
|---|---|---|
| 分子分母先于结论 | 『提效3倍』孤零零一行,与会者各信各的、会后各算各的 | 每个倍数紧跟一行:分子X/分母Y/统计窗口Z |
| 基线先行 | 倍数直接写进结论区,被追问时只能回答『大家感觉快了』 | 抽5个近期需求回溯排期与工时建基线,一个下午,缺项如实标注 |
| 自报限口径、分行、不合并 | 外部宣称与自家实测混排同一段落,读者误以为同一来源 | 两行并列各标来源;拒绝产出『综合提效』类合并数,无论谁要求 |
两行呈现长什么样,给个可直接抄进模板的样子。第一行:『本期用例设计人时较上期下降约 18%(分子分母均为人时,窗口为本期 7 个需求,基线见附录)』——自家实测,口径齐全。第二行:『另,据媒体报道,某入选方案厂商口径称用例设计效率约 2 倍,与本行测量不可比。』『不可比』三个字是这两行的灵魂:它挡掉的不是引用,是读者的眼睛自动在两行之间做乘法的那一下。
四、口径纪律靠模板,不靠自觉
结论:三条规矩若指望每个写报告的人每次都想起来,等于没有;把它们做成模板里的必填字段,缺口径的数字就进不了报告。
落地的最后一步是动模板:效率倍数所在的段落,配一个必填的『分子/分母/统计窗口』栏位和一个必填的基线链接位;外部引用数字只给一个以『据……口径』开头的专用行,模板不提供任何允许内外混排成同一句的格子。规则一旦从『记得写』变成『不填交不了』,它就不再考验人的自觉——美化数字的冲动还在,只是它得先过字段校验这一关。校验,就是公信力的全部守门动作。
五、报告的公信力,来自口径纪律而不是数字漂亮
结论:三条规矩看起来是防别人的,其实主要是防自己——防那个为了数字好看而省略口径的冲动。
『银弹』评选让效率数字第一次大规模站上了公开舞台,热点会过去,但数字背后的口径问题会永远留在每一份报告里。读者对一份报告的信任,从来不是被某一行漂亮数字建立起来的,而是被长年累月每一行都老老实实标了口径的普通数字建立的。那一句『据厂商口径』看起来像在削弱说服力,其实它是给数字装的保险丝:熔断器保的不是别人的热度,是你这份报告三年之后还经得起引用。
报告里每一个裸奔的倍数,都是给未来同事挖的口径坑。
- 点赞
- 收藏
- 关注作者
评论(0)