作者小头像 Lv.7
更多个人资料
6920 成长值
0 关注
16 粉丝
+ 关注 私信

个人介绍

这个人很懒,什么都没有留下

感兴趣或擅长的领域

开发语言、人工智能、测试
个人勋章
TA还没获得勋章~
成长雷达
6920
0
0
0
0

个人资料

个人介绍

这个人很懒,什么都没有留下

感兴趣或擅长的领域

开发语言、人工智能、测试

达成规则

以上满足项可达成此勋章

  • 博客
  • 关注
  • 粉丝
  • 论坛
全部时间
全部时间
最近三天
最近一周
最近一月
  • 全部
  • 暂无专栏分类
RAG 不一定需要大模型重排:Jev 能不能做 Context Filtering?
摘要:做 RAG 时,一个很常见的问题是:检索能召回很多内容,但真正应该塞进 LLM 的,其实只有少数几条。传统方案会用 Embedding 阈值、Cross-Encoder Reranker,或者再调用一次 LLM 做筛选。Jev 出现以后,又多了一种值得研究的思路:检索负责“尽量找全”,Jev 负责“哪些值得留下”,LLM 最后只处理真正相关的 Context。一、RAG 的问题,很多时...
作者小头像 霍格沃兹测试开发 2026-09-22 16:53:36
6
0
0
2026-09-22 16:53:36
6
0
0
Tool、MCP、Skill 越来越多,Jev 能解决 Agent 路由吗?
摘要:Agent 能力越来越多以后,一个很现实的问题开始出现:到底该调用哪个 Tool、加载哪个 Skill、连接哪个 MCP?5 个工具时,让 LLM 自己选可能没什么问题。但当能力数量变成 50 个、100 个甚至更多,路由本身就开始成为 Agent Harness 的核心问题。而 Jev 这类 Decision Model,正在尝试接管其中一部分工作。一、Agent 的问题,开始从“没...
NAT 自动化测试
作者小头像 霍格沃兹测试开发 2026-09-22 16:43:02
6
0
0
2026-09-22 16:43:02
6
0
0
Jev 进入 Agent Guardrail:高风险 Tool Call 该怎么测?
摘要:Agent 能力越来越强以后,一个新的测试问题开始出现:模型会调用工具还不够,还要保证它不会在错误的时候调用危险工具。删除文件、执行 Shell、修改数据库、发送邮件、操作生产环境……当 Tool Call 开始真正影响外部系统,Guardrail 就不再只是一个“安全功能”,而是必须被系统测试的一条关键链路。而 Jev 最近进入 LangChain Agent Harness,也让这...
数据库
作者小头像 霍格沃兹测试开发 2026-09-22 16:21:43
7
0
0
2026-09-22 16:21:43
7
0
0
输入校验写了assert,为什么换个启动参数就失效了?
有一段Python代码,用来检查购买数量必须在1到99之间。# bad_quantity.py:故意保留问题的教学版本import sysquantity = int(sys.argv[1])assert 1 <= quantity <= 99, "数量超出范围"print(f"接受数量:{quantity}")运行python bad_quantity.py -1,程序报错。看起来,负数已...
Python
作者小头像 霍格沃兹测试开发 2026-09-20 16:50:47
27
0
0
2026-09-20 16:50:47
27
0
0
找重复数字,用set就结束了?这道校招题还能追问三层
先看这组数:7、3、7、3、7。如果题目说“找出重复数字”,你会返回什么?7和3?每个数各出现几次?还是所有重复出现的位置?这几种答案都可能符合某一种需求,但它们不是同一个函数。用一道模拟面试题往下拆,最值得展示的第一项能力,就是在动手写代码前,把“重复”的输出定义问清楚。第一层:你求的是重复的值,还是重复的次数对刚才的输入,几个结果分别是:要回答的问题本例结果哪些值出现超过一次7、3每个重...
作者小头像 霍格沃兹测试开发 2026-09-20 16:32:41
28
0
0
2026-09-20 16:32:41
28
0
0
我用 AI 把 Swagger 变成 500 条 pytest 用例,回归从 3 天到 3 小时
上个月我把订单中台的回归测试从 Postman 里拽了出来。之前 87 个接口,每次发版前手工点,3 天起步,点到后面人都麻了。现在 CI 上跑 500 多条 pytest,全量回归 3 小时出头,MR 只跑 smoke 的话 20 分钟。核心不是哪个神器,而是把 Swagger 当成数据源,让 AI 补测试场景,再让 pytest 去干重复劳动。下面是我实际落地的过程,代码是删减过的,但骨...
Python
作者小头像 霍格沃兹测试开发 2026-09-20 16:21:52
27
0
0
2026-09-20 16:21:52
27
0
0
DeepSeek Harness爆火,测试人能拿它做什么?这5个场景最实用
不是让你换个搜索引擎,是让你的重复劳动少一半大家好,我是某互联网公司的测试架构师。上个月,团队里一个做了3年功能测试的同事找我聊天,说了一句让我印象很深的话:“DeepSeek我天天在用,但我就是拿它当搜索引擎,问问概念、查查报错。看别人说能做自动化、能生成用例,我完全不知道从哪下手。”我说:“你不是有库存管理API的接口文档吗?打开终端,我给你演示一下。”20分钟后,他面前跑着一份覆盖等价...
API
作者小头像 霍格沃兹测试开发 2026-09-18 17:37:21
54
0
0
2026-09-18 17:37:21
54
0
0
开源智能测试平台分几层:数据采集、用例编排到质量归因选型地图
一家 200 人规模的研发团队,决定自建「AI 时代的测试平台」。leader 把测试架构师叫过去,给了两周:出一份选型建议。架构师打开浏览器一搜,用例管理有一堆、执行调度有一堆、数据工厂有一堆、评测编排又有一堆,每个都号称「一站式」「智能化」,README 里的 star 数一个比一个高。两周后交上去的报告,很可能是一份「工具名气排行榜」:哪个火就选哪个,拼在一起就叫平台。这是自建测试平台...
作者小头像 霍格沃兹测试开发 2026-09-17 16:43:47
60
0
0
2026-09-17 16:43:47
60
0
0
我用ChatGPT把回归测试从3天压到3小时,提示词全公开
先说结论:不是标题党。上个月我们发版前最后一次回归,从早上9点干到晚上11点,三个人轮着点,点到后面眼睛都花了。结果还是漏了一个优惠券叠加的边界场景,上线第二天客服就炸了。那天晚上我就在想,这破事儿能不能让ChatGPT干。试了两周,现在回归测试基本3小时收工。不是全自动,但至少不用人肉当点读机了。下面直接把我的用法和提示词全倒出来,能不能复用你们自己判断。先说说我们之前的蠢办法项目是电商后...
自动化测试
作者小头像 霍格沃兹测试开发 2026-09-17 16:15:20
53
0
0
2026-09-17 16:15:20
53
0
0
磁盘明明还有空间,测试报告为什么就是写不进去?
回归跑完了,最后一步生成报告却失败了。日志提示 No space left on device。你打开容量监控:磁盘还有空间。重新执行,仍然写不进去。于是开始怀疑报告插件,甚至怀疑刚接入的 AI 分析模块是不是生成了异常内容。先停一下:“还能存多少字节”和“还能创建多少文件”,不是同一个问题。测试平台尤其容易踩到这条边界。每条用例产生 JSON、截图、日志、附件索引,单个文件不大,数量却可能...
Node.js
作者小头像 霍格沃兹测试开发 2026-09-17 15:57:49
62
0
0
2026-09-17 15:57:49
62
0
0
总条数:1011
10
10
20
50
100
  • 1
  • 2
  • 3
  • 4
  • 5
  • 6
  • ...
  • 102

上滑加载中

https://www.baidu.com/s?ie=utf-8&f=3&rsv_bp=0&rsv_idx=1&tn=baidu&wd=sed%20%E6%9B%BF%E6%8D%A2%E5%AD%97%E7%AC%A6%E4%B8%B2&rsv_pq=c7db61a600035dc5&rsv_t=5e19yEsbV9N5fIvdlGRU
作者小头像
作者小头像
快速交付
+ 关注