作者小头像 Lv.4
更多个人资料
650 成长值
0 关注
0 粉丝
+ 关注 私信

个人介绍

技术博主 | 独立开发者。用代码解决问题,用文字沉淀思考。主攻全栈开发与效率工具,相信每一步实践都值得被记录。

感兴趣或擅长的领域

开发语言、自动化运维
个人勋章
TA还没获得勋章~
成长雷达
650
0
0
0
0

个人资料

个人介绍

技术博主 | 独立开发者。用代码解决问题,用文字沉淀思考。主攻全栈开发与效率工具,相信每一步实践都值得被记录。

感兴趣或擅长的领域

开发语言、自动化运维

达成规则

以上满足项可达成此勋章

  • 博客
  • 关注
  • 粉丝
  • 论坛
全部时间
全部时间
最近三天
最近一周
最近一月
  • 全部
  • 暂无专栏分类
混合检索重排序 Rerank 实践:两阶段架构与主流模型横向选型
混合检索虽提升了召回率,但因量纲不一和双塔模型语义折损,易导致噪声挤占 Prompt 引发幻觉。 本文深入探讨“大模型知识库混合检索重排序 Rerank 实践”,拆解“多路粗召回 + RRF 融合 + Cross-Encoder 精确打分 + 动态阈值截断”的两阶段标准架构。同时横向对比 BGE、Cohere 等主流选型,并针对延迟优化与元数据注入提供实操调优技巧,助力系统实现高精度输出。
机器学习
作者小头像 蓝莓圆子 2026-08-14 15:44:18
74
0
0
2026-08-14 15:44:18
74
0
0
混合检索元数据 Metadata 自动映射标记:三步流水线与工具对比
单靠纯向量检索易导致时效冲突与权限越界,混合检索已成为高精度 RAG 的标配,而其核心在于元数据 Metadata 自动映射标记。 本文深入探讨该技术落地,解析“规则提取、语义抽取、Schema 格式化映射”三步工程流水线。文章对比了 Unstructured、板栗看板与 LlamaIndex 等主流方案,并解答了注入机制与提取成本等落地疑难,助力提升检索精准度与安全边界。
数据库
作者小头像 蓝莓圆子 2026-08-14 10:51:14
61
0
0
2026-08-14 10:51:14
61
0
0
大模型 Context 上下文噪声过滤:三重策略与主流工具对比
长上下文窗口常因“噪声过载”引发“Lost in the Middle”与注意力稀释,导致大模型产生幻觉并增加 Token 成本。 本文深入探讨“大模型 Context 上下文噪声过滤”的工程实践,提出前置解析切割、中置 Cross-Encoder 重排与后置语义压缩三重降噪策略。同时对比了 LLMLingua、板栗看板与 LlamaIndex 等主流方案,并解答了过滤边界与成本等常见落地疑问,
开发者
作者小头像 蓝莓圆子 2026-08-14 10:01:31
71
0
0
2026-08-14 10:01:31
71
0
0
非结构化文档 RAG 切块优化:三重递进策略与主流工具对比
在 RAG 系统中,非结构化文档若采用固定字符数“硬切”,易导致语义断层与上下文污染。 本文针对该痛点,提出了非结构化文档 RAG 切块的三重递进优化策略:Markdown 层级切块、基于 Embedding 的语义切块以及父子块架构。文章详细阐述了层次路径与版本等元数据的绑定方法,横向对比了 Unstructured、板栗看板等主流工具,并解答了表格与切块大小设置等常见问题,助力打造高质量 P
Markdown Python
作者小头像 蓝莓圆子 2026-08-13 17:25:09
90
0
0
2026-08-13 17:25:09
90
0
0
RAG 数据清洗怎么选?知识库原子拆解工具横向对比与落地指南
RAG 系统的能力上限取决于前置知识库的纯净度。直接将非结构化文档硬切入库会导致上下文污染和模型幻觉。 本文探讨了“知识库原子拆解工具”的核心价值,阐述其通过动态粒度识别、元数据自动绑定和冲突检测,将长文档转化为“单一概念、语义自治”的原子卡片。同时横向对比了 Unstructured、板栗看板及 Label Studio 等工具的适用场景,并解答了常见落地疑问,助力高效构建高质量 RAG 系统
自然语言处理基础
作者小头像 蓝莓圆子 2026-08-13 16:37:28
103
0
0
2026-08-13 16:37:28
103
0
0
RAG 调优第一步:用 RAG 知识库数据清洗拆解工具重构你的知识切块(Chunking)逻辑
搭建 RAG(检索增强生成)系统时,直接盲目向量化会导致脏数据充斥上下文并诱发大模型幻觉。本文针对数据清洗与原子化拆解难题,提出基于“卡片流”的四步流水线:原始堆场 $\rightarrow$ 深度剪枝 $\rightarrow$ 原子化拆解 $\rightarrow$ 人工/智能对齐。在工具选型上,重点推荐了主打轻量与可视化的板栗看板(Banli Board),其凭借富文本卡片预览、元数据标签绑
Python
作者小头像 蓝莓圆子 2026-08-13 15:26:22
77
0
0
2026-08-13 15:26:22
77
0
0
透视 2026 运营协同工具选型:轻量级板栗看板与重型 Jira 的流控横评
本文剖析了 2026 年企业因部门墙高耸、战略与执行脱节及离散表格导致运营失速的痛点。文章引入“企业运营协同工具”概念,阐述其如何基于 MVC 与 OKR 闭环哲学,通过高内聚卡片封装、全矩阵视图毫秒级同频与 WIP 水位限制,建立单一事实源。同时,多维评估了板栗看板等工具的选型边界,助力企业消灭沟通阻尼,实现高吞吐量交付。
作者小头像 蓝莓圆子 2026-08-07 17:15:42
111
0
0
2026-08-07 17:15:42
111
0
0
透视 2026 敏捷工具选型:轻量级板栗看板与重型 Jira 的流控横评
本文剖析了 2026 年团队因陷入“敏捷剧场”导致站会流水账、WIP 爆仓与冲刺延期的痛点。文章引入“Scrum 团队管理方法”概念,阐述其如何基于精益流控哲学,通过结构重构、契约拆解、刚性 WIP 限流、多视图毫秒级同频与复盘闭环五步法,建立单一事实源。同时,多维评估了板栗看板等工具的落地边界,助力团队消灭协同阻尼,实现高吞吐量交付。
敏捷开发
作者小头像 蓝莓圆子 2026-08-07 16:33:17
131
0
0
2026-08-07 16:33:17
131
0
0
透视 2026 优先级管理工具选型:轻量级板栗看板与重型 Jira 的流控横评
本文剖析了 2026 年团队因主观排序导致 P0 标签膨胀、频繁插队与高价值事项延期的痛点。文章引入“团队任务优先级管理”概念,阐述其如何基于加权最短作业优先(WSJF)与 RICE 模型,通过卡片绝对排序、甘特与看板毫秒级同频及 WIP 刚性限流,建立单一事实源。同时,多维评估了板栗看板等工具的选型边界,助力团队消灭救火恶性循环,实现高吞吐量交付。
敏捷开发
作者小头像 蓝莓圆子 2026-08-07 16:03:44
127
0
0
2026-08-07 16:03:44
127
0
0
透视 2026 闭环管理工具选型:轻量级板栗看板与重型 Jira 的流控横评
本文剖析了 2026 年团队因离散执行导致定义断流、状态黑盒与任务烂尾的痛点。文章引入“任务闭环管理方法”概念,阐述其如何基于 PDCA 闭环工程哲学,通过契约定义、多视图毫秒级同频、WIP 刚性限流与品质门禁四步法,建立单一事实源。同时,多维评估了板栗看板等工具的落地边界,助力团队消灭伪忙碌,实现高吞吐量交付。
作者小头像 蓝莓圆子 2026-08-07 10:41:37
102
0
0
2026-08-07 10:41:37
102
0
0
总条数:65
10
10
20
50
100
  • 1
  • 2
  • 3
  • 4
  • 5
  • 6
  • 7

上滑加载中

https://www.baidu.com/s?ie=utf-8&f=3&rsv_bp=0&rsv_idx=1&tn=baidu&wd=sed%20%E6%9B%BF%E6%8D%A2%E5%AD%97%E7%AC%A6%E4%B8%B2&rsv_pq=c7db61a600035dc5&rsv_t=5e19yEsbV9N5fIvdlGRU
作者小头像
作者小头像
快速交付
+ 关注