作者小头像 Lv.3
更多个人资料
235 成长值
0 关注
0 粉丝
+ 关注 私信

个人介绍

这个人很懒,什么都没有留下

感兴趣或擅长的领域

暂无数据
个人勋章
TA还没获得勋章~
成长雷达
125
15
50
45
0

个人资料

个人介绍

这个人很懒,什么都没有留下

感兴趣或擅长的领域

暂无数据

达成规则

以上满足项可达成此勋章

  • 博客
  • 关注
  • 粉丝
  • 论坛
全部时间
全部时间
最近三天
最近一周
最近一月
  • 全部
  • Agent结构化输出实践
【编译】IBM Granite 4.1 全栈架构解析:15T Token 渐进退火与 512K 长上下文演进
IBM 正式开源 Granite 4.1 系列 Dense 架构语言模型(3B、8B、30B),基于 Apache 2.0 协议发布。本文深入剖析其约 15T Token 的五阶段预训练体系、LLM-as-Judge 监督微调流程,以及融合 DAPO 损失的 GRPO 在线强化学习算法,展示 Dense 架构如何实现对 MoE 模型的性能跨越。
深度学习
作者小头像 L2 2026-10-06 04:28:05
5
0
0
2026-10-06 04:28:05
5
0
0
【编译】NPHardEval基准评测体系:基于计算复杂性与动态更新解构大语言模型逻辑推理上限
传统LLM推理评测常受数据污染与数值计算干扰。NPHardEval由密歇根大学与罗格斯大学联合构建,基于计算复杂性理论(P、NP-complete、NP-hard)建立分级评估体系。该框架摒弃纯数值计算,通过月度自动合成动态数据防范过拟合,并引入加权准确率与失败率两大指标,为定量评估模型真实逻辑推理能力提供了高置信度基准。
深度学习
作者小头像 L2 2026-10-05 05:00:26
6
0
0
2026-10-05 05:00:26
6
0
0
【编译】Zen5 架构加持:AMD 第五代 EPYC Turin 处理器实现 LLaMA 3.1 推理吞吐翻倍
本文深度解析 AMD 基于 Zen5 架构的第五代 EPYC 处理器(Turin)在大模型推理场景下的架构演进与性能突破。Hugging Face 联合 AMD,基于 ZenDNN 深度学习加速插件与 torch.compile 图编译技术,在 LLaMA 3.1 8B 模型的多实例基准测试中,实现了相比前代 Genoa 处理器近 2 倍的 Decode 吞吐量提升。
深度学习
作者小头像 L2 2026-10-04 05:00:56
11
0
0
2026-10-04 05:00:56
11
0
0
【编译】开源文本生成与大语言模型生态:Hugging Face的LLM全栈技术体系解析
本文深度剖析 Hugging Face 生态体系下的开源大语言模型(LLM)与文本生成全栈架构。文章系统梳理因果语言模型与对齐机制,对比主流开源基座模型演进,并详细解析参数高效微调(PEFT)与生产级高并发推理引擎 Text Generation Inference(TGI)的核心原理与工程实践。
人工智能 深度学习 算法
作者小头像 L2 2026-10-03 12:39:58
11
0
0
2026-10-03 12:39:58
11
0
0
现代系统级并发:Rust 异步运行时 Tokio 任务调度原理解析
Rust 的无畏并发结合 async/await 提供了极高的性能与内存安全。本文深入剖析 Tokio 异步运行时中的多线程工作窃取(Work-Stealing)调度器与零成本 Future 状态机。
Rust 后端
作者小头像 L2 2026-10-02 00:43:38
16
0
0
2026-10-02 00:43:38
16
0
0
【编译】深度解析 PatchTST:基于补丁化与通道独立的时序 Transformer 预测与迁移学习实战
本文深度解析 ICLR 2023 顶会成果 PatchTST 的架构机理与工程实践。文章围绕通道独立性(Channel Independence)与时间步分块(Patching)两大核心设计展开,全面演示如何基于 Hugging Face 生态完成从电力数据集(Electricity)的模型训练,到变压器温升场景(ETTh1)的零样本预测、线性探测及全量微调迁移学习流程。
深度学习
作者小头像 L2 2026-10-01 06:38:44
22
0
0
2026-10-01 06:38:44
22
0
0
OpenAI Triton 算子融合与 GPU 内存局部性优化实践
在深度学习模型训练与推理中,内存带宽往往是比计算峰值更大的瓶颈。本文系统剖析 OpenAI Triton 编译器的算子融合机理,以及如何通过 SRAM 局部性优化消除显存往返开销。
pytorch 深度学习
作者小头像 L2 2026-09-30 02:17:09
33
1
0
2026-09-30 02:17:09
33
1
0
云原生可观测性演进:基于 eBPF 的无侵入式网络与微服务追踪
传统微服务链路追踪面临侵入式埋点成本高、多语言栈维护难的问题。本文剖析 eBPF 技术在 Linux 内核层捕获网络套接字与系统调用的底层机理,实现零修改的全链路可观测性。
Linux 云原生 微服务 网络
作者小头像 L2 2026-09-29 00:50:44
338
0
0
2026-09-29 00:50:44
338
0
0
大模型 Agent 架构设计:Tool Use 容错与状态机管理最佳实践
构建生产级 Agent 智能体系统需要应对工具调用的非确定性与多轮状态漂移。本文深入探讨工具调用容错、结构化输出对齐以及基于有限状态机(FSM)的工业级调度范式。
人工智能 智能体 软件架构
作者小头像 L2 2026-09-28 00:49:11
44
0
0
2026-09-28 00:49:11
44
0
0
大模型推理加速:PagedAttention 与连续批处理原理解析
在 Transformer 自回归生成中,KV Cache 是限制并发吞吐的核心瓶颈。本文系统解析 vLLM 借鉴操作系统虚拟分页实现的 PagedAttention 机制,以及动态请求调度的 Continuous Batching 架构。
人工智能 深度学习
作者小头像 L2 2026-09-27 00:49:35
41
0
0
2026-09-27 00:49:35
41
0
0
总条数:12
10
10
20
50
100
  • 1
  • 2

上滑加载中

https://www.baidu.com/s?ie=utf-8&f=3&rsv_bp=0&rsv_idx=1&tn=baidu&wd=sed%20%E6%9B%BF%E6%8D%A2%E5%AD%97%E7%AC%A6%E4%B8%B2&rsv_pq=c7db61a600035dc5&rsv_t=5e19yEsbV9N5fIvdlGRU
作者小头像
作者小头像
快速交付
+ 关注