作者小头像 Lv.7
更多个人资料
8806 成长值
30 关注
86 粉丝
+ 关注 私信

个人介绍

菠萝菠萝蜜,急急如律令

感兴趣或擅长的领域

自动化运维、人工智能、测试、网络技术
个人勋章
  • 活跃之星
  • 考证狂人
成长雷达
6200
1611
525
450
20

个人资料

个人介绍

菠萝菠萝蜜,急急如律令

感兴趣或擅长的领域

自动化运维、人工智能、测试、网络技术

达成规则

以上满足项可达成此勋章

  • 博客
  • 关注
  • 粉丝
  • 论坛
全部时间
全部时间
最近三天
最近一周
最近一月
  • 全部
  • MindSpore
  • CUDA
  • DeepSeek
  • 昇腾
  • DPDK
  • 监控观察
  • 网络基础
  • 流媒体
  • Firewall
  • 数据安全
  • IoT
  • 编程语言
  • 鸿蒙
  • 虚拟化
  • 鲲鹏
  • Linux
  • AI
  • 大数据-数仓
  • 网络安全
均分误差和损失函数
最近在回顾人工智能的基础知识,做一笔记。 均方误差看“均方误差”,先看“方”(Square) 就是指 (预测值 - 真实值) 这个差值的平方。目的是为了去掉正负号,并放大较大的误差。 (预测值 - 真实值)^2 是一个点的单独的计算。但统计学里,我们几乎从不只算一个数据点的误差。再看“均”(Mean) 只算一个样本点的平方误差,那叫“平方误差”(Square Error)。所有平方误差取平均...
机器学习
作者小头像 黄生 2026-07-08 14:09:57
38
0
0
2026-07-08 14:09:57
38
0
0
CUDA与AscendC对比(三)
__global__ 是一个函数类型限定符,它告诉编译器这个函数是一个核函数(Kernel) 既然如此,叫kernel不是更直观?厂商关键字平台NVIDIA (CUDA)__global__GPUAMD (ROCm/HIP)__kernel__GPUOpenCL (跨平台)__kernel各种加速器Ascend C (华为)__global__ __aicore__NPU __kernel_...
深度学习
作者小头像 黄生 2026-06-07 20:48:15
257
0
0
2026-06-07 20:48:15
257
0
0
CUDA与AscendC对比(二)
为什么CUDA当时要设计的现在看上去比较复杂?2006年CUDA刚诞生时,通用GPU编程还是个全新的领域。NVIDIA没有前人的经验可以参考,他们做的事情本质上是:把GPU这种原本只画图的专用硬件,硬生生改造成了通用并行处理器。当时的设计决策:直接暴露硬件特性(Warp、Shared Memory、寄存器)让程序员手动管理一切(线程调度、内存层级、同步)不做过多抽象(性能至上,灵活性第一)类...
任务调度 深度学习
作者小头像 黄生 2026-06-07 12:06:08
314
0
0
2026-06-07 12:06:08
314
0
0
CUDA与AscendC对比(一)
对于《NVIDIA CUDA编程实操一:环境检查与入门》的扩展。这一段cuda例子,global代表什么?我看AscendC里面也有这个?是否AscendC和CUDA很像呢? 另外helloFromGPU<<<1, 5>>>()这种调用方式也像。这里的1,5代表什么呢?但threadIdx.x是从0开始编号的__global__ 是一个函数类型限定符,它告诉编译器这个函数是一个核函数(Ker...
任务调度 深度学习
作者小头像 黄生 2026-06-07 11:14:41
289
0
0
2026-06-07 11:14:41
289
0
0
取整和内存对齐
算子开发里经常会看到这些类似的代码。向上取整uint32_t coreNum = (totalElements + ubFormer - 1) / ubFormer;向下取整// 直接整数除法(C++中整数除法自动向下取整)uint32_t coreNum = totalElements / ubFormer;示例对比,假设 totalElements = 10, ubFormer = 3:...
作者小头像 黄生 2026-05-17 21:47:53
361
0
0
2026-05-17 21:47:53
361
0
0
Skills 和 大模型
如果是同一个skill,那么采用不同的模型跑,会有区别吗?比如后端用deepseek,或用GLM,这2个后端模型的能力是有差别的,但skill是同一个,跑出的结果会有差别吗?其实,Skill 是“剧本”,模型是“演员”。 同一个剧本,不同水平的演员演出来的效果自然不同。Skill 本质上是一段包含多个步骤、约束条件、输入输出格式的复杂提示词。强模型:能准确理解 Skill 的每一步,比如“先...
API
作者小头像 黄生 2026-05-09 11:14:49
550
0
0
2026-05-09 11:14:49
550
0
0
glob宝刀不老
我们会在AI Agent使用的工具里和CMakeLists.txt中看到glob,它干的是一件事:根据通配符模式来查找文件或目录。可以理解成一个聪明的"文件搜索助手",你告诉它一个模糊的规则(比如"所有以.txt结尾的文件"),它就能帮你把电脑里所有符合这个规则的文件都找出来。它最早来自Unix系统,是"global"(全局)的缩写。它使用一些特殊的符号(通配符)来模糊匹配文件名,规则很简单...
Python
作者小头像 黄生 2026-05-07 19:13:05
438
0
0
2026-05-07 19:13:05
438
0
0
opencode简介
OpenCode 是一个 agent(代理)平台“OpenCode is an open-source AI coding agent that runs in your terminal, desktop, or IDE.” —— Linux Command LibraryRed Hat 的官方开发者文章也将其归类为 “agentic tools”(代理型工具),并称其为 “agentic...
作者小头像 黄生 2026-04-24 11:03:59
10441
0
0
2026-04-24 11:03:59
999+
0
0
triton_ascend入门学习三性能调优
以_layer_norm_fwd_fused算子为例msprof op --kernel-name=_layer_norm_fwd_fused python3 ./triton-ascend/third_party/ascend/tutorials/03-layer-norm.pyexport LD_LIBRARY_PATH=$ASCEND_TOOLKIT_HOME/tools/simula...
应用性能调优
作者小头像 黄生 2026-04-24 10:16:29
576
0
0
2026-04-24 10:16:29
576
0
0
CANNBot简介
CANNBot是基于AI Agent构建的一系列智能体,可兼容各类大模型(当然建议你用最强的)和Agent框架。用来自动开发算子的。仓库提供的是skills模块。三层架构:交互例子:帮我开发一个abs算子,支持float16数据类型,shape主要是[1,128]、[4,2048]、[32,4096]读取 requirement.md,根据需求开发自定义算子帮我开发一个 softmax 算子...
API
作者小头像 黄生 2026-04-23 20:31:20
1164
2
0
2026-04-23 20:31:20
999+
2
0
总条数:395
10
10
20
50
100
  • 1
  • 2
  • 3
  • 4
  • 5
  • 6
  • ...
  • 40

上滑加载中

https://www.baidu.com/s?ie=utf-8&f=3&rsv_bp=0&rsv_idx=1&tn=baidu&wd=sed%20%E6%9B%BF%E6%8D%A2%E5%AD%97%E7%AC%A6%E4%B8%B2&rsv_pq=c7db61a600035dc5&rsv_t=5e19yEsbV9N5fIvdlGRU
作者小头像
作者小头像
快速交付
+ 关注