作者小头像 Lv.2
更多个人资料
128 成长值
1 关注
1 粉丝
+ 关注 私信

个人介绍

涉足算法、GPU计算、光学探测及电路设计等多个方向,具备跨领域工程经验,能够从底层硬件到上层算法进行整体把握。

感兴趣或擅长的领域

嵌入式、人工智能
个人勋章
TA还没获得勋章~
成长雷达
80
48
0
0
0

个人资料

个人介绍

涉足算法、GPU计算、光学探测及电路设计等多个方向,具备跨领域工程经验,能够从底层硬件到上层算法进行整体把握。

感兴趣或擅长的领域

嵌入式、人工智能

达成规则

以上满足项可达成此勋章

  • 博客
  • 关注
  • 粉丝
  • 论坛
全部时间
全部时间
最近三天
最近一周
最近一月
  • 全部
  • CUDA编程
CUDA 编程指南 第6章:矩阵乘法的示例
6.1 概述计算两个维度分别为 (wA, hA) 和 (wB, wA) 的矩阵 A 和 B 的乘积 C 的任务,以下列方式分为多个线程:每个线程负责计算 C 的一个平方子矩阵 C_sub块内的每个线程负责计算 C_sub 的一个元素选择 C_sub 的维度 block_size 等于 16,以便:每块的线程数是 warp 大小的倍数(参见 5.2)保持低于每块的最大线程数(参见附录 A)[...
任务调度
作者小头像 叫我小刘就好了 2026-06-04 15:23:31
601
1
1
2026-06-04 15:23:31
601
1
1
CUDA 编程指南 第5章:性能指南
CUDA 编程指南 第5章:性能指南 5.1 指令性能要处理一个 warp 的线程的指令,多处理器必须:(1) 读取 warp 的每个线程的指令操作数(2) 执行指令(3) 写入 warp 的每个线程的结果因此,有效的指令吞吐量取决于名义指令吞吐量以及内存延迟和带宽。它通过下列方式最大化:最小化具有低吞吐量的指令的使用(参见 5.1.1)最大化每种内存的可用内存带宽(参见 5.1.2)允许线...
任务调度
作者小头像 叫我小刘就好了 2026-06-04 15:19:22
582
1
1
2026-06-04 15:19:22
582
1
1
第4章:应用编程接口
CUDA 编程指南 第4章:应用编程接口本文整理自 NVIDIA《CUDA Programming Guide Version 1.1》第4章,系统介绍 CUDA 的编程接口,包括 C 语言扩展、Runtime 组件、以及 Driver API 的使用方式。 4.1 C 编程语言扩展CUDA 编程接口的目标是为熟悉 C 语言的开发者提供简单的路径来编写设备端程序。它包括:组件说明语言扩展(...
API 任务调度
作者小头像 叫我小刘就好了 2026-06-04 15:06:59
568
1
1
2026-06-04 15:06:59
568
1
1
硬件实现
第3章 硬件实现 3.1 具有芯片共享内存的一组SIMD多处理器设备作为一组多处理器(multiprocessors)来实现,如图3-1所示。每个多处理器具有单指令多数据(SIMD)架构:在任何给定的时钟周期,多处理器的每个处理器执行相同的指令,但操作在不同的数据上。每个多处理器具有下列四种类型的芯片内存储器:每个处理器有一组本地32位寄存器并行数据高速缓存或称为共享内存(shared m...
任务调度
作者小头像 叫我小刘就好了 2026-05-29 16:37:23
555
1
1
2026-05-29 16:37:23
555
1
1
编程模型
第2章 编程模型 2.1 概述(本章节原文未提供具体内容,请根据实际补充) 2.2 线程分批与协作 2.2.1 高度多线程协处理器通过CUDA编程时,将GPU看作可以并行执行非常多个线程的计算设备(compute device)。它作为主CPU的协处理器或者主机(host)来运作:换句话说,在主机上运行的应用程序中,数据并行的、计算密集的部分卸载到此设备上。更准确地说,多次但在不同数据上独...
任务调度
作者小头像 叫我小刘就好了 2026-05-29 16:26:34
606
1
1
2026-05-29 16:26:34
606
1
1
CUDA简介
GPU作为数据并行计算设备的图像处理器单元仅仅几年的时间,可编程图像处理器单元已经发展成为绝对的计算主力,如图1-1所示。由于具有由高内存带宽驱动的多个核心,今天的GPU为图像和非图像处理提供了难以置信的资源。图1-1. CPU 和 GPU 的每秒浮点运算数发展背后的主要原因是GPU是特定于计算密集的、高并行的计算,而这正是图像渲染所需要的,因此GPU设计了更多的晶体管专用于数据处理,而非...
作者小头像 叫我小刘就好了 2026-05-28 20:16:39
592
0
1
2026-05-28 20:16:39
592
0
1
NVIDIA 首款智能体专用 CPU
Vera 正式登场:NVIDIA 首款智能体专用 CPU,开启代理式 AI 新时代2026年5月,NVIDIA 超大规模与高性能计算副总裁 Ian Buck 亲自带队,将首批 NVIDIA Vera CPU 系统交付给 Anthropic、OpenAI、SpaceXAI 和 Oracle Cloud Infrastructure (OCI) 四大顶级 AI 实验室,标志着这款专为代理式 A...
作者小头像 叫我小刘就好了 2026-05-28 18:33:17
891
0
1
2026-05-28 18:33:17
891
0
1
一篇简单的生物视觉概述
生物视觉的神经网络密码:从光子到意识,AI能学到什么?一篇综述论文,带你读懂大脑视觉的“四层漏斗”和AI的未来方向 写在前面你有没有想过一个问题:人眼每秒接收约10亿比特的光子信息,但你有意识感知到的,只有大约10比特。中间差了8个数量级。那些信息去哪了?大脑是怎么做到的?更重要的是——AI能不能学学这个?最近读了一篇北大团队的综述论文《生物视觉系统的神经网络编码模型综述》(郑雅菁、余肇飞...
作者小头像 叫我小刘就好了 2026-05-28 05:05:39
615
1
1
2026-05-28 05:05:39
615
1
1
https://www.baidu.com/s?ie=utf-8&f=3&rsv_bp=0&rsv_idx=1&tn=baidu&wd=sed%20%E6%9B%BF%E6%8D%A2%E5%AD%97%E7%AC%A6%E4%B8%B2&rsv_pq=c7db61a600035dc5&rsv_t=5e19yEsbV9N5fIvdlGRU
作者小头像
作者小头像
快速交付
+ 关注