RSS Feed
Articles
-
CUDA Memory Hierarchy: Register, Shared, Global Memory와 Cache
CUDA Memory Model 강의의 내용을 바탕으로 CUDA의 메모리 공간, 접근 범위, 수명, 물리적 위치를 정리한다. 강의가 만들어진 뒤 GPU 구조와 CUDA 문서가 바뀐 부분은 현재 NVIDIA 문서에 맞추어 보완했다.
-
CUDA Matrix Transpose: Shared Memory로 Coalesced Access 만들기
CUDA에서 행렬 전치(matrix transpose)를 구현하면서, 왜 shared memory를 사용하는지와 블록 및 블록 내부 좌표가 어떻게 전치되는지 정리한다.
-
CUDA 기초: 스레드 구조, 메모리 복사, 벡터 덧셈과 SGEMM
CUDA를 처음 공부하면서 확인한 Host/Device의 관계, 커널 실행 구조, 메모리 복사, 벡터 덧셈과 기본적인 행렬 곱셈을 정리한다.
-
Ubuntu 22.04에 무선랜카드 rtl8832bu 드라이버 설치
-
Jetson Nx module sd카드에 ubuntu 설치
