CUDA: Difference between revisions
Jump to navigation
Jump to search
(Added Knowledge Graph section) |
(Fix: remove --- horizontal lines (9 removed)) |
||
| Line 18: | Line 18: | ||
* 언제 사용하는가? - 서버 구성, 성능 튜닝, 문제 해결 시 | * 언제 사용하는가? - 서버 구성, 성능 튜닝, 문제 해결 시 | ||
== Purpose == | == Purpose == | ||
| Line 28: | Line 27: | ||
* Non-goals: 다른 주제로의 확장 | * Non-goals: 다른 주제로의 확장 | ||
== Key Concepts == | == Key Concepts == | ||
| Line 42: | Line 40: | ||
|} | |} | ||
== Detailed Explanation == | == Detailed Explanation == | ||
| Line 55: | Line 52: | ||
* 왜 필요한가? GPU의 대규모 병렬 처리 능력을 활용하여 AI/ML, 과학 계산, 영상 처리 가속 | * 왜 필요한가? GPU의 대규모 병렬 처리 능력을 활용하여 AI/ML, 과학 계산, 영상 처리 가속 | ||
* 언제 사용하는가? 딥러닝 훈련/추론, 과학 시뮬레이션, 영상 처리, 암호화 등 | * 언제 사용하는가? 딥러닝 훈련/추론, 과학 시뮬레이션, 영상 처리, 암호화 등 | ||
이 문서가 존재하는 이유 | 이 문서가 존재하는 이유 | ||
* Goal: CUDA 컴파일 방법, nvcc 플래그, PyTorch/TensorRT 설정, 호환성 정보 제공 | * Goal: CUDA 컴파일 방법, nvcc 플래그, PyTorch/TensorRT 설정, 호환성 정보 제공 | ||
* Scope: CUDA 컴파일 플래그, TORCH_CUDA_ARCH_LIST, CMake 설정, CUDA 호환성 | * Scope: CUDA 컴파일 플래그, TORCH_CUDA_ARCH_LIST, CMake 설정, CUDA 호환성 | ||
* Non-goals: CUDA C++ 프로그래밍 상세, 커널 최적화 기법 | * Non-goals: CUDA C++ 프로그래밍 상세, 커널 최적화 기법 | ||
{| class="wikitable" | {| class="wikitable" | ||
! Concept | ! Concept | ||
| Line 67: | Line 62: | ||
|- | |- | ||
== Best Practices == | == Best Practices == | ||
| Line 75: | Line 69: | ||
* 테스트 환경에서 먼저 검증 | * 테스트 환경에서 먼저 검증 | ||
== References == | == References == | ||
| Line 81: | Line 74: | ||
* [https://wiki.hpcmate.com CUDA] | * [https://wiki.hpcmate.com CUDA] | ||
== Related Pages == | == Related Pages == | ||
| Line 90: | Line 82: | ||
* [[Network]] | * [[Network]] | ||
[[Category:GPU]] | [[Category:GPU]] | ||
Latest revision as of 11:27, 17 July 2026
Overview
CUDA에 대한 기술 문서입니다.
Summary
- 무엇인가? - CUDA
- 왜 필요한가? - HPC 및 서버 환경에서 필수 개념
- 언제 사용하는가? - 서버 구성, 성능 튜닝, 문제 해결 시
Purpose
이 문서가 존재하는 이유
- Goal: CUDA에 대한 기술 정보 제공
- Scope: CUDA의 개념, 사용법, 설정
- Non-goals: 다른 주제로의 확장
Key Concepts
| Concept | Description | Related |
|---|---|---|
| CUDA | HPC/서버 환경에서 중요한 기술 개념 | Linux, Server |
Detailed Explanation
|status=Draft |owner=Knowledge Agent |last_update=2026-07-16 |review=Pending }} CUDA(NVIDIA Compute Unified Device Architecture)는 NVIDIA GPU에서 일반 연산을 수행할 수 있는 병렬 컴퓨팅 플랫폼과 프로그래밍 모델입니다.
- 무엇인가? NVIDIA GPU 병렬 컴퓨팅 플랫폼 및 프로그래밍 모델
- 왜 필요한가? GPU의 대규모 병렬 처리 능력을 활용하여 AI/ML, 과학 계산, 영상 처리 가속
- 언제 사용하는가? 딥러닝 훈련/추론, 과학 시뮬레이션, 영상 처리, 암호화 등
이 문서가 존재하는 이유
- Goal: CUDA 컴파일 방법, nvcc 플래그, PyTorch/TensorRT 설정, 호환성 정보 제공
- Scope: CUDA 컴파일 플래그, TORCH_CUDA_ARCH_LIST, CMake 설정, CUDA 호환성
- Non-goals: CUDA C++ 프로그래밍 상세, 커널 최적화 기법
Best Practices
- 최신 버전 사용 권장
- 공식 문서 참고
- 테스트 환경에서 먼저 검증
References
Related Pages
Knowledge Graph
Related
→ NVIDIA GPU → CUDA Toolkit → CUDA Programming → MIG → NVIDIA GPUs → Tensor Core
| Concept | Description | Related |
|---|