1. 대규모 병렬연산을 위한 GPGPU의 개요

그래픽 처리를 위해 설계된 GPU의 대규모 병렬 연산능력을 범용 응용프로그램의 연산에 활용하여 처리능력을 향상시키는 병렬 컴퓨팅 기술이다.

2. GPGPU 구조 및 구성요소

3. GPGPU 처리과정

① 데이터 전송 → ② Kernel 실행 → ③ 병렬연산 → ④ 결과 회수

① CPU가 Main Memory의 데이터를 GPU Memory로 전송
② CPU(Host)가 GPU에 Kernel 실행 명령
③ GPU의 다수 Thread가 병렬로 연산 수행
④ 연산 결과를 GPU Memory에서 Main Memory로 전송

→ 최근에는 Unified Memory, 고속 인터커넥트 등 활용으로 병목 해소

4. CPU와 GPGPU의 비교

구분CPUGPGPU
구조소수의 고성능 Core다수의 단순 Core
처리순차·복잡 연산대규모 병렬 연산
최적화지연시간(Latency)처리량(Throughput)
제어복잡한 제어에 강함동일·반복 연산에 강함
활용OS, 일반 프로그램AI, 영상, 과학연산

5. GPGPU의 핵심기술

기술설명
SIMT다수 Thread가 동일 명령을 병렬 수행
ThreadGPU 병렬 실행 단위
KernelGPU에서 병렬 실행되는 함수
Memory 계층Register·Shared·Global Memory 활용
CUDA / OpenCLGPU 병렬 프로그래밍 플랫폼



댓글

답글 남기기

이메일 주소는 공개되지 않습니다. 필수 필드는 *로 표시됩니다