inflearn logo
강의

강의

N
챌린지

챌린지

멘토링

멘토링

N
클립

클립

로드맵

로드맵

지식공유

CUDA 프로그래밍 (2) - C/C++/GPU 병렬 컴퓨팅 - 벡터 vector 더하기

15-7 lane id rules - 레인 ID 부여 규칙 설명

최신 엔비디아 CUDA 아키텍처에서의 결정적 변경 사항

해결된 질문

41

차시머_from_PK

작성한 질문수 17

1

최신 엔비디아 CUDA 아키텍처에서의 결정적 변경 사항을 보면

"알고 있을 필요 없음" $\rightarrow$ "모르면 AI 최적화 불가능"

그 이하는 system에서 처리" $\rightarrow$ "독립적 스레드 스케줄링 (ITS)"

"Thread Block 단위 (순서 없음)" $\rightarrow$ "Thread Block Cluster 계층의 등장"

AI 행렬 연산 시 이웃한 SM들끼리 메모리를 공유하며 고속으로 데이터를 주고받고 있는데 강의에 추가로 알려주시면 좋을 것 같아요 시간에 흐름에(구현 알고리즘) 따르 아키텍처도 많이 변경되고 있으니까요

c c++ cuda gpu 병렬-처리

답변 1

0

드립커피+한모금더

안녕하세요.

말씀하신것 이외에도 CUDA 13.3이 나오면서 tiled computing 이 도입되었습니다.

해당 강의가 녹화되던 시점에는 나오지 않은 architecture 들이고, 새로운 내용을 준비하고 있습니다.

감사합니다.

이론 공부법 요약본 버전 업데이트 문의

0

10

1

코딩살구클럽 가입부탁드립니다

0

22

2

vs 디버그 옵션 설정

0

24

2

코딩살구클럽 가입 요청 확인부탁드립니다

0

29

2

54강 양자화의 끝판왕, 터보퀀트 (예정) 강의 업로드

0

28

1

블로그에 학습 내용 올려도 되나요?

0

30

1

5-S 테스트 케이스 질문

0

34

2

정처기 필기 준비할때 이 이론을 다시 외워도 될까요?

0

51

2

코살 문제풀이 환경

0

46

2

2 - T 오큰수 문제가 있는 것 같습니다.

0

43

1

추천 추가문제들

0

42

2

프로그래머스 코테 환경 관련해서 질문드립니다.

0

43

2

최댓값 구하기(서바이벌)에서 수식 구성에 대한 질문

0

39

2

ch .12 grid 설정 관련 질문 드립니다.

0

105

2

memcpy 시간 고려 시 gpu vs. cpu

0

119

2

common.cpp의 procArg 함수에 대해 질문이 있습니다.

0

158

2

Thread Block 개수에 제한이 있나요?

0

439

1

Warp를 동시에 돌린다는 말이 이해가 가지 않습니다.

0

337

1

매크로 함수를 쓴 이유

0

327

1

VS2022 컴파일 에러

0

394

2

global 변수가 cuda memory에서 사용되는 이유

0

394

1

Warp 갯수에 대한 고찰입니다....

0

574

2

15강 Block ID 예제 오류 질문입니다.

0

381

1

컴파일 시의 <typeinfo> 관련 에러

0

612

1