최신 엔비디아 CUDA 아키텍처에서의 결정적 변경 사항
최신 엔비디아 CUDA 아키텍처에서의 결정적 변경 사항을 보면
"알고 있을 필요 없음" $\rightarrow$ "모르면 AI 최적화 불가능"
그 이하는 system에서 처리" $\rightarrow$ "독립적 스레드 스케줄링 (ITS)"
"Thread Block 단위 (순서 없음)" $\rightarrow$ "Thread Block Cluster 계층의 등장"
AI 행렬 연산 시 이웃한 SM들끼리 메모리를 공유하며 고속으로 데이터를 주고받고 있는데 강의에 추가로 알려주시면 좋을 것 같아요 시간에 흐름에(구현 알고리즘) 따르 아키텍처도 많이 변경되고 있으니까요
답변 1
0
안녕하세요.
말씀하신것 이외에도 CUDA 13.3이 나오면서 tiled computing 이 도입되었습니다.
해당 강의가 녹화되던 시점에는 나오지 않은 architecture 들이고, 새로운 내용을 준비하고 있습니다.
감사합니다.
6-H 체점 관련 질문
0
8
0
영상 다운로드는 안되나요?
0
11
0
채점서버 연결 관련 질문입니다
0
31
1
삼성 s직군
0
32
0
삼성 코테 없어짐
0
81
1
섹션7에서 개념적 궁금증
0
22
1
26년2회 실기기출은 언제쯤...
0
59
2
이론 공부법 요약본 버전 업데이트 문의
0
39
2
코딩살구클럽 가입부탁드립니다
0
40
2
vs 디버그 옵션 설정
0
27
2
코딩살구클럽 가입 요청 확인부탁드립니다
0
35
2
54강 양자화의 끝판왕, 터보퀀트 (예정) 강의 업로드
0
31
1
블로그에 학습 내용 올려도 되나요?
0
35
1
ch .12 grid 설정 관련 질문 드립니다.
0
106
2
memcpy 시간 고려 시 gpu vs. cpu
0
122
2
common.cpp의 procArg 함수에 대해 질문이 있습니다.
0
159
2
Thread Block 개수에 제한이 있나요?
0
440
1
Warp를 동시에 돌린다는 말이 이해가 가지 않습니다.
0
339
1
매크로 함수를 쓴 이유
0
328
1
VS2022 컴파일 에러
0
394
2
global 변수가 cuda memory에서 사용되는 이유
0
394
1
Warp 갯수에 대한 고찰입니다....
0
575
2
15강 Block ID 예제 오류 질문입니다.
0
382
1
컴파일 시의 <typeinfo> 관련 에러
0
615
1





