inflearn logo
강의

講義

知識共有

三角形の本番! OpenAI Triton初級

코드가 실행되는 순서에 관하여

解決済みの質問

392

tritonman

投稿した質問数 4

0

@triton.jit
def add_kernel(x_ptr, y_ptr, z_ptr, size, block_size: tl.constexpr):
    (...)

def add(x, y):
    z = (...)
    size = (...)

    def grid(meta):
        return (triton.cdiv(size, meta["block_size"]),)

    add_kernel[grid](x, y, z, size, 1024)

    return z

 

안녕하세요 vector_add.py를 보던 중, 코드 라인이 실행되는 순서가 궁금하여 질문남깁니다

 

수업에서 runtime 때 meta가 받아진다고 말씀해주셨는데요.

그렇다면 코드가 실행되는 순서가

  1. runtime 동안 add_kernel의 argument로 들어온 x, y, z, size, 1024가 meta로 받아지고

  2. meta를 이용해 grid가 (n, )의 형태로 set되고

  3. 그 이후 add_kernel이 실행된다

가 맞을까요?

 

또 하나 궁금한 것은 아래 라인이 실행될 때 @triton.jit 데코레이터의 역할인데요

add_kernel[grid](x, y, z, size, 1024)
  1. (x, y, z, size, 1024)를 meta로 받아준다

  2. 그 meta가 적용된 특정 grid 설정 위에서 add_kernel 함수가 실행될 수 있게 해준다

일까요?

 

파이썬에서 원래 함수는 subscriptable하지 않아, 위 syntax가 생소해서 질문드립니다

python 딥러닝 cnn gpgpu dropout openai argmax relu triton kernel-programming

回答 1

1

triangle

안녕하세요?

 

네 맞습니다! 알고 계신 순서로 실행이 됩니다. 그리고 triton.jit 데코레이터의 역할은 해당 함수를 Triton 커널로 정의하는 것입니다. triton.jit 데코레이터를 명시한 함수는 실행전에 컴파일 과정을 거치게 됩니다.

 

감사합니다.

영상 다운로드는 안되나요?

0

4

0

수강자료 다운로드 관련 문의

0

11

2

Opus/Sonnet 버전 관련 문의

1

12

2

"run_nvidia_gpu.bat" 실행후

0

11

1

섹션2 질문이요

1

16

2

섹션 2

0

12

1

섹션1.9 질문입니다!

1

20

3

웹서비스 방법

0

19

1

MCP 정의가 잘못되어 있음 (Chapter2)

0

21

1

수강 연장 문의드립니다.

0

27

2

스케쥴 설정 질문

0

35

2

13. (App 2) 기본기 훈련 에서

0

29

1

채점 프로그램 미작동

0

22

2

챌린지 시작일 문의

0

33

0

2. 어떤 도구를 사용하는 것이 가장 유리할까? 강의 중

0

27

1

autotune은 아직 안 올라온 건가요?

0

78

1

강의만 봐서는 triton 커널이 pytorch에 비해 빨라 보이지 않네요..

0

237

2

block ptr 질문

0

98

2

디스코드 커뮤

0

123

1

앞으로의 강의 계획에 대하여

0

271

2

실행을 위한 최적 환경

1

858

1

강의 계획에 대하여

0

356

1

행렬곱 오차 문제

1

442

2

실습 코드

0

395

1