Transformer Decoder 강의에서 "MaskedMultihadAttention"클래스 질문
153
작성한 질문수 1
안녕하세요.
설명을 너무 잘해주셔서 Transformer에 대한 이해도가 높아졌습니다. 감사합니다.
강의 중 이해안되는 부분이 있어 질문드립니다.
"Char Level GPT 만들기"강의 중 MaskedMultiheadAttention 클래스 선언 부분의 attention 객체 만드는 부분의 매개변수가 이해가 안갑니다.
Class MaskedMultiheadAttention(nn.Module):
def init(self, embed_dim, num_heads):
...
self.attentions = nn.ModuleList([MaskedSelfAttention(attention_dim, attention_dim) for in range(num_heads)]
...
위에 attention 객체 생성할 때 입력단자로 attention_dim이 들어가게 되는데 embed_dim 이 들어가야 하는게 아닐까요?
선택사항이라고 하기에는 TrnsformerDecoderBlock 클래스 선언한 걸 보면 layer_norm1을 emed_dim으로 설정해서 그래도 맞지 않는 것 같아서요.
답변 부탁드릴게요!
답변 1
0
안녕하세요. 질문 감사합니다. 강의중 타입 오류가 있었던점 사과드립니다.
https://github.com/NoCodeProgram/deepLearning/blob/main/transformer/bibleGPT.ipynb
에 보시면, MaskedMultiheadAttention 선언부분이 있습니다.
class MaskedMultiheadAttention(nn.Module):
def __init__(self, embed_dim, num_heads):
super().__init__()
attention_dim = embed_dim // num_heads
self.attentions = nn.ModuleList([MaskedSelfAttention(embed_dim, attention_dim) for _ in range(num_heads)])
self.fc = nn.Linear(embed_dim, embed_dim)
강의 자료 및 코드 수령
0
21
2
기초실습 BERT파인튜닝 예제 오류
0
22
1
54강 양자화의 끝판왕, 터보퀀트 (예정) 강의 업로드
0
26
1
블로그에 학습 내용 올려도 되나요?
0
29
1
130_Transformer.ipynb 오류 대응 부탁드립니다.
0
33
1
[데이터 전처리] dropna에서 특정 두 지표만 기준으로 결측치를 제거한 이유가 궁금합니다
1
27
1
smithery filesystem mcp server
0
48
2
supabase url, key 값 확인방법
1
58
3
02_TENSOR.md자료
0
40
1
프로그램은 뭘 사용하시는 건가요??
1
51
2
소스코드 오탈자 및 누락입니다.
0
61
2
소스코드 오탈자 입니다.
0
62
2
pytorch 설치 업데이트좀요
0
61
2
강의 제작
1
65
1
안녕하세요, 강의자료 요청드립니다
0
45
1
자료실 문의합니다. AIDU 툴 다운받으려고합니다.
0
43
1
7강 강의 학습자료에 대해서 질문있습니다.
0
36
1
runpod 사용방법이 궁금합니다..
0
63
1
소스 깃허브 주소
0
39
1
타 강의 내용
1
64
2
이론 설명의 ppt 자료 다운
0
54
2
[긴급요청2] 28강 동영상 오류(27강 음성 재생) 수정 예정일자를 알려주세요
0
36
1
모듈
0
102
1
state
0
101
2





