inflearn logo
강의

Khóa học

Chia sẻ kiến thức

Học tăng cường học dễ dàng với R

Phòng thí nghiệm PerDQN

PER DQN

251

MQ

2 câu hỏi đã được viết

0

강의 감사드립니다!

PER DQN 코드에서.. 

er<-target_Q-qvalue 한다음에 discount factor 를 er 에다가 곱하는데..

설명 해주신 식에서는 target_Q에다가 discount factor를 곱하고 (1) //

그전 state에서의 qvalue 에서 그전시점의 action에 해당하.는 값을 구하고 (2)

리워드+(1)-(2) 라고 이해했는데 코딩은 조금 다른 것 같아서요! 

머신러닝 배워볼래요? R 강화학습

Câu trả lời 1

0

coco

안녕하세요 MQ님

아래 코드와  수식을 비교해보면 delta 변수와 TD-error가 같은 것을 확인 할 수 있습니다.

      er<-target_Q-qvalue

      delta<-re_ep[1]+dis_f*er[action_index]   

numpy의 shape

0

631

1

tfjs-node 안깔려서

0

1139

1

ADP 자격증 대비 강의 개설 문의

0

856

2

하이퍼 파라미터 튜닝 범위

0

633

1

딥러닝 코드에 Batch Normalization 적용해보기 질문입니다

0

599

1

flyctl 관련 재문의 드립니다.

0

621

1

mac os ) zip 파일 dataframe 오류

0

701

1

flyctl 배포 관련 에러 문의드립니다.

0

766

1

딥러닝으로 Regression 문제 적용해보기 (House Price Kaggle 문제) 질문입니다

0

500

1

numpy.random.default_rng/hyperopt버젼

0

1216

1

Binary Classfication 딥러닝 적용해보기 질문입니다

0

384

1

업로드 후 홈화면에서 이미지가 보이지 않습니다

0

607

1

n_iter 횟수 넘음 질문

0

522

2

image 파일에서 vscode로 드래그 앤 드롭을 처리할 수 없다고 합니다

0

1039

1

upload 페이지에 아무것도 안 뜨는 현상

0

463

1

혹시 응용편은 어디서 볼 수 있을까요?

0

500

1

[질문] 파이썬 머신러닝 완벽 가이드 교차검증-2 강의내용

1

467

1

다차원 데이터 군집화와 시각화에 대해 질문드립니다

0

578

1

강의 자료 부탁드립니다 !

0

417

1

postman invalid url 질문드립니다.

0

1035

1

hyperopt를 이용한 하이퍼파라미터 튜닝

0

641

1

강화학습 예시로 날씨예측

0

460

1

return_reward 함수에서

0

272

3

강의자료와 코드에 아무것도 안뜹니다.

0

227

1