Playing Atari with Deep Reinforcement Learning Week - 2.3
- Related work 모르는 단어 정리(연관 논문빼고)
- 은닉층 : 인공 신경망에서 입력층과 출력층 사이에 위치한 중간층.
- 오프 폴리시 학습 : 현재 전략과는 다른 정책으로 수집된 데이터도 사용하여 학습.
- 선형 함수 : 입력과 출력이 직선적인 함수 (쉽게 일차함수)
- 딥 오토인코더 : 딥러닝에서 사용되는 신경망 구조 중 하나로, 입력 데이터를 압축하여 저차원 표현을 학습하고, 다시 원래의 입력 데이터로 복원하는 데 사용됨.