PG-DPO
동적 포트폴리오 선택을 위한 Pontryagin-Guided Direct Policy Optimization.
PG-DPO(Pontryagin-Guided Direct Policy Optimization)는 폰트랴긴 최대원리와 직접 정책 최적화를 결합하여 고차원 동적 포트폴리오 선택을 푸는 우리의 프레임워크입니다. 학습된 정책이 기저 확률제어 문제의 구조를 복원하도록 설계되었습니다.
동적 포트폴리오 선택을 위한 Pontryagin-Guided Direct Policy Optimization.
PG-DPO(Pontryagin-Guided Direct Policy Optimization)는 폰트랴긴 최대원리와 직접 정책 최적화를 결합하여 고차원 동적 포트폴리오 선택을 푸는 우리의 프레임워크입니다. 학습된 정책이 기저 확률제어 문제의 구조를 복원하도록 설계되었습니다.