블로그
- What Your PRD Should Cover Don't go deep on one section at the cost of another — balance matters. HR managers at 200–500 person companies who spend three or more hours a week answering repetitive policy
- [2017 arXiv] Proximal Policy Optimization Algorithms(PPO) - 강화 학습 초보자를 위한 쉬운 설명 □ 설명 2017년에 발표된 Proximal Policy Optimization(PPO)은 앞서 설명한 Trust Region Policy Optimization(TRPO)에 이어, Deep Reinforcement Learning(Deep RL, 심층 강화 학습)의 핵심 알고리즘 중 하나입니다.
- [2015 ICML] Trust Region Policy Optimization(TRPO) - 강화 학습 초보자를 위한 쉬운 설명 □ 설명 2015년에 발표된 Trust Region Policy Optimization(TRPO)은 Deep Reinforcement Learning(Deep RL, 심층 강화 학습 결국 TRPO는 같은 저자가 2017년에 후속 논문으로 발표한, 실용적인 1차 미분 근사에 기반한 알고리즘인 Proximal Policy Optimiz.......
- The Comfort women [위안부에 대하여, 위안부 바로 알기] thousands of women around the world to relieve sexual desire of Japanese troops and victims have been left deep The comfort women were conscripted under the policy leadership of the Japanese government.