블로그
-
인센티브의 힘: 인간의 행동을 움직이는 숨은 원동력
강화(Reinforcement) 이론과 강화 일정 조작적 조건형성 (B.F. 스키너): 행동은 그.......
blog.naver.com · 2026.09.11
-
마크포지드, 고강성 연속섬유 3D 프린팅 항공우주·방위산업 웨비나 7월 21일 예정
마크포지드의 연속섬유 강화(Continuous Fiber Reinforcement) 기술은 연속섬유를 부품 내부에 연속적으로 적층하여 금속 수준의 강도와 뛰어난 내구성과 획기적인 경량화를
blog.naver.com · 2026.07.02
-
[CNG TV] 고강성 연속섬유 3D 프린팅으로 항공우주·방위산업의 제조혁신을 앞당기다!(7/21, 마크포지드)
마크포지드의 연속섬유 강화(Continuous Fiber Reinforcement) 기술은 연속섬유를 부품 내부에 연속적으로 적층하여 금속 수준의 강도와 뛰어난 내구성과 획기적인 경량화를
blog.naver.com · 2026.07.02
-
틀리지 않은 삶을 위하여
첫째는 부분 강화 효과(partial reinforcement effect)입니다. 어떤 행동을 지속하는 이유는 그 행동에 대해서 강화를 받았기 때문입니다.......
blog.naver.com · 2026.06.21
-
휴머노이드는 어디에서부터 쓰일까? 물류공장. 한 10년 후에나 가정에서?
기술적 변화 (2:17-4:27): 과거 휴머노이드가 수학적 연산 기반으로 움직였다면, 최근에는 **강화 학습(Reinforcement Learning)**을 통해 스스로 시행착오를
blog.naver.com · 2026.06.17
-
구글 새 AI CPU인 TPU 공개
Pre-training(사전 교육), Reinforcement learning(강화 학습), Fine-tuning(미세 조정), Serving(서비스 제공)을 효율적으로 할 수 있게
blog.naver.com · 2026.04.23
-
CPDT-KA 시험에서 반드시 알아야 할 핵심 개념 TOP 10
Reinforcement (강화) 강화는 행동을 증가시키는 결과로, Positive 강화와 Negative.......
blog.naver.com · 2026.04.14
-
강화 학습[Reinforcement Learning(RL)]의 주요 개념 및 용어 요약 정리 - 초보자를 위한 수학식 없는 설명
□ 마르코프 결정 과정[Markov Decision Process(MDP)] 1. 마르코프 체인[Markov Chain]에 기반한 의사 결정 MDP는 이산 시간[Discrete Time]에서 확률에 기반하여[Stochastic] 순차적 상태 전이를 표현한 마르코프 체인[Markov Ch
blog.naver.com · 2025.06.29
-
[2017 arXiv] Proximal Policy Optimization Algorithms(PPO) - 강화 학습 초보자를 위한 쉬운 설명
발표된 Proximal Policy Optimization(PPO)은 앞서 설명한 Trust Region Policy Optimization(TRPO)에 이어, Deep Reinforcement Learning(Deep RL, 심층 강화 학습)의 핵심 알고리즘 중 하나입니다.
blog.naver.com · 2025.07.20
-
[2015 ICML] Trust Region Policy Optimization(TRPO) - 강화 학습 초보자를 위한 쉬운 설명
□ 설명 2015년에 발표된 Trust Region Policy Optimization(TRPO)은 Deep Reinforcement Learning(Deep RL, 심층 강화 학습
blog.naver.com · 2025.07.06
블로그 결과 더보기 →