DreamWiz
통합 뉴스 블로그 웹문서 동영상

블로그

  • 일타기초과학 #23 비마르코프 기반 감염재생산지수 추정법 이 가정은 마르코프 과정(Markov process)에 해당하며, 현재 상태만으로 미래 감염 확률을 계산하고 과거의 감염 시점은 고려하지 않습니다. blog.naver.com · 2025.10.30
  • 강화 학습[Reinforcement Learning(RL)]의 주요 개념 및 용어 요약 정리 - 초보자를 위한 수학식 없는 설명 □ 마르코프 결정 과정[Markov Decision Process(MDP)] 1. 체인[Markov Chain]에 의사 결정 문제를 포함시켜 수학적으로 모델링한 프레임워크입니다. 2. blog.naver.com · 2025.06.29
  • [강화학습] Markov Decision Process (MDP) Markov Decision Process (MDP) : 어떤 상황에서 어떤 행동을 선택해야 할지 알려주는모델 MDP 구성 요소 상태 : 지금 상황 Ex. blog.naver.com · 2025.01.08
  • 강화학습 상태(state) 행동(action) 보상(reward) 탐험과 탐사 갈등(Exploration and exploitation conflict) 마르코프 결정 프로세스(MDP) Markov (state-action value function) 할인 누적 보상액(discounted accumulating reward) MDP(Markov Decision Process) blog.naver.com · 2021.01.15

실시간 이슈 키워드

  1. 1 영화관
  2. 2 신봉선
  3. 3 한국거래소
  4. 4 롯데마트
  5. 5 lg유플러스
  6. 6 트로트
  7. 7 트럼프
  8. 8 하나머티리얼즈
  9. 9 설 영우
  10. 10 김도환

오늘의 이슈

일본 이바라키 지진5 안세영 배드민턴 결승4 베트남 태국 축구4 미국 캐나다 무역갈등4 해남 지진2 삼성전자 특허2 아마존 드론 실수2 박준효 미스코리아 진2 용산공원 대체지역2
이용약관 법적고지 개인정보처리방침 청소년보호정책 뉴스이용안내 이메일 무단수집거부 광고안내 회사소개
Copyright© DreamWiz Internet Co., Ltd. All rights reserved.