Tag

11회차

AI 기초 및 활용 11회: 강화학습 — 넘어지면서 배우는 기계, 그리고 알파고

자전거 타기에는 정답 데이터셋이 없습니다. 넘어지며 배우는 수밖에요. 보상 하나로 전략을 통째로 배우는 강화학습의 원리, 탐험과 활용의 딜레마, 세계를 놀라게 한 알파고, 그리고 보상을 해킹하는 기계까지. 제2부 완결편. SVIL AI 교육 시리즈 11회

SVIL - Singularity Visual Intelligence Lab 24 min read