pile·

실시간 경로탐색에 Multi-armed Bandit 기반 강화학습 도입하기 (feat. SCI급 논문게재)

kakao tech·if(kakao)25 2025··
#experimentation#machine-learning#navigation#reinforcement-learning#optimization#multi-armed-bandit#route-planning

챕터별 상세

010:12 – 0:55

운전자 선택에서 도로 품질을 배우는 문제

실시간 내비게이션은 단순히 최단 경로를 찾는 것이 아니라 운전자가 실제로 받아들일 만한 경로를 제시해야 한다. 지도에 명시되지 않은 좁은 길, 대기 행렬, 운전 난이도 같은 잠재 특성을 사용자 선택에서 학습해 링크 비용에 반영하는 것이 프로젝트의 목표였다.