강화학습 기법의 하나로, 인공지능 에이전트가 현재 상태에서 선택한 행동을 수행하는 것의 기대 효용을 예측하는 함수인 Q-함수(상태에 따라 가치를 테이블로 나타낸 함수)를 학습함으로써 최적의 정책을 수행하는 방법1
활용 및 발전방향
- 실무 적용: Q러닝 개념을 실제 프로젝트나 업무 상황에 직접 적용해 이해를 심화한다.
- 연관 개념 학습: 관련 노트와 연결하여 맥락을 넓히고 응용 범위를 확장한다.
- 비교 분석: 유사한 방법론·도구와 비교하며 장단점을 파악한다.
- 참고 자료 탐색: 공식 문서나 전문 서적을 통해 더 깊은 이해를 추구한다.
- 사례 수집: 실제 사례를 꾸준히 수집하여 이 노트를 발전시킨다.
관련 노트
- 강화학습 — 공유 키워드:
AI,강화학습,딥러닝 - 모방 강화학습 — 공유 키워드:
AI,강화학습,딥러닝 - 퓨샷러닝 — 공유 키워드:
AI,강화학습,딥러닝 - AGI — 공유 키워드:
AI,딥러닝,실제 - Active Learning — 공유 키워드:
AI,딥러닝,실제
Footnotes
-
쉽게 활용하는 인공지능 비즈니스 ↩