강화학습 기법의 하나로, 인공지능 에이전트가 현재 상태에서 선택한 행동을 수행하는 것의 기대 효용을 예측하는 함수인 Q-함수(상태에 따라 가치를 테이블로 나타낸 함수)를 학습함으로써 최적의 정책을 수행하는 방법1

활용 및 발전방향

  • 실무 적용: Q러닝 개념을 실제 프로젝트나 업무 상황에 직접 적용해 이해를 심화한다.
  • 연관 개념 학습: 관련 노트와 연결하여 맥락을 넓히고 응용 범위를 확장한다.
  • 비교 분석: 유사한 방법론·도구와 비교하며 장단점을 파악한다.
  • 참고 자료 탐색: 공식 문서나 전문 서적을 통해 더 깊은 이해를 추구한다.
  • 사례 수집: 실제 사례를 꾸준히 수집하여 이 노트를 발전시킨다.

관련 노트

  • 강화학습 — 공유 키워드: AI, 강화학습, 딥러닝
  • 모방 강화학습 — 공유 키워드: AI, 강화학습, 딥러닝
  • 퓨샷러닝 — 공유 키워드: AI, 강화학습, 딥러닝
  • AGI — 공유 키워드: AI, 딥러닝, 실제
  • Active Learning — 공유 키워드: AI, 딥러닝, 실제

Footnotes

  1. 쉽게 활용하는 인공지능 비즈니스