강화학습은 최대 보상을 얻기 위한 행동을 배우는 것으로, 이때, 행동 결과에 따른 상태 변화와 보상을 정하는 것을 모델이라고 하며, 이러한 모델을 통해 학습하는 것을 모델 기반 학습이라는 것 대조하여, 이러한 모델 없이 반속적 시행착오를 통해 학습하는 것을 모델 프리 학습이라 함.1 AI 모델이 유사한 입력에 대해 얼마나 일관적인 결과를 제공하는지를 이용하여 판단하는 특정으로 목적에 맞는 유사한 입력에 대해 정확도가 높을 경우 취약성이 낮다고 표현함.2
활용 및 발전방향
- 실무 적용: 모델 프리 개념을 실제 프로젝트나 업무 상황에 직접 적용해 이해를 심화한다.
- 연관 개념 학습: 관련 노트와 연결하여 맥락을 넓히고 응용 범위를 확장한다.
- 비교 분석: 유사한 방법론·도구와 비교하며 장단점을 파악한다.
- 참고 자료 탐색: 공식 문서나 전문 서적을 통해 더 깊은 이해를 추구한다.
- 사례 수집: 실제 사례를 꾸준히 수집하여 이 노트를 발전시킨다.
관련 노트
- 블랙박스 모델 — 공유 키워드:
AI,딥러닝,모델 - 완전히 연결된 모델 — 공유 키워드:
AI,딥러닝,모델 - 지도학습 — 공유 키워드:
AI,딥러닝,유사한 - A.I. Guideline — 공유 키워드:
AI,모델 - AGI — 공유 키워드:
AI,딥러닝