강의 듣다 보면 supervised, unsupervised 이 말이 계속 나오는데 정확히 뭐가 다른 건지 감이 안 옵니다. 지도학습은 정답이 있는 거고 비지도학습은 없는 거다 이렇게 외우긴 했는데, 막상 실제로는 어떻게 나뉘는지 예시가 없으니까 자꾸 헷갈려요.


제가 이해한 게 맞나 싶어서 예를 하나 들어볼게요. 예를 들어 이런 데이터가 있다고 치면요.


고객나이 월소비액 이탈여부
25 12만원 O
41 3만원 X
33 27만원 O


여기서 이탈여부(O/X) 이 컬럼이 정답이니까 이걸 맞추게 학습시키면 지도학습, 이런 게 맞나요? 그러면 이탈여부 컬럼이 아예 없고 그냥 나이랑 소비액만 가지고 비슷한 애들끼리 묶는 거는 비지도학습이 되는 거고요?


그리고 궁금한 게, 실무에서는 둘 중에 뭘 더 많이 쓰나요? 처음 시작할 때는 그냥 지도학습부터 파는 게 맞을까요? 비지도학습은 clustering 말고 또 어디에 쓰이는지도 잘 모르겠더라고요. 대충이라도 예시로 정리해주시면 진짜 감사하겠습니다.