여기는 분류 모델 실험실. 사과 22개와 배 18개, 총 40개의 데이터가 도착했다.
먼저 네가 직접 경계선을 긋고, 그다음 모델이 찾은 경계와 겨뤄 본다.
마지막에는 임계값 슬라이더로 두 오류(거짓 양성·거짓 음성)의 줄다리기를 관찰한다.
산점도 위를 드래그해서 사과와 배를 가장 잘 나누는 직선을 그어라. 겹침 구간이 있어 완벽한 경계는 불가능하다!
오분류 점 개수를 세었다. 이제 정확도 = 맞은 수 ÷ 전체 수. 계산은 네 몫이다!
양성 = 사과. 맞힌 칸(TP·TN)은 채워졌다. 틀린 점 묶음을 알맞은 오류 칸으로 끌어다 놓아라 (골라서 칸을 클릭해도 된다)
같은 데이터인데 모둠마다 경계가 다르다. 오분류 수가 같아도 경계가 다를 수 있다!
모델이 찾은 경계(초록)와 내 경계(노랑 점선)를 비교하고, 슬라이더로 경계를 밀며 세 구간에서 FP·FN을 기록하라!
| 구간 | FP | FN | 기록 |
|---|---|---|---|
| 느슨 (−24 ~ −9) | – | – | |
| 중간 (−8 ~ +8) | – | – | |
| 엄격 (+9 ~ +24) | – | – |
경계 복잡도를 1→5로 올리면 훈련 정확도는 계속 오른다. 평가 정확도가 떨어지기 시작하는 지점을 찾아 클릭( )하라!
상황: 스팸 필터 과제 (양성 = 스팸). 지호의 초대 메일이 스팸함에 갇혔던 사건을 떠올리며 빈칸을 채워라.