7차시와 같은 코드로 다시 나누고, 얼굴을 본다
2분코드 ①은 7차시와 똑같은 코드(구성비 표 · KMeans(n_init=10, random_state=0))로 다시 나눕니다.
같은 데이터·같은 씨앗이니 무리 크기도 같아야 합니다. 그리고 그림이 나오기 전에 하나 짐작해 두세요 —
'밤에 붐비는' 무리의 가운데 역은 하루 중 언제 가장 많이 내릴까요?
기본 코드 ①은 채워져 있습니다. K = 4 는 7차시에서 고른 값이에요
— 다른 k를 골랐다면 그 값으로 바꿔 ▶ 실행하세요.
[0] k=4 · 무리 크기 [67, 32, 92, 48]
[1] 무리마다 가운데 역(중앙값)의 봉우리
무리 0: 승차 08시 12.5% · 하차 18시 11.9%
무리 1: 승차 18시 20.8% · 하차 08시 23.6%
무리 2: 승차 08시 16.9% · 하차 18시 14.4%
무리 3: 승차 18시 12.5% · 하차 08시 14.3%
도전 K 를 3이나 5로 바꿔 보세요. 무리 크기가 통째로 달라지고
봉우리 시각도 바뀝니다 — 같은 자료인데 얼굴이 몇 개인지가 사람이 고른 값에 달려 있습니다.
탐구 .median() 자리를 .mean() 으로 바꿔 곡선을 다시 그려 보세요.
어느 무리의 봉우리가 가장 크게 움직이나요? 그 무리에 무엇이 들어 있을까요?