- 중심경향치
- 산포도
: 데이터의 퍼짐 정도를 나타내는 방법
1. 분산(Variance) : 평균에 데이터가 퍼진 정도

ex) 10,20,30,40,50의 분산
import numpy as np
data = [10,20,30,40,50]
my_array = np.array(data)
np.var(my_array)
#####
200
#####
표준편차(standard deviation) : 분산의 제곱근
변동계수(coeffient of variabtion)

서로 값의 스케일이 다르면 분산도 달라지므로 변동계수를 사용해 측정 단위가 다른 자료를 비교한다.
이제 통계학을 파이썬을 활용하여 쓸려면 Numpy모듈을 이용해야 한다.
만약 python에서 사용되는 list를 사용하면
# list으로 처리
import time
start = time.time()
my_list = [i for i in range(10000000)]
for i in range(len(my_list)):
my_list[i] = my_list[i] + 10
end = time.time()
print(end - start)
이렇게 적어야 하지만
Numpy모듈을 쓴다면
# array 자료형으로 처리
import numpy as np
start = time.time()
np.array(my_list) + 10
end = time.time()
print(end-start)
C언어에서 사용하는 array방식으로 처리하여 데이터 처리속도를 높일 수 있다.
또한 Random모듈을 사용하여 데이터를 임의로 만들어 시뮬레이션을 할수 있다.
