Son's Data story

글

라벨이 SGD classifier인 게시물 표시

이진분류(Binary Classification)

내용 MNIST 자료 호출 이진분류기, SGD classifier 교차검증(Cross-Validation) 혼동행렬 정밀도/재현율 트레이드오프 이진분류(Binary Classification) MNIST 자료 호출 MNIST 데이터셋트에 대해 분류 문제를 적용합니다. import numpy as np import pandas as pd from sklearn.datasets import fetch_openml import matplotlib as mpl import matplotlib.pyplot as plt import pickle, gzip 다음의 mnist 자료는 kaggle 로 부터 다운받은 자료를 pickle.load()함수로 압축을 해제하여 호출한 것입니다. 이 자료는 이미 훈련, 검정, 테스트 셋트로 분리된 상태입니다. 각 그룹에는 특징들과 라벨이 튜플 형식으로 포함되어 있습니다. with gzip.open('mnist.pkl.gz', 'rb')as f: tr, val, te=pickle.load(f, encoding="latin1") tr[0].shape, val[0].shape, te[0].shape ((50000, 784), (10000, 784), (10000, 784)) Xtr, ytr=tr[0], tr[1] Xval, yval=val[0], val[1] Xte, yte=te[0], te[1] plt.imshow(Xtr[0,:].reshape(28, 28)) plt.axis('off') plt.show() ytr[0], ytr.dtype (5, dtype('int64')) 라벨의 자료형은 목록형이므로 숫자형으로 전환 이진분류기, SGD classifier 데이터 mnist에서 숫자 하나를 분류해 봅니다. 예를 들어 숫자 '5'와 나머지를

자세한 내용 보기

Son's Data story

이 블로그 검색

글

통계관련 함수와 메서드 사전

이진분류(Binary Classification)