2_2最近鄰算法kNN(k_nearest_neighbor)——file2matrix_2_2

聲明:《機器學習實戰》代碼詳細註釋和重構,以及相關的函數、模塊和算法的解釋;本文爲博主原創文章,未經博主允許不得轉載。

1.k-近鄰算法(程序清單2-2)

*#代碼:Peter Gong_shuai
*#中文註釋:Gong_shuai
*#代碼重構:Gong_shuai
*#函數註解:Gong_shuai
*#相關的函數、模塊和算法的解釋:Gong_shuai

2. 代碼

#coding=utf-8
#k-近鄰算法(程序清單2-2)

#源代碼:Peter  Gong_shuai
#中文註釋:Gong_shuai
#代碼重構:Gong_shuai
#函數註解:Gong_shuai
#環境:python2.7

from numpy import *
import operator
from os import listdir #函數listdir可以列出給定目錄的文件名



#處理輸入格式問題,輸入爲文件名字符串,輸出爲訓練樣本矩陣和類標籤向量
def file2matrix(filename):
    fr = open(filename)
    numberOfLines = len(fr.readlines())         #得到文本行數
    returnMat = zeros((numberOfLines,3))        #創建以零填充的矩陣,爲了簡化,另外的一個維度設爲3
    classLabelVector = []                       #返回標籤     
    fr = open(filename)    #解析文件數據到列表,循環處理文件中的每一行的數據
    index = 0
    for line in fr.readlines():
        line = line.strip()    #截取掉所有的回車字符
        listFromLine = line.split('\t')    #將整行數據分割成一個元素列表
        returnMat[index,:] = listFromLine[0:3]     #選取前三個元素,存儲到特徵矩陣中
        classLabelVector.append(int(listFromLine[-1]))
        index += 1
    return returnMat,classLabelVector

# datingDataMat,datingLabels = file2matrix('datingTestSet.txt')
# print datingDataMat
發表評論
所有評論
還沒有人評論,想成為第一個評論的人麼? 請在上方評論欄輸入並且點擊發布.
相關文章