通过引入第三方包captcha生成测试集数据图像文件(test)和训练集数据图像文件(train), 通过编写函数拿到所有图像的文件名和数字值,并将将结果保存到列表中存储,再通过opencv 第三方库中的灰度化、膨胀腐蚀、二值化以及平移(放射变换)方法将图像数据转换为数组(每 一个像素代表一个特征值,每一个行代表一个图像)从而生成训练集数据和测试集数据。最后通 过机器学习包sklearn中的K临近算法生成分类器,测试test文件夹数据。
需求方专属客服,免费梳理匹配