回复:0 阅读:1410
计算机视觉基础数据集-MNIST 数据集

曾文超 离线

帖子:1095
粉蓝豆:24
经验:2114
注册时间:2012-04-21
加关注  |  发消息
楼主 发表于 2018-09-28 09:56|举报|关注(0)
浏览排序[ 顺序 逆序 楼主 支持 精彩 ]  快捷回复

 MNIST 数据集已经是一个被”嚼烂”了的数据集, 很多教程都会对它”下手”, 几乎成为一个 “典范”.

MNIST 数据集来自美国国家标准与技术研究所, National Institute of Standards and Technology (NIST). 训练集 (training set) 由来自 250 个不同人手写的数字构成, 其中 50% 是高中学生, 50% 来自人口普查局 (the Census Bureau) 的工作人员. 测试集(test set) 也是同样比例的手写数字数据. 

MNIST数据集包含60000张训练图片,10000张测试图片。其中每一张图片都是0~9中的一个数字。图片尺寸为28×28。由于数据集中数据相对比较简单,人工标注错误率仅为0.2%。

计算机视觉基础数据集-MNIST 数据集图1
名称:图1
描述:1


MNIST 数据集可在 http://yann.lecun.com/exdb/mnist/ 获取, 它包含了四个部分:

  • Training set images: train-images-idx3-ubyte.gz (9.9 MB, 解压后 47 MB, 包含 60,000 个样本)
  • Training set labels: train-labels-idx1-ubyte.gz (29 KB, 解压后 60 KB, 包含 60,000 个标签)
  • Test set images: t10k-images-idx3-ubyte.gz (1.6 MB, 解压后 7.8 MB, 包含 10,000 个样本)
  • Test set labels: t10k-labels-idx1-ubyte.gz (5KB, 解压后 10 KB, 包含 10,000 个标签)

标签:
0
添加参考诊断
×参考诊断
  
回复:0 阅读:1410
【免责声明】讨论内容仅作学术交流之用,不作为诊疗依据,由此而引起的法律问题作者及本站不承担任何责任。
快速回复
进入高级回复
您最多可输入10000个汉字,按 "Ctrl" + "Enter" 直接发送
搜索回复/乘电梯 ×
按内容
按会员
乘电梯
合作伙伴
友情链接