数据挖掘的数据集资源

简介:
1、气候监测数据集  [url]http://cdiac.ornl.gov/ftp/ndp026b[/url]
2、几个实用的测试数据集下载的网站
3、找了很多测试数据集,写论文的同志们肯定需要的,至少能用来检验算法的效果
可能有一些不能访问,但是总有能访问的吧:
关于基金的数据挖掘的网站
[url]http://www.gotofund.com/index.asp[/url]
WEKA:
[url]http://flow.dl.sourceforge.net/sourceforge/weka/regression-datasets.jar[/url]
1。A jarfile containing 37 classification problems, originally obtained from the UCI repository
[url]http://prdownloads.sourceforge.net/weka/datasets-UCI.jar[/url]
2。A jarfile containing 37 regression problems, obtained from various sources
[url]http://prdownloads.sourceforge.net/weka/datasets-numeric.jar[/url]
3。A jarfile containing 30 regression datasets collected by Luis Torgo
[url]http://prdownloads.sourceforge.net/weka/regression-datasets.jar[/url]
以下网址上有各种数据集:
[url]http://kdd.ics.uci.edu/summary.data.type.html[/url]
进行文本分类,还有一个数据集是可以用的,即rainbow的数据集
[url]http://www-2.cs.cmu.edu/afs/cs/project/theo-11/www/naive-bayes.html[/url]

Download the Financial Data (~17.5M zipped file, ~67M unzipped data) 
Download the Medical Data (~2M zipped file, ~6M unzipped data)
[url]http://lisp.vse.cz/pkdd99/Challenge/chall.htm[/url]
还有另外一个很好的资源网址为:[url]http://kdd.ics.uci.edu/[/url],里面包含的数据资源如下(按应用领域划分):
Direct Marketing 
KDD CUP 1998 Data 

GIS 
Forest CoverType 

Indexing 
Corel Image Features 
Pseudo Periodic Synthetic Time Series 

Intrusion Detection 
KDD CUP 1999 Data 

Process Control 
Synthetic Control Chart Time Series 

Recommendation Systems 
Entree Chicago Recommendation Data 

Robots 
Pioneer-1 Mobile Robot Data 
Robot Execution Failures 

Sign Language Recognition 
Australian Sign Language Data 
High-quality Australian Sign Language Data 

Text Categorization 
20 Newsgroups Data 
Reuters-21578 Text Categorization Collection 
NSF Research Awards Abstracts 199 0-2003 

World Wide Web 
Microsoft Anonymous Web Data 
MSNBC Anonymous Web Data 
Syskill Webert Web Data 

这里又找到一个,在一个老外的blog上找到的。(儿童节前一天)
[url]http://www.fs.fed.us/fire/fuelman/[/url]









本文转自 yuwenhu 51CTO博客,原文链接:http://blog.51cto.com/yuwenhu/136551,如需转载请自行联系原作者
目录
相关文章
|
4月前
|
机器学习/深度学习 数据挖掘 Python
【数据挖掘】分类器模型性能评估讲解及iris数据集评估实战(超详细 附源码)
【数据挖掘】分类器模型性能评估讲解及iris数据集评估实战(超详细 附源码)
46 0
|
4月前
|
机器学习/深度学习 算法 数据挖掘
【数据挖掘】SVM原理详解及对iris数据集分类实战(超详细 附源码)
【数据挖掘】SVM原理详解及对iris数据集分类实战(超详细 附源码)
91 1
|
4月前
|
算法 数据挖掘
【数据挖掘】朴素贝叶斯分类讲解及对iris数据集分类实战(超详细 附源码)
【数据挖掘】朴素贝叶斯分类讲解及对iris数据集分类实战(超详细 附源码)
83 0
|
4月前
|
机器学习/深度学习 存储 算法
【数据挖掘】KNN算法详解及对iris数据集分类实战(超详细 附源码)
【数据挖掘】KNN算法详解及对iris数据集分类实战(超详细 附源码)
68 0
【数据挖掘】KNN算法详解及对iris数据集分类实战(超详细 附源码)
|
4月前
|
算法 数据挖掘 Python
【数据挖掘】决策树中C4.5与CART算法讲解及决策树应用iris数据集实战(图文解释 附源码)
【数据挖掘】决策树中C4.5与CART算法讲解及决策树应用iris数据集实战(图文解释 附源码)
47 0
|
机器学习/深度学习 人工智能 大数据
人工智能、大数据、数据挖掘、机器学习-数据集来源(下)
人工智能、大数据、数据挖掘、机器学习-数据集来源(下)
181 0
|
机器学习/深度学习 存储 人工智能
人工智能、大数据、数据挖掘、机器学习-数据集来源(中)
人工智能、大数据、数据挖掘、机器学习-数据集来源(中)
140 0
|
机器学习/深度学习 数据采集 存储
人工智能、大数据、数据挖掘、机器学习-数据集来源(上)
人工智能、大数据、数据挖掘、机器学习-数据集来源(上)
156 0
|
算法 数据挖掘 Windows
【数据挖掘】关联规则挖掘 Apriori 算法 ( 关联规则简介 | 数据集 与 事物 Transaction 概念 | 项 Item 概念 | 项集 Item Set | 频繁项集 | 示例解析 )
【数据挖掘】关联规则挖掘 Apriori 算法 ( 关联规则简介 | 数据集 与 事物 Transaction 概念 | 项 Item 概念 | 项集 Item Set | 频繁项集 | 示例解析 )
145 0
|
算法 数据挖掘 数据采集
数据挖掘——数据归约之大型数据集的维度
虽然大型数据集可能得到更佳的挖掘结果,但未必能获得比小型数据集更好的挖掘结果 对于多维数据,一个主要的问题是在所有维度中搜寻所有挖掘方案之前,是否可以确定某方法在已归约数据集的挖掘和发现中国发挥得淋漓尽致。
2545 0