转载地址:
来自互联网:
1、气候监测数据集2、几个实用的测试数据集下载的网站
在下面的网址可以找到reuters数据集以下网址上有各种数据集:进行文本分类,还有一个数据集是可以用的,即rainbow的数据集3、找了很多测试数据集,写论文的同志们肯定需要的,至少能用来检验算法的效果
可能有一些不能访问,但是总有能访问的吧:UCI收集的机器学习数据集
statlib
样本数据库
关于基金的数据挖掘的网站
reuters数据集
各种数据集:
进行文本分类&WEB
时间序列数据的网址
apriori算法的测试数据
数据生成器的链接
关联:WEKA:
1。A jarfile containing 37 classification problems, originally obtained from the UCI repository2。A jarfile containing 37 regression problems, obtained from various sources3。A jarfile containing 30 regression datasets collected by Luis Torgo癌症基因:
金融数据:
另一个人提供的
在下面的网址可以找到reuters数据集以下网址上有各种数据集:
进行文本分类,还有一个数据集是可以用的,即rainbow的数据集
Download the Financial Data (~17.5M zipped file, ~67M unzipped data) Download the Medical Data (~2M zipped file, ~6M unzipped data)kdnuggets 相关链接数据集:
还有另外一个很好的资源网址为:,里面包含的数据资源如下(按应用领域划分):
Direct Marketing KDD CUP 1998 Data
GIS Forest CoverType Indexing Corel Image Features Pseudo Periodic Synthetic Time Series Intrusion Detection KDD CUP 1999 Data Process Control Synthetic Control Chart Time Series Recommendation Systems Entree Chicago Recommendation Data Robots Pioneer-1 Mobile Robot Data Robot Execution Failures Sign Language Recognition Australian Sign Language Data High-quality Australian Sign Language Data Text Categorization 20 Newsgroups Data Reuters-21578 Text Categorization Collection NSF Research Awards Abstracts 199 0-2003 World Wide Web Microsoft Anonymous Web Data MSNBC Anonymous Web Data Syskill Webert Web Data 这里又找到一个,在一个老外的blog上找到的。(儿童节前一天)