20newsgroups数据集是用于文本分类、文本挖据和信息检索研究的国际标准数据集之一。数据集收集了大约20,000左右的新闻组文档,均匀分为20个不同主题的新闻组集合。
来源: 20 Newsgroups
原文链接: http://qwone.com/~jason/20Newsgroups/