2021-12-27 16:59:30 1.87MB 数据集
1
中文文本分类数据集
2021-12-16 22:17:00 76.88MB 中文文本分类数据集
中文文本分类数据集 数据来源: 今日头条客户端 数据格式: 6552431613437805063_!_102_!_news_entertainment_!_谢娜为李浩菲澄清网络谣言,之后她的两个行为给自己加分_!_佟丽娅,网络谣言,快乐大本营,李浩菲,谢娜,观众们 每行为一条数据,以_!_分割的个字段,从前往后分别是 新闻ID,分类code(见下文),分类名称(见下文),新闻字符串(仅含标题),新闻关键词 分类code与名称: 100 民生 故事 news_story 101 文化 文化 news_culture 102 娱乐 娱乐 news_entertainment 103 体育 体育 news_sports 104 财经 财经 news_finance 106 房产 房产 news_house 107 汽车 汽车 news_car 108 教育 教育 news_edu 109 科
2021-07-12 16:12:23 25.67MB Python
1
零基础入门NLP - 新闻文本分类 NLP_data_list_0715.csv
2021-07-01 09:25:19 370B 数据集
1
复旦中文文本数据集,包含训练集与测试集,数据集为TXT格式,可以进行文本分类实验,机器学习,深度学习,需要的可以下载。
2021-06-26 20:27:01 142.08MB 复旦数据集 文本分类 中文数据集
1
train_set.csv test_a.csv
2021-06-19 16:51:49 295.37MB 数据集
1
有24000条新闻,共六个类别,直接用python3的pickle.load()该文件即可,是一个24000个元素的list,list的每个元素是一个tuple,tuple的第一个元素是与处理好的文本,第二个元素是对应的标签。
1
天池比赛 新闻文本分类数据集 test_a.csv train_set.csv
2021-06-12 23:36:39 295.32MB 数据集
1
大规模新闻文本分类数据集,有多个领域,按文件夹摆放,不仅可以用来做文本分类实验,数据不少甚至可以用来做BERT预训练
2021-06-04 21:06:29 1.45GB NLP
1
cnews中文文本分类数据集;由清华大学根据新浪新闻RSS订阅频道2005-2011年间的历史 数据筛选过滤生成,训练过程见我的博客;
2021-06-02 20:25:12 42.97MB cnews 深度学习 数据集
1