机器学习(预测模型):抑郁症的Reddit用户的帖子数据集

上传者: 41605937 | 上传时间: 2025-10-11 11:30:10 | 文件大小: 431.13MB | 文件类型: ZIP
Reddit Depression Dataset(RDS)是一个包含约9000名自报被诊断为抑郁症的Reddit用户的帖子数据集,以及大约107000名对照用户的帖子。该数据集中,被诊断用户的帖子已经去除了所有在心理健康相关的subreddits中发表的帖子,或者包含与抑郁症相关的关键词的帖子;而对照用户的帖子则在选取过程中不包含这类帖子。 这个数据集的构建细节可以在EMNLP 2017的论文《Depression and Self-Harm Risk Assessment in Online Forums》的第3.1节中找到,或者在数据网站上查看。RDS数据集的目的是为了支持在线论坛中抑郁症和自残风险评估的研究,它提供了一个丰富的资源,用于开发和测试用于识别抑郁症状的算法。 RDS数据集的统计数据显示,经过处理后,有9210名被诊断用户被分为训练集、验证集和测试集,以及相应的匹配对照用户。每个用户发表的帖子数量和每篇帖子的长度都有很大的差异。这个数据集为研究人员提供了一个宝贵的资源,用于分析抑郁症患者在社交媒体上的行为模式和语言使用习惯,以及开发用于识别抑郁症状的工具。

文件下载

资源详情

[{"title":"( 1 个子文件 431.13MB ) 机器学习(预测模型):抑郁症的Reddit用户的帖子数据集","children":[{"title":"reddit_depression_dataset.csv <span style='color:#111;'> 1.09GB </span>","children":null,"spread":false}],"spread":true}]

评论信息

免责申明

【只为小站】的资源来自网友分享,仅供学习研究,请务必在下载后24小时内给予删除,不得用于其他任何用途,否则后果自负。基于互联网的特殊性,【只为小站】 无法对用户传输的作品、信息、内容的权属或合法性、合规性、真实性、科学性、完整权、有效性等进行实质审查;无论 【只为小站】 经营者是否已进行审查,用户均应自行承担因其传输的作品、信息、内容而可能或已经产生的侵权或权属纠纷等法律责任。
本站所有资源不代表本站的观点或立场,基于网友分享,根据中国法律《信息网络传播权保护条例》第二十二条之规定,若资源存在侵权或相关问题请联系本站客服人员,zhiweidada#qq.com,请把#换成@,本站将给予最大的支持与配合,做到及时反馈和处理。关于更多版权及免责申明参见 版权及免责申明