内容 本数据集采集于豆瓣电影,电影与演员数据收集于2019年8月上旬,影评数据(用户、评分、评论)收集于2019年9月初,共945万数据,其中包含14万部电影,7万演员,63万用户,416万条电影评分,442万条影评,是当前国内互联网公开的电影数据集中最全的一份。 数据集共有5个文件: movies.csv、person.csv、users.csv、comments.csv、ratings.csv。 数字字段介绍,见文件。 豆瓣影评数据信息-数据集是一个详细记录了豆瓣电影用户评论、评分及相关电影和演员信息的数据集合。该数据集覆盖了2019年8月和9月的数据,其中电影和演员数据于2019年8月上旬采集,而影评数据(包括用户信息、评分和评论内容)则在2019年9月初收集,共计包含945万条数据。这个数据集不仅庞大,而且内容全面,被认为是当前国内互联网上公开的最全面的电影数据集之一。 数据集的构成分为五个主要的CSV文件,分别是movies.csv、person.csv、users.csv、comments.csv和ratings.csv。这些文件分别记录了不同的信息: 1. movies.csv:此文件包含了电影的相关信息,例如电影名称、类型、上映年份等,以及电影与演员之间的关联信息。 2. person.csv:此文件记录了演员的基本信息,包括演员姓名、性别、出生日期以及演员与电影的参与关系。 3. users.csv:此文件包含了用户的基本信息,如用户的ID、昵称、注册时间和地理位置等信息。 4. comments.csv:此文件详细记录了用户的评论内容,每个评论包含了评论者ID、电影ID、评论文本、评论时间和评分等数据。 5. ratings.csv:此文件存储了用户对电影的评分数据,包括用户ID、电影ID以及用户给出的具体评分。 这些数据文件为研究者提供了丰富的信息,使得可以从多个角度分析和研究电影产业,包括用户喜好、电影评价趋势、演员影响力分析等。通过对这些数据进行统计分析和挖掘,可以得到关于电影市场的宝贵洞察,例如哪些演员或电影更受欢迎、观众对不同类型电影的偏好、用户的评分习惯等。此外,由于数据集覆盖时间跨度上的限制,研究者还可以分析特定时期内电影市场的变化趋势,例如节假日或特殊事件对电影票房和评论的影响。 该数据集对电影产业的从业者、研究人员以及数据分析师来说,是一个极其宝贵的资源。他们可以利用这些数据来优化电影的营销策略、改进电影内容、预测电影市场趋势,甚至进行更深入的影视文化研究。同时,对于开发推荐系统和情感分析算法的工程师来说,这个数据集同样是一个很好的实践平台,能够帮助他们训练和评估他们的模型。 不过,由于数据集包含大量的个人信息和用户评论,使用该数据集时需要遵守相关法律法规,并尊重用户隐私。研究人员在处理和发布分析结果时,应当确保不会泄露个人身份信息,避免给用户造成不必要的麻烦和风险。 豆瓣影评数据信息-数据集是研究电影产业和用户行为的强大工具,它为多方面的分析和研究提供了可能,同时也提出了对数据隐私和安全的重视。随着数据分析技术的发展和应用,这类数据集在市场研究、用户行为分析和人工智能领域都将发挥重要的作用。
2025-09-17 13:20:24 295.75MB 数据集
1
在bmp文件中隐藏数据信息的java组件类
2023-10-24 12:53:10 5KB java bmp hidden
1
VB.net 查询获取数据库数据信息实现函数,需要的朋友可以参考下,代码比较简单。
2023-04-11 12:18:43 19KB VB.net 数据库数据
1
全国知名景点的数据,含有标题,等级,地点,开放时间等 全国知名景点的数据,含有标题,等级,地点,开放时间等 全国知名景点的数据,含有标题,等级,地点,开放时间等 全国知名景点的数据,含有标题,等级,地点,开放时间等 全国知名景点的数据,含有标题,等级,地点,开放时间等 全国知名景点的数据,含有标题,等级,地点,开放时间等 全国知名景点的数据,含有标题,等级,地点,开放时间等 全国知名景点的数据,含有标题,等级,地点,开放时间等 全国知名景点的数据,含有标题,等级,地点,开放时间等 全国知名景点的数据,含有标题,等级,地点,开放时间等 全国知名景点的数据,含有标题,等级,地点,开放时间等 全国知名景点的数据,含有标题,等级,地点,开放时间等 全国知名景点的数据,含有标题,等级,地点,开放时间等 全国知名景点的数据,含有标题,等级,地点,开放时间等 全国知名景点的数据,含有标题,等级,地点,开放时间等 全国知名景点的数据,含有标题,等级,地点,开放时间等 全国知名景点的数据,含有标题,等级,地点,开放时间等 全国知名景点的数据,含有标题,等级,地点,开放时间等 2019--8--13
2023-03-09 22:29:59 10.41MB mysql Java 全国 景点
1
工具分享,因为资源分数最低是1分
2022-12-19 19:39:56 32KB iOS调试工具
1
贝克找房网站爬取的二手房数据信息,该数据用于Hadoop综合项目的数据分析。主要利用MapReduce、Hive对爬取的数据统计分析,并进行数据可视化。
2022-12-08 11:24:36 1.24MB MapReduce Hive 贝克找房数据
1
根据系统的需求分析结果,可以将本系统为三个大模块构成,包括数据爬取模块、数据分析模块和数据可视化模块,其中每个模块又包含许多个功能模块。 数据爬取模块包括:数据爬取、数据存储、数据预处理等。 数据分析模块包括:动漫类型分析、动漫导演分析、动漫声优分析、动漫脚本分析、国漫日漫对比、播出时间分析以及动漫词云分析等。 数据可视化模块包括:对分析结果的柱状图、箱型图、折线图、散点图和词云图等等的展示。 使用前请仔细查看说明文档
2022-11-25 18:42:31 11.59MB Python
1
INF 554项目 林俊,苏杭和姜浩宇 工作演示链接 影片示范 纸 背面链接 PDF格式 推介会 PDF格式
2022-11-10 23:31:27 33.58MB HTML
1
QT TCP客户端在子线程中发送结构体数据和接收信息普通数据信息
2022-11-02 18:03:20 8KB QT client 结构体数据
1
含全部比赛赛题测试数据+题面+标程题解 按照年度、月度、金银铜白金组别整理完全
2022-10-08 19:06:19 973.44MB USACO oj平台 测试数据 信息学竞赛
1