资源为.ipynb格式。可以用jupter nootboke打开 对kaggle泰坦尼克号辛存者预测竞赛的一点小总结 1.首先提出了对数据分析思维的一些tips(不感兴趣的可以跳过) 2.对数据分析的流程做了一个文本的总结。 由数据探索-->特征工程-->建模三部分组成 2.1 数据探索:探索特征的类型,缺失情况等等 2.2 特征工程:简要介绍数据的填充,删除,增补等等方法 2.3 建模:对可以使用的分类算法做一些比较,优先选择比较好的算法来进行集成学习(有借鉴一些大神的思路 , 但是因为找不到原来的网址了,没有附加超链接,如果以后有遇见相似的文本,希望各位发个消息,我再加上链接,谢谢!)
2023-01-27 20:30:13 463KB kaggle titanic
1
泰坦尼克号的生存预测原始数据,以及Kaggle的下载网站
1
Titanic数据集主要包含两部分,训练集(train.csv)和测试集(test.csv)。其中训练集中包含乘客的基本信息和最终在事故中的存活情况,测试集只包含乘客的基本信息, 不包含存活情况。 目的:通过对训练集中乘客的基本信息和存活情况的分析,找到背后隐藏的某种规律,去推断测试集中的乘客是否遇难。
1
r-kaggle-泰坦尼克号 #Titanic生存预测 该存储库包含我针对Kaggle的《泰坦尼克号生存预测问题》的一些方法。 该存储库包括用于功能选择的脚本,用于数据建模的替代策略,原始测试和训练数据集以及为其生成的可视化图。 所有代码段均以R编写。 泰坦尼克号生存预测问题 在这一普遍的挑战中,目标是根据性别,阶级,机票详细信息,年龄类别等属性来预测什么样的人可能度过泰坦尼克号灾难。 程式码范例 去做 动机 列出的示例代码中的一种方法已提交给Kaggle。 安装 数据集可以在“数据”文件夹中找到。 它包括2个分别用于培训和测试的csv文件。 train.csv(59.76 kb) test.csv(27.96 kb) 使用以下R包。 seqinr:生物序列检索和分析 e1071:统计部概率论小组的其他职能(以前为E1071),维也纳工业大学 派对:递归派对的实验室 Ame
2022-12-16 11:06:19 77KB R
1
卡格格-泰坦尼克号 这使用Common Lisp解决了kaggle教程“”。 2015/10/19:我决定首先使用朴素的贝叶斯分类器。 但是,我认为这不是执行此任务的正确方法。 我只想知道这种“幼稚”的方式可以达到什么速率作为基准。 用法 首先,您需要从上述kaggle教程中获取“ train.csv”和“ test.csv”(还需要注册Kaggle)。 然后,将它们放在该项目下的“资源”目录中。 该项目导出两个函数“ main”和“ cross-validate”。 “主要”功能 学习使用“ train.csv”中的所有数据。 使用“ test.csv”中的所有数据将分类结果输出到“ resources / result.csv” (kaggle-titanic:main) “交叉验证”功能 使用“ train.csv”中的数据进行k交叉验证。 (k = 5) 将结果输出到标准输
2022-12-16 10:45:24 10KB CommonLisp
1
Titanic数据集来自kaggle
2022-11-24 18:14:58 88KB 机器学习
1
平台下载的原始三个数据train.csv test.csv gender_submission.csv (本来想0积分 分享给大家 无奈最低是1分了)
2022-11-21 08:29:47 32KB titanic数据
1
泰坦尼克号预测生还数据集,PassengerId => 乘客ID Pclass => 乘客等级(1-一等舱,2-二等舱,3-三等舱) Name => 乘客姓名 Sex => 性别 Age => 年龄 SibSp => 兄弟姐妹/配偶的数量 Parch => 父母与小孩数量 Ticket => 船票信息 Fare => 票价 Cabin => 客舱 Embarked => 登船港口(C-瑟堡,Q-皇后镇,S-南安普顿) 目标:预测survived(1-生存,0-死亡)
2022-11-01 20:18:56 77KB 数据集
1
python 常用 示例 数据 train.csv eval.csv titanic.csv
2022-10-13 19:04:29 10KB csv python titanic.csv titanic
1
数据文件fork Notebook可以直接运行
2022-10-09 17:58:39 22KB 数据集
1