Build your ultimate AI agent
课程介绍
基于树的机器学习模型可以揭示数据中复杂的非线性关系,并且常常在机器学习竞赛中占据优势。在本课程中,您将使用 tidymodels 包来探索并构建不同的树模型——从简单的决策树到复杂的随机森林。您还将学习使用提升树,这是一种利用集成学习来构建高性能预测模型的强大技术。学习过程中,您将基于健康与信用风险数据,预测糖尿病发生率和客户流失。
先修要求
课程大纲
课程大纲
1
分类树
准备好搭建一个真正的机器学习流水线了吗?通过逐步练习学习如何创建决策树、划分数据,并预测哪些患者最可能患上糖尿病。最后,您还将构建性能度量来评估模型并判断预测效果。
2
回归树与交叉验证
准备来点甜的?使用巧克力评分数据集来构建回归树,并用合适的误差度量评估其性能。通过应用如交叉验证等"甜蜜"技巧,克服单次训练/测试划分的统计不确定性,并更进一步掌握偏差-方差权衡。
3
超参数与集成模型
是时候认真调优您的超参数并解读受试者工作特征(ROC)曲线了。在本章中,您将利用集成模型(如装袋法与随机森林)的群体智慧,构建能够预测哪些信用卡客户最可能流失的集成模型。
4
提升树
准备好迈入树模型的"上流社会"了吗?应用梯度提升来创建性能优于您此前见过或构建过的一切的强大集成。了解其精细调优方法,并学会比较不同模型,从而为生产环境选出最佳方案。
R
R 中的树模型机器学习
课程完成

