Build your ultimate AI agent
课程介绍
在本课程中,您将学习如何使用数据进行建模。模型用于刻画关注的结果变量与一组解释/预测变量之间的关系。此类模型既可用于解释目的,例如:"知道教授的年龄是否有助于解释其教学评分?",也可用于预测目的,例如:"仅根据房屋的面积和状况,能多准确地预测房价?" 您将运用 tidyverse 技能来构建并解读这些模型。课程以线性回归为核心——这是一种最常用且易于理解的建模方法。此类建模方法与思维广泛应用于统计学、因果推断、机器学习和人工智能等领域。
先修要求
课程大纲
课程大纲
1
建模入门
本章将向您介绍建模的一些背景理论与术语,重点包括通用建模框架、用于解释与用于预测的建模之区别,以及建模问题本身。此外,您将开始进行第一次探索性数据分析,这是任何正式建模之前至关重要的第一步。
2
基础回归建模
在掌握通用建模框架后,本章将讲解基础线性回归。您将保持设置简单,将结果变量 y 建模为单个解释/预测变量 x 的函数。我们会同时使用数值型和分类型的 x 变量。本章关注的结果变量是德克萨斯大学奥斯汀分校授课教师的教学评分。
3
多元回归建模
上一章中,您学习了只使用单个数值或单个分类预测变量的基础回归。但为何只用一个变量来支持解释或预测?现在,您将把基础回归扩展为多元回归,从而在模型中纳入不止一个解释或预测变量。您将使用西雅图(华盛顿州)都会区的房屋数据集来建模房价。
4
模型评估与选择
前几章中,您拟合了多种模型来解释或预测关注的结果变量。然而,我们如何判断该选择哪些模型?模型评估度量可用于判断解释性模型对数据的"拟合"程度,或预测性模型的准确性。基于这些度量,您将学习判定"最佳"模型的准则。
R
Tidyverse 的数据建模
课程完成

