Build your ultimate AI agent
课程介绍
科学家的主要目标之一是从数据中发现模式,并构建模型来描述、预测并从这些模式中提炼洞见。最基础的模式之一就是两个变量之间的线性关系。本课程将通过最小二乘、线性回归、估计以及自助法重采样等技术,带您初步了解如何探索、量化并建模数据中的线性关系。您将使用 Python 数据科学生态中的强大建模工具,包括 scipy、statsmodels 和 scikit-learn,来构建并评估线性模型。通过用 Python 探索线性模型的概念与应用,本课程既是建模的实用入门,也为您进一步学习统计学与机器学习中的更高级建模技术与工具打下基础。
先修要求
课程大纲
课程大纲
1
探索线性趋势
我们将从对线性关系的初步探索开始,包括一些关于线性模型如何应用的动机示例,以及使用 matplotlib 进行数据可视化的演示。随后用描述性统计来量化数据的形状,并使用相关性来量化两个变量之间线性关系的强度。
2
构建线性模型
本章将剖析构建线性模型所需的要素。结合泰勒级数的概念,我们聚焦斜率与截距两个参数,说明它们如何定义模型,并在若干应用场景中解读它们的含义。我们将使用多种 Python 模块,通过最小二乘、numpy、statsmodels 和 scikit-learn 来计算斜率与截距的最优值,从而找到最契合数据的模型。
3
进行模型预测
接下来我们会将模型应用于真实数据并进行预测。我们将探讨预测中常见的误区与局限,并通过量化与比较多种拟合优度指标(包括 RMSE 与 R-squared)来评估与对比模型。
4
估计模型参数
在最后一章中,我们将引入推断统计学的概念,并据此探讨如何利用极大似然估计与自助法重采样来估计线性模型参数。随后应用这些方法,对我们对模型参数的把握程度给出概率性的表述。
Python 线性建模入门
课程完成

