跳至内容

课程

Python 中的无监督学习

中级4 小时

学习如何使用 scikit-learn 和 scipy 对无标签数据集进行聚类、转换、可视化并提取洞察。

Python4 小时13 个视频52 个练习4,150 经验值180K+结业证明

创建您的免费账户

继续使用 Google
继续即表示您接受我们的 使用条款,我们的 隐私政策 并且您的数据存储在美国。

深受上千家公司学习者喜爱

要培训团队?

试用企业版

课程介绍

设想您手里有一组客户数据,包含年龄、所在地、财务历史等多种特征,您希望找出其中的模式并将他们分成簇。或者,您有一组文本(如 Wikipedia 页面),希望根据内容将其划分为不同类别。这就是无监督学习:之所以称为"无监督",是因为您并未通过某个预测任务来引导或监督模式发现,而是从未标注的数据中挖掘潜在结构。无监督学习涵盖机器学习中的多种技术,从聚类到降维再到矩阵分解。在本课程中,您将学习无监督学习的基础,并使用 scikit-learn 和 SciPy 实现核心算法。您将学会如何对未标注的数据集进行聚类、变换、可视化与洞察提取,并在课程最后构建一个推荐系统,为用户推荐受欢迎的音乐艺术家。视频带有实时字幕,您可以点击视频左下角的 "Show transcript" 展开查看。 课程术语表位于右侧的资源部分。若要获得 CPE 学分,您需要完成课程并在合格评估中达到 70% 的得分。您可以点击右侧的 CPE 学分提示进入评估。

先修要求

课程大纲

课程大纲

2

层次聚类与 t-SNE 的可视化

本章将介绍两种用于数据可视化的无监督学习技术:层次聚类与 t-SNE。层次聚类把数据样本不断合并为更粗的簇,并生成表示簇层级关系的树状可视化。t-SNE 将数据样本映射到 2 维空间,从而可以直观展示样本之间的相互接近程度。
开始本章
3

数据去相关与降维

降维通过提取常见模式来概括数据集。在本章中,您将学习最基础的降维技术——"主成分分析"("PCA")。PCA 常用于有监督学习之前,以提升模型性能与泛化能力。它对无监督学习同样有用。例如,您将使用一种 PCA 的变体,根据内容对 Wikipedia 文章进行聚类!
开始本章

Python 中的无监督学习

课程完成

获取成就证书

立即报名

通过 DataCamp for Mobile 提升您的数据技能

通过我们的移动课程和每日 5 分钟编程挑战,随时随地取得进步。

Python 中的无监督学习 | DataCamp