Build your ultimate AI agent
课程介绍
出色的数据可视化是高影响力数据科学的基石。可视化既能帮助您从数据中发现洞见,也能将这些洞见清晰传达给受众。成为数据科学家的过程中,大家都会学会绘制基础的散点图或柱状图,但当您退一步,思考在可视化中呈现什么、为什么、以及如何呈现时,数据可视化的真正潜力才会释放。在本课程中,您将学习如何构建引人注目且美观的可视化,使您能够高效、有效地交流分析结果。我们将涵盖数据比较、颜色的用法、如何展示不确定性,以及如何根据目标受众选择合适的可视化;并以美国各地空气污染与农贸市场的数据集为例展开讲解。课程最后,我们将利用开放获取的农贸市场数据,制作一份精炼而有影响力的可视化报告。
先修要求
课程大纲
课程大纲
1
突出重点数据
如何在呈现全部数据的同时,确保观众不会错过关键点?本节将讨论如何用基于颜色的高亮与文本来引导观众理解数据。我们还将介绍一个涵盖全美常见污染物数值的数据集。
2
在可视化中使用颜色
颜色是在数据可视化中编码取值的强大工具。但能力越大,风险也越大。本章将根据数据类型,讨论如何为您的可视化选择合适的配色方案。
3
展示不确定性
不确定性在数据科学中无处不在,但在许多本该呈现的可视化中却常被忽略。本章将回顾什么是置信区间,以及如何为点估计与连续函数进行可视化展示。此外,我们将讨论用于评估不确定性的自助法重采样技术,以及如何正确地将其可视化。
4
数据科学流程中的可视化
可视化常被割裂地教授,最佳实践多以概论形式出现。而在实际工作中,您需要根据场景灵活调整。从凌乱的探索性图表到打磨最终成品的字体大小;本章将深入讲解如何在数据科学流程的各个阶段优化您的可视化。
用 Python 提升数据可视化
课程完成

