Build your ultimate AI agent
课程介绍
真实世界的数据常常令人头疼——当面对一个复杂又凌乱的数据集时,您可能会想:该从哪里下手?tidyr 包可以把这些"猛兽"整理成整洁的数据集。那些藏在列名里的不可访问取值会被放回到行里,JSON 文件会变成数据框,缺失值也将得到妥善处理。您将把这些技术应用到各类杂乱的数据集上,并在过程中了解苏联送上太空的狗有多少、以及新西兰最受欢迎的鸟是什么。把 tidyr 加入您的 tidyverse 工具箱后,您几乎可以把任何数据集转换为整洁格式,为后续分析打下良好基础。
先修要求
课程大纲
课程大纲
1
整洁数据
本章将介绍本课程的核心概念——整洁数据。前两节课,您将直接上手,把杂乱的字符列拆分为整洁的变量与观测,便于后续分析。最后一节课,您将学习如何覆盖与移除缺失值。
2
宽表与长表之间的转换
本章将围绕使用 `pivot_longer()` 和 `pivot_wider()` 在宽表与长表之间进行转换。当变量被隐藏在凌乱的列名中,或变量被存放在行而非列中时,您就需要用到这些函数。在练习中,您还会顺带了解太空犬、核弹与行星温度等数据话题。
3
扩展数据
数据中经常会有缺失值,有时甚至整条观测都会缺失。本章将带您用缺失的观测来补全数据集。您会为计数数据添加取值为 0 的观测,扩展时间序列到完整的区间序列,等等。
4
矩形化数据
最后一章,您将学习如何把 JSON、XML 等嵌套数据结构转换为整洁的"矩形"数据。这项技能能帮助您处理来自 Web API 的数据。您还将学习如何利用嵌套数据结构编写优雅的建模流程,并产生成整洁的输出。
R
使用 tidyr 重塑数据
课程完成

