Build your ultimate AI agent
コース説明
優れたデータ可視化は、インパクトのあるデータサイエンスの要です。可視化は、データから洞察を見つけることにも、その洞察を相手に伝えることにも役立ちます。データサイエンティストを目指す過程で、誰もが散布図や棒グラフの基本は学びますが、可視化の真価は、データを「何を・なぜ・どのように」見せるかを一歩引いて考えたときに発揮されます。本コースでは、分析結果を効率的かつ効果的に伝えられる、説得力があり見た目に優れた可視化の作り方を学びます。データ比較、色の使い方、不確実性の表現、そして対象となる受け手に合った可視化の選び方を、全米の大気汚染とファーマーズマーケットのデータセットを用いて解説します。最後に、オープンアクセスのファーマーズマーケットデータを用いて、完成度が高く印象的なビジュアルレポートを作成して締めくくります。
前提条件
カリキュラム
コース概要
1
データを際立たせる
重要なポイントを見落とさせないようにしつつ、すべてのデータをどう見せればよいでしょうか?この章では、色によるハイライトやテキストで、閲覧者をデータの理解へ導く方法を解説します。あわせて、アメリカ全土の一般的な汚染物質の値に関するデータセットも紹介します。
2
可視化での色の使い方
色は、データ可視化で値をエンコードする強力な道具です。しかし、強力であるがゆえの注意点もあります。この章では、表示するデータの種類に基づいて、可視化に適したカラーパレットをどのように選ぶかを解説します。
3
不確実性を可視化する
不確実性はデータサイエンスの至るところに存在しますが、本来含めるべき可視化からしばしば省かれてしまいます。ここでは、信頼区間とは何かを復習し、単一の推定値と連続関数の双方に対する可視化方法を学びます。さらに、不確実性を評価するためのブートストラップ再標本化手法と、その適切な可視化方法についても説明します。
4
データサイエンスのワークフローにおける可視化
可視化はしばしば独立したテーマとして教えられ、ベストプラクティスも一般論として語られがちです。実際には、状況に応じてルールを柔軟に適用する必要があります。探索段階のラフな可視化から、最終成果物のフォントサイズの微調整まで、この章ではデータサイエンスのワークフロー各段階で可視化を最適化する方法を掘り下げます。
Pythonでデータ可視化を磨く
コース修了

