メインコンテンツへスキップ

コース

Rで学ぶ自然言語処理入門

中級4 時間

Rでの自然言語処理に必須のスキルとツールを体系的に概観し、実務で活かす力を身につけます。

R4 時間15 本の動画47 個の演習3,750 XP8,577修了証明書

無料アカウントを作成

Google で続行
または
続行することで、 利用規約、私たちの プライバシーポリシー そして、あなたのデータが米国に保存されること。

何千もの企業の学習者に支持されています

チームのトレーニングをお考えですか?

ビジネス向けに試す

コース説明

本コース「Rで学ぶ自然言語処理入門」は、テキスト分析を始めるために必要な道具を身につけることを目的とした基礎講座です。Natural Language Processing (NLP) はデータサイエンスの中でも拡大し続けている分野で、過去10年で大きく進歩してきました。本コースでは、これらの基礎を押さえ、分析の幅を広げる準備を整えます。正規表現、トピックモデリング、固有表現抽出などを取り上げ、今後の分析をすぐに始められるよう、実践的な例を通して丁寧に解説します。

前提条件

カリキュラム

コース概要

1

本当の基礎から

「Rで学ぶ自然言語処理入門」の第1章では、はじめてのテキスト分析を実行できるよう準備します。正規表現とトークナイゼーションという、ほとんどの分析で頻出の2つの要素を学びます。正規表現を使うと、思いつくあらゆるパターンを検索でき、トークナイゼーションによって、より高度な分析に向けてテキストを整形・クレンジングできます。本章は、この後の章で学ぶテクニックに取り組むための必須の土台となります。
2

テキストの表現方法

この章では、テキストを分析するうえで最も一般的で研究の進んだ手法を学びます。テキストコーパスの作成、Bag-of-Words 表現から TFIDF 行列への拡張、さらにコサイン類似度を用いて2つのテキスト同士の近さを測る方法を見ていきます。第3章・第4章で NLP の応用に進む前に、NLP を実践するための基礎をさらに固めていきます。
3

応用:分類とトピックモデリング

第3章では、テキスト分析でよく使われる2つのアプローチ、分類モデルとトピックモデリングに焦点を当てます。テキスト分析のプロジェクトに取り組むと、いずれか、あるいは両方の手法を使うことになるでしょう。本章ではそれぞれの手法をどのように実行するかを学び、実務的な観点からの取り組み方についても理解を深めます。
4

発展的なテクニック

第4章では、自然言語処理の定番である感情分析と単語埋め込みを扱います。どちらもテキスト分析の基礎を学ぶうえで欠かせない手法です。さらに、BERT、品詞タグ付け、固有表現抽出についても簡潔に学びます。本コースでは合計で約15種類の分析手法を取り上げるため、第4章の最後に、学んだ主要なテクニックを振り返ります。
R

Rで学ぶ自然言語処理入門

コース修了

達成証明書を取得する

今すぐ登録

DataCamp for Mobileでデータスキルを磨きましょう

モバイルコースと毎日5分のコーディングチャレンジで、外出先でも学習を進めましょう。