본문으로 바로가기
R

강의

R로 배우는 자연어 처리 입문

중급기술 수준
업데이트됨 2024. 5.
R로 Natural Language Processing에서 성공하는 데 필요한 모든 기술과 도구를 한눈에 익히세요.
무료로 강의 시작
RMachine Learning
4시간
15 동영상
47 연습 문제
3,750 XP
8,565
성취 증명서

무료 계정 만들기

Google에서 계속 진행더 많은 옵션 보기

또는


계속 진행하시면 당사의 이용약관개인정보처리방침에 동의하고 및 귀하의 데이터가 미국에 저장되는 것에 동의하게 됩니다.

수천 개 기업의 학습자들이 사랑하는

Group

팀을 교육하시나요?

비즈니스용으로 체험해 보세요

강의 설명

이 기초 과정인 R로 배우는 자연어 처리 입문은 텍스트 분석을 시작하는 데 필요한 도구를 갖추도록 설계되었습니다. 자연어 처리(NLP)는 지난 10년간 눈에 띄는 발전을 이룬 데이터 과학의 지속적으로 성장하는 분야입니다. 이 과정에서는 정규 표현식, 토픽 모델링, 개체명 인식 등 기본 개념을 다루고, 향후 분석을 시작하는 데 바로 활용할 수 있는 충분한 예시를 제공합니다.

선수 조건

Intermediate RIntroduction to the Tidyverse
1

진짜 기초 다지기

R로 배우는 자연어 처리 입문 1장은 텍스트에 대한 첫 분석을 실행할 준비를 합니다. 대부분의 분석 작업에서 가장 흔히 쓰이는 두 구성 요소인 정규 표현식과 토큰화를 살펴봅니다. 정규 표현식을 사용하면 떠올릴 수 있는 어떤 패턴이든 검색할 수 있고, 토큰화를 통해 더 정교한 분석을 위해 텍스트를 준비하고 정제할 수 있어요. 이 장은 이후 장에서 배울 기법을 다루기 위한 필수 기반이 됩니다.
챕터 시작
2

텍스트 표현 방식

이 장에서는 텍스트를 분석하는 데 가장 널리 쓰이고 연구된 방법을 학습합니다. 텍스트 코퍼스를 만들고, bag-of-words 표현을 TFIDF 행렬로 확장한 뒤, 코사인 유사도 지표를 사용해 두 텍스트가 서로 얼마나 비슷한지 판단해 봅니다. 이렇게 NLP 연습을 위한 기초를 다진 뒤 3장과 4장에서 NLP의 응용으로 들어갈 준비를 하게 됩니다.
챕터 시작
3

응용: 분류와 토픽 모델링

3장에서는 텍스트 분석에서 흔히 쓰이는 두 가지 접근법, 분류 모델링과 토픽 모델링에 집중합니다. 텍스트 분석 프로젝트를 진행하다 보면 결국 이 방법들 중 하나 또는 둘 다를 사용하게 됩니다. 이 장에서는 두 기법을 수행하는 방법을 배우고, 실무적인 관점에서 이 기법들에 어떻게 접근할지에 대한 통찰도 제공합니다.
챕터 시작
4

고급 기법

4장에서는 자연어 처리의 핵심인 감성 분석과 단어 임베딩을 다룹니다. 이는 텍스트 분석의 기초를 배우는 분들께 꼭 필요한 두 가지 기법입니다. 더불어 BERT, 품사 태깅, 개체명 인식에 대해서도 간단히 배웁니다. 이 과정에서는 거의 15가지에 달하는 분석 기법을 살펴보므로, 4장은 이 과정에서 배우게 될 뛰어난 기법들을 다시 정리하며 마무리합니다.
챕터 시작
R로 배우는 자연어 처리 입문
강의
완료

수료증 획득

LinkedIn 프로필, 이력서 또는 CV에 이 인증서를 추가하세요
소셜 미디어와 성과 평가에서 공유하세요
지금 등록

19백만 명 이상의 학습자와 함께 R로 배우는 자연어 처리 입문을(를) 시작하세요!

무료 계정 만들기

Google에서 계속 진행더 많은 옵션 보기

또는


계속 진행하시면 당사의 이용약관개인정보처리방침에 동의하고 및 귀하의 데이터가 미국에 저장되는 것에 동의하게 됩니다.

DataCamp for Mobile을 통해 데이터 분석 능력을 향상시키세요.

모바일 강좌와 매일 5분 코딩 챌린지를 통해 이동 중에도 학습 효과를 높이세요.