본문으로 바로가기

코스

R로 배우는 자연어 처리 입문

중급4시간

R로 Natural Language Processing에서 성공하는 데 필요한 모든 기술과 도구를 한눈에 익히세요.

R4시간15개 동영상47개 연습 문제3,750 XP8,577수료 확인서

무료 계정 만들기

Google에서 계속 진행
또는
계속 진행하시면 다음 약관에 동의하는 것으로 간주됩니다: 이용약관, 우리의 개인정보 처리방침 그리고 귀하의 데이터가 미국에 저장된다는 점입니다.

수천 개 기업의 학습자가 선택한 서비스

코스 설명

이 기초 과정인 R로 배우는 자연어 처리 입문은 텍스트 분석을 시작하는 데 필요한 도구를 갖추도록 설계되었습니다. 자연어 처리(NLP)는 지난 10년간 눈에 띄는 발전을 이룬 데이터 과학의 지속적으로 성장하는 분야입니다. 이 과정에서는 정규 표현식, 토픽 모델링, 개체명 인식 등 기본 개념을 다루고, 향후 분석을 시작하는 데 바로 활용할 수 있는 충분한 예시를 제공합니다.

사전 요구 사항

커리큘럼

코스 개요

1

진짜 기초 다지기

R로 배우는 자연어 처리 입문 1장은 텍스트에 대한 첫 분석을 실행할 준비를 합니다. 대부분의 분석 작업에서 가장 흔히 쓰이는 두 구성 요소인 정규 표현식과 토큰화를 살펴봅니다. 정규 표현식을 사용하면 떠올릴 수 있는 어떤 패턴이든 검색할 수 있고, 토큰화를 통해 더 정교한 분석을 위해 텍스트를 준비하고 정제할 수 있어요. 이 장은 이후 장에서 배울 기법을 다루기 위한 필수 기반이 됩니다.
챕터 시작하기
2

텍스트 표현 방식

이 장에서는 텍스트를 분석하는 데 가장 널리 쓰이고 연구된 방법을 학습합니다. 텍스트 코퍼스를 만들고, bag-of-words 표현을 TFIDF 행렬로 확장한 뒤, 코사인 유사도 지표를 사용해 두 텍스트가 서로 얼마나 비슷한지 판단해 봅니다. 이렇게 NLP 연습을 위한 기초를 다진 뒤 3장과 4장에서 NLP의 응용으로 들어갈 준비를 하게 됩니다.
챕터 시작하기
3

응용: 분류와 토픽 모델링

3장에서는 텍스트 분석에서 흔히 쓰이는 두 가지 접근법, 분류 모델링과 토픽 모델링에 집중합니다. 텍스트 분석 프로젝트를 진행하다 보면 결국 이 방법들 중 하나 또는 둘 다를 사용하게 됩니다. 이 장에서는 두 기법을 수행하는 방법을 배우고, 실무적인 관점에서 이 기법들에 어떻게 접근할지에 대한 통찰도 제공합니다.
챕터 시작하기
4

고급 기법

4장에서는 자연어 처리의 핵심인 감성 분석과 단어 임베딩을 다룹니다. 이는 텍스트 분석의 기초를 배우는 분들께 꼭 필요한 두 가지 기법입니다. 더불어 BERT, 품사 태깅, 개체명 인식에 대해서도 간단히 배웁니다. 이 과정에서는 거의 15가지에 달하는 분석 기법을 살펴보므로, 4장은 이 과정에서 배우게 될 뛰어난 기법들을 다시 정리하며 마무리합니다.
챕터 시작하기
R

R로 배우는 자연어 처리 입문

코스
완료

성취 확인서 획득하기

지금 등록하기

DataCamp for Mobile로 데이터 스킬을 키워보세요

모바일 강의와 매일 5분 코딩 챌린지로 이동 중에도 학습을 진행하세요.

R로 배우는 자연어 처리 입문 | DataCamp