본문으로 바로가기

코스

R로 시작하는 Bioconductor

중급4시간

바이러스·곰팡이·인간·식물 데이터로 핵심 Bioconductor 패키지를 활용해 생물정보학 분석을 학습하세요!

R4시간14개 동영상54개 연습 문제4,050 XP18,675수료 확인서

무료 계정 만들기

Google에서 계속 진행
또는
계속 진행하시면 다음 약관에 동의하는 것으로 간주됩니다: 이용약관, 우리의 개인정보 처리방침 그리고 귀하의 데이터가 미국에 저장된다는 점입니다.

수천 개 기업의 학습자가 선택한 서비스

코스 설명

의학부터 바이오텍까지, 생물학 연구는 점차 서열 분석 중심으로 이동하고 있어요. 이제는 표적 유전체부터 전체 유전체까지 방대한 데이터를 생성하고 있으며, 이를 분석해 생물학적 질문에 답해야 합니다. 이 과정을 시작할 수 있도록 Bioconductor 프로젝트를 소개해 드립니다. Bioconductor는 유전체 데이터의 분석과 이해를 위해 소프트웨어 도구(패키지), 워크플로, 데이터셋을 공유하는 인프라를 제공하고 구축합니다. Bioconductor는 누구나 접근할 수 있고, 커뮤니티가 함께 개발하는 오픈 소프트웨어 자원이에요. 이 과정을 마치면 핵심 Bioconductor 패키지를 사용할 수 있고, 인프라와 일부 내장 데이터셋의 개념을 익히게 됩니다. 다양한 종의 실제 데이터와 함께 BSgenome, Biostrings, IRanges, GenomicRanges, TxDB, ShortRead, Rqc를 사용해 보는 흥미로운 경험이 될 거예요!

사전 요구 사항

커리큘럼

코스 개요

1

Bioconductor란 무엇인가요?

이 장에서는 Bioconductor를 직접 다뤄 보겠습니다. Bioconductor는 R 커뮤니티가 개발·유지하는 바이오인포매틱스 소프트웨어의 특화 저장소입니다. Bioconductor 패키지를 설치하고 사용하는 방법을 배우게 됩니다. 또한, Bioconductor의 대부분 패키지가 S4를 상속하므로 S4 객체와 함수도 함께 소개해요. 더불어 곰팡이의 실제 유전체 데이터셋을 사용해 BSgenome 패키지를 탐색해 봅니다.
챕터 시작하기
2

Biostrings와 활용 시점

Biostrings는 메모리 효율적인 문자열 컨테이너입니다. Biostrings는 대규모 생물학적 서열이나 서열 집합을 빠르게 다룰 수 있도록 매칭 알고리즘과 다양한 유틸리티를 제공합니다. 내 서열에 맞는 올바른 컨테이너를 사용하면 얼마나 효율이 좋아질까요? 바이러스의 작은 유전체를 이용해 알파벳과 서열 조작 방법을 익히게 됩니다.
챕터 시작하기
3

IRanges와 GenomicRanges

IRanges와 GenomicRanges 패키지는 유전체 상의 구간과 그에 정의된 변수를 저장하고 조작하기 위한 컨테이너입니다. 이 패키지들은 풍부한 기능 덕분에 많은 Bioconductor 패키지의 기반 인프라와 지원을 제공합니다. 이 컨테이너와 연관된 메타데이터를 활용해 서열을 조작하는 방법을 배우게 됩니다. 이번에 살펴볼 데이터셋은 인간 유전체에서 관심 유전자에 해당하는 특별한 예시입니다.
챕터 시작하기
4

ShortRead 소개

ShortRead는 fasta와 fastq 파일을 입력, 조작, 평가하기 위한 패키지입니다. 관심 있는 서열을 서브셋팅하고, 트리밍하고, 필터링할 수 있으며, 품질 보고서까지 생성할 수 있어요. 마지막 연습 문제에서는 병렬 품질 평가를 위한 도구도 함께 다루는데요, 바로 Rqc입니다. 게다가 식물 유전체 서열을 직접 사용해 보게 됩니다!
챕터 시작하기
R

R로 시작하는 Bioconductor

코스
완료

성취 확인서 획득하기

지금 등록하기

DataCamp for Mobile로 데이터 스킬을 키워보세요

모바일 강의와 매일 5분 코딩 챌린지로 이동 중에도 학습을 진행하세요.