Chuyển đến nội dung chính

Khóa học

Giới thiệu Bioconductor trong R

Trung cấp4 giờ

Học cách sử dụng các gói Bioconductor cơ bản cho phân tích sinh học bằng cách sử dụng dữ liệu từ virus, nấm, con người và thực vật!

R4 giờ14 video54 bài tập4,050 XP18,696Giấy chứng nhận thành tích

Tạo tài khoản miễn phí

Tiếp tục với Google
hoặc
Bằng việc tiếp tục, ban chấp nhận Điều khoản sử dụng, của chúng tôi Chính sách bảo mật và rằng dữ liệu của bạn được lưu trữ tại Hoa Kỳ.

Được người học tại hàng nghìn công ty yêu thích

Đào tạo đội ngũ?

Dùng thử cho Doanh nghiệp

Mô tả khóa học

Phần lớn nghiên cứu sinh học, từ y học đến công nghệ sinh học, đang chuyển dịch sang phân tích chuỗi. Chúng ta đang tạo ra dữ liệu lớn ở mức gene mục tiêu và toàn bộ bộ gene, cần được phân tích để trả lời các câu hỏi sinh học. Để bạn bắt đầu, khóa học sẽ giới thiệu Dự án Bioconductor. Bioconductor xây dựng và cung cấp hạ tầng để chia sẻ các công cụ phần mềm (package), quy trình làm việc và tập dữ liệu phục vụ phân tích và hiểu dữ liệu hệ gene. Bioconductor là một nền tảng tuyệt vời, dễ tiếp cận và là tài nguyên phần mềm mã nguồn mở do cộng đồng phát triển. Kết thúc khóa học, bạn sẽ biết cách dùng các package cốt lõi của Bioconductor và nắm được hạ tầng cùng một số tập dữ liệu tích hợp sẵn. Trải nghiệm làm việc với BSgenome, Biostrings, IRanges, GenomicRanges, TxDB, ShortRead và Rqc trên dữ liệu thực từ nhiều loài chắc chắn sẽ rất ấn tượng!

Yêu cầu tiên quyết

Chương trình học

Đề cương khóa học

1

Bioconductor là gì?

Trong chương này, bạn sẽ thực hành với Bioconductor. Bioconductor là kho chuyên biệt dành cho phần mềm tin sinh học, được phát triển và duy trì bởi cộng đồng R. Bạn sẽ học cách cài đặt và sử dụng các package của Bioconductor. Bạn cũng sẽ được giới thiệu về đối tượng và hàm S4, vì hầu hết các package trong Bioconductor đều kế thừa từ S4. Thêm vào đó, bạn sẽ dùng một tập dữ liệu hệ gene thực tế của một loài nấm để khám phá package BSgenome.
Bắt đầu chương
2

Biostrings và khi nào nên dùng?

Biostrings là các vùng chứa chuỗi tối ưu bộ nhớ. Biostrings có các thuật toán so khớp và nhiều tiện ích khác để thao tác nhanh trên các chuỗi sinh học lớn hoặc tập hợp chuỗi. Bạn có thể hiệu quả đến mức nào khi dùng đúng kiểu vùng chứa cho các chuỗi của mình? Bạn sẽ tìm hiểu về bảng chữ cái (alphabet) và cách thao tác chuỗi bằng bộ gene tí hon của một loại virus.
Bắt đầu chương
3

IRanges và GenomicRanges

Các package IRanges và GenomicRanges cũng là những vùng chứa để lưu trữ và thao tác các khoảng hệ gene và các biến được xác định dọc theo bộ gene. Nhờ các tính năng phong phú, chúng cung cấp hạ tầng và hỗ trợ cho nhiều package khác trong Bioconductor. Bạn sẽ học cách dùng những vùng chứa này và siêu dữ liệu đi kèm để thao tác các chuỗi của bạn. Tập dữ liệu bạn sẽ xem xét là một gene đặc biệt quan tâm trong hệ gene người.
Bắt đầu chương
4

Giới thiệu ShortRead

ShortRead là package để nhập, thao tác và đánh giá các tệp fasta và fastq. Bạn có thể chọn lọc, cắt tỉa và lọc các chuỗi quan tâm, và thậm chí tạo báo cáo chất lượng. Thêm một phần thú vị ở các bài tập cuối sẽ cung cấp cho bạn công cụ đánh giá chất lượng song song, gợi ý: Rqc. Hấp dẫn hơn nữa, bạn sẽ sử dụng các chuỗi hệ gene thực vật cho phần này!
Bắt đầu chương
R

Giới thiệu Bioconductor trong R

Hoàn
thành khóa học

Nhận Chứng nhận Hoàn thành

Đăng ký ngay

Phát triển kỹ năng dữ liệu với DataCamp for Mobile

Tiến bộ mọi lúc mọi nơi với các khóa học di động và thử thách lập trình 5 phút hàng ngày.