Build your ultimate AI agent
Descripción del curso
Gran parte de la investigación biológica, desde la medicina hasta la biotecnología, se está orientando al análisis de secuencias. Ahora generamos datos masivos de genomas completos y dirigidos que necesitan analizarse para responder a preguntas biológicas. Para ayudarte a empezar, te presentaremos el proyecto Bioconductor. Bioconductor es, y construye, la infraestructura para compartir herramientas de software (paquetes), flujos de trabajo y conjuntos de datos para el análisis y la comprensión de datos genómicos. Bioconductor es una plataforma excelente y accesible para ti, y es un recurso de software abierto desarrollado por la comunidad. Al final de este curso, podrás usar paquetes esenciales de Bioconductor y comprender su infraestructura y algunos conjuntos de datos incorporados. ¡Usar BSgenome, Biostrings, IRanges, GenomicRanges, TxDB, ShortRead y Rqc con conjuntos de datos reales de distintas especies será una experiencia excepcional!
Requisitos previos
Programa de formación
Contenido del curso
1
¿Qué es Bioconductor?
En este capítulo trabajarás directamente con Bioconductor. Bioconductor es el repositorio especializado de software de bioinformática, desarrollado y mantenido por la comunidad de R. Aprenderás a instalar y usar paquetes de Bioconductor. También conocerás los objetos y funciones S4, porque la mayoría de paquetes en Bioconductor heredan de S4. Además, usarás un conjunto de datos genómicos real de un hongo para explorar el paquete BSgenome.
- Introducción al proyecto Bioconductor50 XP
- Versión de Bioconductor100 XP
- BiocManager para instalar paquetes100 XP
- El papel de S4 en Bioconductor50 XP
- Definición de clase S450 XP
- Interacción con clases100 XP
- Introducción a la biología de los conjuntos de datos genómicos50 XP
- Descubriendo el genoma de la levadura100 XP
- Particionando el genoma de levadura100 XP
- Genomas disponibles50 XP
2
Biostrings y cuándo usarlas
Biostrings son contenedores de cadenas eficientes en memoria. Biostrings incluye algoritmos de búsqueda y otras utilidades para manipular rápidamente secuencias biológicas grandes o conjuntos de secuencias. ¿Cuán eficiente puedes ser usando los contenedores adecuados para tus secuencias? Aprenderás sobre alfabetos y manipulación de secuencias usando el pequeño genoma de un virus.
3
IRanges y GenomicRanges
Los paquetes IRanges y GenomicRanges también son contenedores para almacenar y manipular intervalos genómicos y variables definidas a lo largo de un genoma. Estos paquetes proporcionan infraestructura y soporte a muchos otros paquetes de Bioconductor gracias a sus funcionalidades. Aprenderás a usar estos contenedores y sus metadatos asociados para manipular tus secuencias. El conjunto de datos que verás es un gen especial de interés en el genoma humano.
4
Introducción a ShortRead
ShortRead es el paquete para la entrada, manipulación y evaluación de archivos fasta y fastq. Puedes crear subconjuntos, recortar y filtrar las secuencias de interés, e incluso generar un informe de calidad. Como extra en los últimos ejercicios tendrás herramientas para evaluación de calidad en paralelo, guiño, guiño: Rqc. ¡Y lo mejor es que para esto usarás secuencias de genoma de plantas!
R
Introducción a Bioconductor en R
Curso
completado

