Ir al contenido principal

Curso

Procesamiento del lenguaje hablado en Python

Intermedio4 h

Aprende a cargar, transformar y transcribir voz a partir de archivos de audio sin procesar en Python.

Python4 h14 vídeos53 ejercicios4,400 XP9,145Certificado de logro

Crea tu cuenta gratis

Continuar con Google
o
Al continuar, aceptas nuestros los Términos de uso, nuestro la Política de privacidad y que tus datos se almacenan en EE. UU.

Les encanta a estudiantes de miles de empresas

¿Formando a un equipo?

Prueba para empresas

Descripción del curso

Aprende reconocimiento de voz y procesamiento del lenguaje hablado en Python

Aprendemos a hablar mucho antes de aprender a leer. Incluso en la era digital, vuestro principal método de comunicación es el habla. El procesamiento del lenguaje hablado en Python te ayudará a cargar, transformar y transcribir archivos de audio. Comenzarás viendo cómo es el audio sin procesar en Python y, a continuación, explorarás las bibliotecas más populares y trabajarás con un ejemplo de caso de uso empresarial.

Utiliza Python SpeechRecognition y PyDub para transcribir archivos de audio

Python cuenta con varias bibliotecas populares que te ayudan a procesar el lenguaje hablado. SpeechRecognition te ofrece una forma sencilla de integrarte con las API de conversión de voz a texto, mientras que PyDub te ayuda a modificar mediante programación los atributos de los archivos de audio para prepararlos para la transcripción. Cada una de estas bibliotecas se trata en un capítulo detallado, lo que te ofrece la oportunidad de poner en práctica la teoría para consolidar tus conocimientos.

Practica la transcripción de discursos con un proyecto dentro del curso.

El último capítulo de este curso te ofrece la oportunidad de poner en práctica todo lo que has aprendido creando una prueba de concepto de procesamiento del habla para una empresa tecnológica ficticia. Crearás un sistema que transcribe el audio de las llamadas telefónicas a texto y, a continuación, realiza un análisis de opiniones para revisar las llamadas telefónicas de atención al cliente.

Al finalizar este curso, tendrás tanto los conocimientos como la experiencia práctica necesarios para poner en práctica lo aprendido en tu trabajo o en tus proyectos personales.

Requisitos previos

Programa de formación

Contenido del curso

1

Introducción al procesamiento del lenguaje hablado con Python

Los archivos de audio son distintos a la mayoría de los demás tipos de datos. Antes de poder trabajar con ellos, requieren cierto preprocesamiento. En este capítulo, aprenderás los primeros pasos para trabajar con archivos de voz convirtiendo dos archivos de audio en ondas de sonido y comparándolas visualmente.
Empezar capítulo
2

Uso de la librería SpeechRecognition de Python

El reconocimiento de voz aún está lejos de ser perfecto. Pero la librería SpeechRecognition ofrece una forma sencilla de interactuar con muchas APIs de speech‑to‑text. En esta sección, aprenderás a usar SpeechRecognition para empezar a convertir con facilidad el lenguaje hablado de tus archivos de audio en texto.
Empezar capítulo
3

Manipulación de archivos de audio con PyDub

No todos los archivos de audio tienen la misma forma, tamaño o formato. Por suerte, la librería PyDub de James Robert proporciona herramientas con las que puedes modificar de forma programática distintos atributos de audio como la frecuencia de muestreo, el número de canales, el formato del archivo y más. En este capítulo, aprenderás a usar esta útil librería para asegurarte de que todos tus archivos de audio estén en el formato adecuado para su transcripción.
Empezar capítulo

Procesamiento del lenguaje hablado en Python

Curso
completado

Obtén el certificado de logro

Inscríbete ahora

Desarrolla tus habilidades con la aplicación móvil de DataCamp

Progresa sobre la marcha con nuestros cursos móviles y desafíos diarios de 5 minutos.