Build your ultimate AI agent
Descrição do curso
Aprenda Reconhecimento de Fala e Processamento de Linguagem Falada em Python
Aprendemos a falar muito antes de aprender a ler. Mesmo na era digital, nosso principal método de comunicação é a fala. O Processamento de Linguagem Falada em Python vai ajudar você a carregar, transformar e transcrever arquivos de áudio. Você começará vendo como o áudio bruto se apresenta em Python e, em seguida, explorará bibliotecas populares e trabalhará em um exemplo de caso de uso de negócios.Use Python SpeechRecognition e PyDub para transcrever arquivos de áudio
Python tem várias bibliotecas populares que ajudam você a processar linguagem falada. SpeechRecognition oferece uma maneira fácil de integrar com APIs de fala para texto, enquanto PyDub ajuda você a alterar programaticamente os atributos de arquivos de áudio para deixá-los prontos para transcrição. Cada uma dessas bibliotecas é abordada em um capítulo aprofundado, oferecendo a você a oportunidade de praticar a teoria para consolidar seu conhecimento.Pratique a transcrição de fala com um projeto no curso
O capítulo final deste curso oferece a você a oportunidade de reunir tudo o que aprendeu construindo uma prova de conceito de processamento de fala para uma empresa de tecnologia fictícia. Você vai construir um sistema que transcreve o áudio de chamadas telefônicas em texto e, em seguida, realiza análise de sentimento para revisar chamadas de suporte ao cliente.Ao final deste curso, você terá tanto o conhecimento quanto a experiência prática para colocar o que aprendeu em prática no seu trabalho ou em projetos pessoais.
Pré-requisitos
Programa de estudos
Conteúdo do curso
1
Introdução ao Processamento de Linguagem Falada com Python
Arquivos de áudio são diferentes da maioria dos outros tipos de dados. Antes de começar a trabalhar com eles, é preciso fazer algum pré-processamento. Neste capítulo, você vai aprender os primeiros passos para trabalhar com arquivos de fala, convertendo dois arquivos de áudio diferentes em ondas sonoras e comparando-os visualmente.
- Introdução aos dados de áudio em Python50 XP
- A frequência certa50 XP
- Importando um arquivo de áudio com Python100 XP
- Convertendo bytes de ondas sonoras em inteiros50 XP
- O tipo de dado certo50 XP
- Bytes para inteiros100 XP
- Encontrando os carimbos de tempo100 XP
- Visualizando ondas sonoras50 XP
- Mantendo a consistência50 XP
- Processando dados de áudio com Python100 XP
2
Usando a biblioteca SpeechRecognition do Python
O reconhecimento de fala ainda está longe de ser perfeito. Mas a biblioteca SpeechRecognition oferece uma forma simples de interagir com muitas APIs de conversão de fala em texto. Nesta seção, você vai aprender a usar a SpeechRecognition para começar a converter com facilidade a linguagem falada nos seus arquivos de áudio em texto.
3
Manipulando arquivos de áudio com PyDub
Nem todos os arquivos de áudio têm o mesmo formato, tamanho ou estrutura. Felizmente, a biblioteca PyDub, criada por James Robert, oferece ferramentas para alterar programaticamente diferentes atributos de arquivos de áudio, como taxa de amostragem, número de canais, formato do arquivo e mais. Neste capítulo, você vai aprender a usar essa biblioteca útil para garantir que todos os seus arquivos de áudio estejam no formato certo para transcrição.
4
Processando texto transcrito de linguagem falada
Neste capítulo, você vai reunir tudo o que aprendeu construindo uma prova de conceito de processamento de fala para uma empresa de tecnologia, a Acme Studios. Você vai começar transcrevendo trechos de áudios de chamadas do suporte ao cliente para texto. Em seguida, vai realizar análise de sentimentos com NLTK, reconhecimento de entidades nomeadas com spaCy e classificação de texto com scikit-learn no texto transcrito.
Processamento de Linguagem Falada em Python
Curso
concluído

