Przejdź do głównej treści

Kurs

Przetwarzanie mowy w Pythonie

Średniozaawansowany4 godz.

Naucz się ładować, przekształcać i transkrybować mowę z surowych plików audio w Pythonie.

Python4 godz.{count, plural, one {# film} few {# filmy} many {# filmów} other {# filmów}}{count, plural, one {# ćwiczenie} few {# ćwiczenia} many {# ćwiczeń} other {# ćwiczenia}}4,400 XP9,141Oświadczenie o ukończeniu

Utwórz bezpłatne konto

Kontynuuj z Google
lub
Kontynuując, akceptujesz nasz Warunki użytkowania, nasz Polityka prywatności i że Twoje dane są przechowywane w USA.

Uwielbiany przez uczących się w tysiącach firm

Szkolisz zespół?

Wypróbuj dla firm

Opis kursu

Poznaj rozpoznawanie mowy i przetwarzanie języka mówionego w Pythonie

Uczymy się mówić na długo przed tym, zanim nauczymy się czytać. Nawet w erze cyfrowej naszym głównym sposobem komunikacji jest mowa. Przetwarzanie mowy w Pythonie pomoże Ci wczytywać, przekształcać i transkrybować pliki audio. Zaczniesz od zobaczenia, jak wygląda surowy dźwięk w Pythonie, a następnie przejdziesz do poznawania popularnych bibliotek i przepracujesz przykład biznesowego zastosowania.

Użyj Python SpeechRecognition i PyDub do transkrypcji plików audio

Python ma wiele popularnych bibliotek, które pomagają w przetwarzaniu języka mówionego. SpeechRecognition oferuje łatwy sposób integracji z interfejsami API zamiany mowy na tekst, a PyDub pomaga programowo modyfikować atrybuty plików audio, aby przygotować je do transkrypcji. Każda z tych bibliotek jest omówiona w szczegółowym rozdziale, dając Ci możliwość przełożenia teorii na praktykę i utrwalenia swojej wiedzy.

Ćwicz transkrypcję mowy w ramach projektu w kursie

Ostatni rozdział tego kursu daje Ci możliwość połączenia wszystkiego, czego się nauczyłeś, poprzez zbudowanie proof of concept przetwarzania mowy dla fikcyjnej firmy technologicznej. Zbudujesz system, który przekształca nagrania rozmów telefonicznych na tekst, a następnie przeprowadza analizę sentymentu, aby ocenić rozmowy telefoniczne z obsługą klienta.

Po ukończeniu tego kursu będziesz mieć zarówno wiedzę, jak i praktyczne doświadczenie, aby wykorzystać to, czego się nauczysz, w swojej pracy lub projektach osobistych.

Wymagania wstępne

Program kursu

Plan kursu

1

Wprowadzenie do przetwarzania mowy w Pythonie

Pliki audio różnią się od większości innych typów danych. Zanim zaczniesz z nimi pracować, wymagają wstępnego przetwarzania. W tym rozdziale poznasz pierwsze kroki pracy z plikami dźwiękowymi – nauczysz się przekształcać dwa różne pliki audio w fale dźwiękowe i porównywać je wizualnie.
Rozpocznij rozdział
2

Biblioteka SpeechRecognition w Pythonie

3

Manipulowanie plikami audio za pomocą PyDub

Pliki audio nie zawsze mają ten sam format, rozmiar czy strukturę. Na szczęście biblioteka PyDub autorstwa Jamesa Roberta dostarcza narzędzi, które pozwalają programowo modyfikować różne właściwości plików audio – takie jak częstotliwość próbkowania, liczba kanałów czy format pliku. W tym rozdziale nauczysz się korzystać z tej przydatnej biblioteki, aby przygotować pliki audio do transkrypcji.
Rozpocznij rozdział

Przetwarzanie mowy w Pythonie

Kurs
ukończony

Zdobądź Certyfikat Ukończenia

Zapisz się

Rozwijaj swoje umiejętności danych z DataCamp for Mobile

Rozwijaj się w drodze dzięki naszym kursom mobilnym i codziennym 5-minutowym wyzwaniom kodowania.

Przetwarzanie mowy w Pythonie | DataCamp