Lewati ke konten utama

Kursus

Pemrosesan Bahasa Lisan dengan Python

Menengah4 jam

Pelajari cara memuat, mengolah, dan mentranskrip ucapan dari berkas audio mentah menggunakan Python.

Python4 jam14 video53 Latihan4,400 XP9,145Pernyataan pencapaian

Buat Akun Gratis Anda

Lanjutkan dengan Google
atau
Dengan melanjutkan, Anda menyetujui Ketentuan Penggunaan, kami Kebijakan Privasi dan bahwa data Anda disimpan di AS.

Disukai pelajar di ribuan perusahaan

Deskripsi Kursus

Pelajari Pengenalan Suara dan Pemrosesan Bahasa Lisan dalam Python

Kita belajar berbicara jauh sebelum kita belajar membaca. Bahkan di era digital, metode komunikasi utama kita tetaplah ucapan. Pemrosesan Bahasa Lisan dalam Python akan membantu Anda memuat, mengubah, dan mentranskrip berkas audio. Anda akan memulai dengan melihat seperti apa bentuk audio mentah dalam Python, kemudian melanjutkan dengan menjelajahi perpustakaan-perpustakaan populer, dan mengerjakan contoh kasus penggunaan bisnis.

Gunakan Python SpeechRecognition dan PyDub untuk mentranskrip berkas audio.

Python memiliki sejumlah perpustakaan populer yang membantu Anda memproses bahasa lisan. SpeechRecognition menyediakan cara mudah untuk mengintegrasikan dengan API pengenalan suara ke teks, sementara PyDub membantu Anda secara programatik mengubah atribut file audio agar siap untuk transkripsi. Setiap perpustakaan ini dibahas secara mendalam dalam bab tersendiri, memberikan Anda kesempatan untuk menerapkan teori ke dalam praktik guna memperkuat pemahaman Anda.

Latihan Transkripsi Ucapan dengan Proyek Dalam Kursus

Bab terakhir dalam kursus ini memberikan Anda kesempatan untuk mengaplikasikan semua yang telah Anda pelajari dengan membangun konsep bukti (proof of concept) pemrosesan suara untuk sebuah perusahaan teknologi fiktif. Anda akan membangun sistem yang mentranskrip audio panggilan telepon menjadi teks, kemudian melakukan analisis sentimen untuk meninjau panggilan telepon layanan pelanggan.

Pada akhir kursus ini, Anda akan memiliki pengetahuan dan pengalaman praktis yang diperlukan untuk menerapkan apa yang telah Anda pelajari dalam pekerjaan atau proyek pribadi Anda.

Prasyarat

Kurikulum

Garis besar kursus

1

Pengantar Pemrosesan Bahasa Lisan dengan Python

Berkas audio berbeda dengan sebagian besar jenis data lainnya. Sebelum dapat digunakan, berkas tersebut memerlukan prapemrosesan. Di bab ini, Anda akan mempelajari langkah awal bekerja dengan berkas ujaran dengan mengonversi dua berkas audio berbeda menjadi gelombang suara dan membandingkannya secara visual.
Mulai Bab
2

Menggunakan pustaka SpeechRecognition di Python

Pengenalan ujaran masih jauh dari sempurna. Namun pustaka SpeechRecognition menyediakan cara mudah untuk berinteraksi dengan banyak API speech-to-text. Di bagian ini, Anda akan mempelajari cara menggunakan pustaka SpeechRecognition untuk mulai mengonversi bahasa lisan dalam berkas audio Anda menjadi teks dengan mudah.
Mulai Bab
3

Memanipulasi Berkas Audio dengan PyDub

Tidak semua berkas audio memiliki bentuk, ukuran, atau format yang sama. Untungnya, pustaka PyDub oleh James Robert menyediakan alat yang dapat Anda gunakan untuk secara terprogram mengubah berbagai atribut berkas audio seperti laju bingkai, jumlah kanal, format berkas, dan lainnya. Di bab ini, Anda akan mempelajari cara menggunakan pustaka yang membantu ini untuk memastikan semua berkas audio Anda berada dalam kondisi yang tepat untuk ditranskripsi.
Mulai Bab

Pemrosesan Bahasa Lisan dengan Python

Kursus
Selesai

Dapatkan Sertifikat Penyelesaian

Daftar Sekarang

Kembangkan keterampilan data Anda dengan DataCamp untuk Mobile

Lanjutkan pembelajaran Anda di mana saja dengan kursus mobile kami dan tantangan coding 5 menit setiap hari.