Repository ini menyediakan skrip sederhana menggunakan Python untuk mentranskripsi audio dari video YouTube menjadi teks. Skrip ini menggunakan Libary PyTube untuk mengunduh audio dari video YouTube, model Whisper ASR (Automatic Speech Recognition) dari OpenAI untuk mentranskripsi, dan Langdetect untuk deteksi bahasa.
| No | Nama | NIM |
|---|---|---|
| 1 | Abdurrahman Ridho | 21.11.4341 |
| 2 | Oxa Defrizal Khasay | 21.11.4388 |
| 3 | Hamim Nur Khamid | 21.11.4395 |
Proyek ini terinspirasi dan diadaptasi dari javedali99/audio-to-text-transcription. Terima kasih khusus kepada penulis asli yang menyediakan dasar untuk alat transkripsi ini.
Sebelum menjalankan skrip, pastikan untuk menginstal ketergantungan yang diperlukan:
!pip install pytube
!pip install git+https://github.com/openai/whisper.git
!pip install langdetect- Klon repository ini: https://github.com/OxaDefrizal/ml_transcribe_video.git
- Jalankan skrip:
- Masukkan URL video YouTube ketika diminta.
- Skrip akan mengunduh audio, mentranskripsikannya menjadi teks, dan menyimpannya dalam file teks (misalnya, Hasil Transkripsi_id.txt). Bahasa secara otomatis terdeteksi.
- PyTube: Mengambil konten YouTube.
- Whisper ASR: Model ASR dari OpenAI.
- Langdetect: Mendeteksi bahasa dari teks yang ditranskripsi.
- Input Video YouTube: Pengguna memberikan URL video YouTube.
- Unduh Audio: PyTube mengunduh aliran audio.
- Transkripsi: Whisper ASR mentranskripsi audio.
- Deteksi Bahasa: Langdetect menentukan bahasa.
- Output Teks: Teks yang ditranskripsi disimpan dalam file dengan informasi bahasa.
Kontribusi dipersilakan. Laporkan masalah atau usulkan perbaikan melalui GitHub.