Panduan Lengkap Transkripsi Audio untuk Pemula
Panduan transkripsi audio untuk pemula: cara merekam yang benar, perbedaan output verbatim vs clean, langkah upload ke verbatim.id, dan koreksi hasil.
Transkripsi audio untuk pemula terasa rumit sampai kamu tahu ada dua bagian yang harus dikuasai: cara merekam yang benar, dan cara memproses rekaman itu jadi teks. Panduan ini membahas keduanya, dari awal sampai kamu punya dokumen transkrip yang siap dipakai.
Apa itu transkripsi audio?
Transkripsi audio adalah proses mengubah rekaman suara menjadi tulisan. Hasilnya disebut transkrip. Ini bukan terjemahan, hanya mengubah bentuk dari audio ke teks dalam bahasa yang sama.
Transkripsi digunakan untuk banyak keperluan: lampiran wawancara skripsi, notulen rapat, subtitle video, arsip podcast, sampai dokumentasi wawancara kerja.
Dua jenis output transkripsi audio
Sebelum mulai, tentukan dulu output yang kamu butuhkan:
- Verbatim: kata per kata persis seperti yang diucapkan, termasuk kata pengisi, jeda (
[jeda 2.4d]), dan ekspresi non-verbal ([tertawa]). Dibutuhkan untuk lampiran skripsi dan penelitian kualitatif. - Clean: teks yang sudah dirapikan, kata pengisi dihapus, mudah dibaca. Cocok untuk notulen rapat, artikel blog dari podcast, atau ringkasan wawancara.
Cara merekam audio untuk transkripsi
Kualitas rekaman menentukan kualitas transkripsi. Rekam di ruangan tenang. Gunakan mikrofon eksternal kalau ada, atau pastikan HP tidak terlalu jauh dari pembicara. Aktifkan mode pesawat selama merekam untuk menghindari gangguan. Untuk wawancara dengan dua orang, letakkan perekam di antara pembicara.
Format rekaman yang dihasilkan tidak terlalu penting selama itu MP3, WAV, atau M4A.
Cara transkripsi audio dengan AI
Setelah rekaman siap, langkah transkripsi audio dengan verbatim.id:
- Buka verbatim.id di browser (tidak perlu install aplikasi)
- Upload file audio
- Pilih mode Verbatim atau Clean
- Bayar saldo menit via QRIS
- Download hasil transkrip dalam DOCX atau PDF
Cara koreksi transkrip hasil AI
Buka file DOCX di Word atau Google Docs. Ganti label "Pembicara 1" dengan nama responden. Baca sekilas dan koreksi nama orang, tempat, atau istilah teknis yang salah dikenali. Untuk audio berkualitas baik, koreksi biasanya tidak lebih dari 10–15 menit per jam rekaman.
Rekaman yang belum ditranskrip itu, bisa jadi dokumen siap analisis hari ini.