Rekaman Suara Menjadi Teks: Panduan Lengkap
Panduan lengkap rekaman suara menjadi teks: persiapan rekaman, pilihan mode output, langkah koreksi, dan estimasi biaya dan waktu.
Rekaman suara sudah ada, tapi mengubahnya jadi teks yang bisa dibaca dan dianalisis butuh langkah tersendiri. Panduan ini merangkum semua yang perlu kamu tahu tentang proses rekaman suara menjadi teks, dari persiapan rekaman sampai download hasil akhir.
Langkah 1: Persiapkan rekaman yang berkualitas
Kualitas transkripsi bergantung langsung pada kualitas rekaman. Beberapa hal yang perlu diperhatikan sebelum merekam: pilih ruangan dengan sedikit kebisingan latar, gunakan mikrofon eksternal kalau memungkinkan, jaga jarak mikrofon 20–30 cm dari pembicara, dan aktifkan mode pesawat di HP untuk menghindari notifikasi yang memotong rekaman.
Untuk wawancara dengan beberapa orang, letakkan perekam di tengah-tengah agar semua suara tertangkap dengan jelas.
Langkah 2: Pilih format file yang tepat
Rekaman suara menjadi teks paling efisien ketika file audio sudah dalam format yang didukung langsung. verbatim.id mendukung MP3, WAV, dan M4A. Format MP3 lebih kecil ukurannya, WAV kualitasnya lebih tinggi. Untuk wawancara penelitian, MP3 128kbps sudah cukup.
Hindari format yang butuh konversi dulu (seperti FLAC atau OGG) agar tidak ada langkah ekstra.
Langkah 3: Upload dan pilih mode transkripsi
Setelah file siap, upload ke verbatim.id. Pilih mode:
- Mode Verbatim: untuk lampiran skripsi, laporan penelitian kualitatif, atau dokumentasi hukum. Merekam kata per kata, termasuk
[jeda 2.4d],[tertawa], dan semua kata pengisi. - Mode Clean: untuk notulen rapat, ringkasan wawancara, atau konten yang langsung dibaca. Kata pengisi dihapus, teks lebih rapi.
Langkah 4: Koreksi dan finalisasi transkrip
Setelah proses selesai, buka file DOCX di Word atau Google Docs. Ganti label Pembicara 1 / Pembicara 2 dengan nama atau kode responden. Koreksi nama tempat, istilah teknis, atau kata-kata yang mungkin salah dikenali oleh AI.
Untuk audio berkualitas baik, koreksi biasanya tidak lebih dari 5–10 menit per jam audio.
Biaya dan waktu rekaman suara menjadi teks
verbatim.id mengenakan Rp127 per menit audio. Proses berlangsung dalam hitungan menit. Untuk 10 wawancara masing-masing 45 menit, total biaya sekitar Rp57.150 dan selesai dalam kurang dari 2 jam.
Dibandingkan transkripsi manual (rata-rata 40–60 jam kerja untuk 10 wawancara 45 menit), penghematannya sangat signifikan.
Tumpukan rekaman dari semua responden itu, bisa selesai dalam satu hari.