Konverter audio ke teks

Ubah rekaman audio menjadi teks dengan akurasi tinggi. Ideal untuk transkripsi wawancara, kuliah, dan dokumen penting.


Pilih berkas audio atau video Anda

MP3, WAV, M4A, OGG, FLAC, WEBM, MP4, MOV dan lainnya

Hingga 20 MB dan 15 menit per berkas.

100% gratis Tanpa pendaftaran Berkas dihapus setelahnya
Menyebutkan bahasanya lebih andal daripada membiarkannya dideteksi, terutama pada rekaman pendek atau berisik.

Apa yang terjadi pada berkas Anda

Berkas Anda dikirim ke server kami, ditranskripsikan di sana, lalu dihapus begitu transkripnya siap. Berkas itu tidak diarsipkan, tidak dicadangkan, dan tidak didengarkan siapa pun. Kami tidak meminta akun maupun alamat email, jadi tidak ada yang menghubungkan sebuah rekaman dengan Anda. Transkripnya hanya tampil di halaman yang Anda terima kembali, jadi begitu halaman itu ditutup, hilang juga dari sisi kami.

  • Berkas yang diunggah dihapus pada saat transkrip selesai dibuat.
  • Tanpa akun, tanpa alamat email, tanpa catatan apa yang Anda transkripsikan.
  • Transkripsi berjalan di mesin kami sendiri, jadi audio Anda tidak pernah diserahkan ke layanan pihak ketiga.

Cara mengubah audio menjadi teks

  1. Pilih berkas audio atau video Anda.
  2. Sebutkan bahasa yang diucapkan jika Anda tahu, atau biarkan otomatis.
  3. Tekan Transkripsikan lalu tunggu. Rekaman pendek kembali dalam hitungan detik, 15 menit penuh butuh sekitar satu menit.
  4. Salin teksnya, atau unduh sebagai TXT, SRT, atau takarir VTT.

Format yang didukung

Berkas audio maupun video sama sama bisa. Ini yang umum dipakai.

Jenis Format
Audio MP3, WAV, M4A, AAC, OGG, OPUS, FLAC, WMA, WEBM
Video MP4, MOV, WEBM, MKV, AVI, 3GP (jalur audionya yang dipakai)
Ekspor TXT teks biasa, SRT takarir, VTT takarir web

Jawaban singkat

Untuk mengubah audio menjadi teks secara gratis, pilih berkas MP3, WAV, M4A, atau MP4 Anda di atas, tentukan bahasa yang diucapkan, lalu tekan Transkripsikan. Untuk rekaman pendek transkrip kembali dalam hitungan detik dan bisa diunduh sebagai TXT, SRT, atau VTT. Tidak perlu akun dan berkas Anda dihapus begitu transkripnya siap.

Apa itu pengubah audio menjadi teks?

Pengubah audio menjadi teks mendengarkan sebuah rekaman lalu menuliskan apa yang diucapkan. Pekerjaannya sama dengan juru transkrip manusia, hanya saja model pengenalan suara menyelesaikannya dalam waktu yang jauh lebih singkat. Orang memakainya untuk wawancara, kuliah, podcast, memo suara, rekaman rapat, dan takarir video.

Batas dan kecepatan

Berkas boleh sampai 20 MB dan 15 menit. Rekaman 15 menit kembali dalam sekitar satu menit, sedangkan pesan suara pendek dalam beberapa detik. Kalau Anda punya wawancara panjang, memecahnya pada jeda alami lebih baik daripada memaksakan satu berkas besar.

Seberapa akurat?

Ucapan jernih dengan sedikit derau latar dialihkan dengan sangat baik. Akurasi menurun bila ada suara bertumpuk, aksen kental, musik di bawah suara, dan rekaman berkualitas telepon. Angka, nama diri, dan istilah teknis biasanya perlu diperiksa manual. Anggap hasilnya draf pertama yang kuat, bukan dokumen jadi.

Agar transkrip lebih baik

  • Sebutkan bahasa yang diucapkan alih alih membiarkannya otomatis.
  • Rekam sedekat mungkin dengan pembicara. Jarak mikrofon lebih menentukan daripada format berkas.
  • Jika ada musik atau derau di bawah suara, bersihkan dulu sebelum mentranskripsikan.
  • Pecah rekaman panjang pada jeda alami agar tidak ada kalimat yang terpotong.
  • Ruangan yang sunyi lebih berharga daripada mikrofon mahal. Benahi ruangannya dulu.

Pertanyaan yang sering diajukan

Ya, tanpa akun, tanpa masa uji coba, dan tanpa tanda air pada hasilnya. Kami menjalankan model suara di server sendiri alih alih membayar pihak ketiga per menit, dan itulah yang membuatnya bisa ditawarkan tanpa biaya dan tanpa dinding pendaftaran.

Berkas diunggah, ditranskripsikan, lalu langsung dihapus. Tidak diarsipkan, tidak dicadangkan, dan tidak ada orang yang mendengarkannya. Karena tidak ada akun, sejak awal tidak ada yang menghubungkan rekaman dengan Anda. Transkrip hanya muncul di halaman yang Anda terima, jadi menutup halaman itu mengakhiri semuanya.

Dua puluh megabita dan lima belas menit per berkas. Ada juga jeda singkat jika Anda mengirim beberapa berkas berturut turut, supaya alat ini tetap responsif untuk semua orang. Untuk rekaman lebih panjang, pecah menjadi beberapa bagian lalu transkripsikan berurutan.

Sekitar 90, termasuk bahasa Indonesia, Inggris, Spanyol, Portugis, Prancis, Jerman, Italia, Belanda, Polandia, Rusia, Turki, Jepang, Korea, Tionghoa, Thai, Vietnam, dan Katalan. Memilih bahasanya sendiri memberi hasil lebih baik daripada deteksi otomatis, terutama pada klip pendek.

Bisa. Unggah berkas MP4, MOV, WEBM atau sejenisnya dan jalur audionya akan dibaca dari sana. Gambarnya sendiri diabaikan, jadi Anda tidak perlu memisahkan audionya lebih dulu.

Unduh berkas SRT atau VTT. Keduanya memuat transkrip yang sama, dibagi menjadi baris berwaktu, persis seperti yang diharapkan penyunting video dan pemutar. SRT cocok untuk hampir semua perangkat lunak penyuntingan dan VTT adalah format untuk video web.

Pesan suara satu menit kembali dalam beberapa detik dan lima belas menit penuh butuh sekitar satu menit. Waktu tunggu sebagian besar adalah transkripsinya sendiri, jadi koneksi cepat membantu saat mengunggah tetapi tidak pada pemrosesan.

Pengenalan suara kesulitan dengan suara yang bertumpuk, aksen kental, musik latar, dan rekaman telepon berkualitas rendah. Yang biasanya paling membantu adalah menetapkan sendiri bahasa yang diucapkan alih alih membiarkan deteksi otomatis. Nama diri dan angka layak diperiksa manual berapa pun kualitas audionya.

Jawaban singkat

Untuk mengubah audio menjadi teks secara gratis, pilih berkas MP3, WAV, M4A, atau MP4 Anda di atas, tentukan bahasa yang diucapkan, lalu tekan Transkripsikan. Untuk rekaman pendek transkrip kembali dalam hitungan detik dan bisa diunduh sebagai TXT, SRT, atau VTT. Tidak perlu akun dan berkas Anda dihapus begitu transkripnya siap.