Satu file, satu tombol Transkrip
Taruh MP3, WAV, M4A, atau klip serupa ke kartu, lalu tekan Transkrip. Teks tetap di halaman ini supaya bisa dibaca, disalin, atau diunduh sebagai txt tanpa pindah tab.
Di perangkat ini · Tidak diunggah · Tanpa akun
Ubah audio jadi teks di browser ini. Model ucapan jalan di perangkat Anda dan file tidak diunggah. Audio ke teks Indonesia, Inggris, atau bahasa yang Anda ucapkan — Auto menulis bahasa itu.
Taruh file audio atau klik untuk memilih
MP3, WAV, M4A, OGG, FLAC, atau WebM. Satu file. Tidak diunggah. Komputer bisa sekitar 200 MB atau 20 menit; ponsel pakai klip yang lebih pendek.
Tempel tautan file langsung. YouTube dan tautan halaman lain tidak ditarik di sini — simpan filenya dulu, lalu pakai File.
00:00
Klip tetap di tab ini sampai Anda unduh. Berhenti untuk transkrip. Auto menulis bahasa yang diucapkan; English faster hanya untuk bahasa Inggris.
Audio ke teks
Ucapan diubah di perangkat ini. Komputer bisa menyiapkan model yang lebih besar di latar setelah halaman muncul. Ponsel memakai model yang lebih ringan. Proses ucapan jalan di tab ini lewat WASM.
Bagaimana kata-katanya ditulis?
Kami mengenali bahasa Anda dan menulis teks yang cocok. Bicara Prancis, dapat Prancis. Sekitar 99 bahasa. Diingat di perangkat ini.
Memproses…
0%
Jalan pertama di perangkat ini bisa sedikit lebih lama.
Jika transkrip ini kurang bagus, buka halaman yang sama di komputer. Versi desktop lebih kuat.
Fitur
Halaman ini adalah alat yang bekerja. Anda mengubah satu file lokal jadi teks, melihat bilah progres saat model ucapan tersimpan, lalu menyalin atau mengunduh transkrip tanpa meninggalkan tab.
Taruh MP3, WAV, M4A, atau klip serupa ke kartu, lalu tekan Transkrip. Teks tetap di halaman ini supaya bisa dibaca, disalin, atau diunduh sebagai txt tanpa pindah tab.
Model ucapan jalan di tab ini lewat Transformers.js. Auto menulis bahasa yang diucapkan — bicara Indonesia, dapat teks Indonesia. Komputer bisa menyiapkan model yang lebih besar di latar; ponsel memakai model yang lebih ringan.
Audio tetap di browser. Tidak dikirim ke server kami, tidak perlu daftar, dan transkrip tidak disimpan setelah tab ditutup.
Setelah pass selesai, Anda bisa menyalin teks, mengunduh file .txt, atau membuka Lihat untuk dialog yang lebih besar. Label pembicara dan file subtitle tidak ditawarkan di halaman ini.

Apa ini
Audio ke teks online di halaman ini adalah tab browser yang mengubah satu rekaman lokal menjadi baris tulisan dengan model ucapan on-device. File model datang dari host kami sendiri dan jalan di tab ini lewat Transformers.js. Auto menulis bahasa yang diucapkan. File tidak dikirim ke server kami dan tidak ditulis ke log yang kami simpan setelah Anda pergi.
Halaman Indonesia ini untuk klip yang sudah Anda punya, tautan file langsung, atau rekaman di tab. Halaman ini tidak mengambil URL video YouTube, tidak menandai pembicara, tidak mengekspor SRT, tidak meringkas rapat, dan tidak menerjemahkan ucapan. Jika itu pekerjaan yang Anda butuhkan, ini alat yang salah — kami mengatakannya daripada berpura-pura ada antrean di balik tombol.
Cara pakai
Tiga langkah di halaman: tambah file, tekan Transkrip, lalu salin atau unduh txt. Langkah 1 adalah memilih klip. Tautan hanya untuk URL file langsung, bukan halaman YouTube atau CapCut.
Langkah 1
Taruh satu klip atau klik kartu. Tetap dalam batas yang tertera di kartu supaya tab bisa selesai. Tautan halaman YouTube tidak ditarik di sini.

Langkah 2
Kunjungan pertama mengunduh model ucapan dan menyimpannya. Bilah progres menandai tunggu itu. File berikutnya di browser yang sama melewati unduhan kecuali data situs dibersihkan.

Langkah 3
Cocokkan nama file, baca transkrip di sini, lalu salin atau simpan file teks. Tidak ada yang tersimpan setelah Anda pergi.

Mengapa halaman ini
Beberapa konverter mengunggah rekaman ke kluster. Halaman ini menahan file di tab supaya memo suara atau cuplikan wawancara tidak menjadi salinan yang bisa kami baca nanti. Tambahannya adalah privasi dan kejujuran, bukan daftar fitur yang lebih panjang.
Beberapa konverter mengunggah rekaman ke kluster. Halaman ini menahan file di tab supaya memo suara atau cuplikan wawancara tidak menjadi salinan yang bisa kami baca nanti.
Safari dan iPhone tetap menjalankan model di perangkat lewat WASM. Kunjungan pertama lebih lambat karena model diunduh; file berikutnya memakai cache di browser ini.
Satu file, batas yang tertera di kartu, Auto menulis bahasa yang diucapkan. Kami tidak mengklaim caption waktu nyata, label pembicara, ekspor SRT, atau akurasi kelas server di halaman ini. Tambahan itu milik alat berhosting, bukan tab ini.
Halaman ini adalah alat yang bekerja. Mode ekstra yang tidak kami kirim tetap di luar halaman, bukan ubin abu-abu yang tidak bisa diklik.
Tips
Catatan praktis supaya unduhan model pertama dan transkrip tetap bisa ditebak. Ini batas, bukan poin pemasaran: ponsel memakai model yang lebih ringan, kartu menampilkan batas ukuran, dan ruangan ramai tetap akan terbaca buruk.
Siapa yang memakai
Orang yang sudah punya rekaman dan butuh teks yang bisa diedit. Setiap kartu adalah pekerjaan nyata dengan input, pengaturan, output, dan caveat — bukan slogan. Halaman ini hanya untuk file lokal itu, bukan URL video jarak jauh atau bot rapat.
Anda sudah merekam pikiran di ponsel dan butuh baris yang bisa ditempel ke aplikasi catatan tanpa mengirim klip ke host.
Input: Satu memo ponsel tersimpan sebagai M4A atau MP3, dalam batas kartu, sudah di perangkat.
Pengaturan: Default Transkrip. Auto menulis bahasa yang diucapkan. Tidak ada paket bahasa tambahan dan tidak ada mode pembicara.
Output: Transkrip polos di halaman ini plus txt yang bisa ditempel ke catatan.
Caveat: Ucapan tenang berhasil. Musik latar dan overlapping talk akan berantakan.
Anda merekam percakapan sendiri dan ingin transkrip pass pertama supaya nama dan kutipan bisa dibersihkan tangan.
Input: Wawancara yang Anda rekam sebagai WAV atau MP3, satu file, di bawah batas kartu.
Pengaturan: Tekan Transkrip sekali. Auto di komputer; ponsel selalu Auto dengan model yang lebih ringan.
Output: Satu blok teks di halaman ini. Salin atau unduh txt. Tidak ada kolom pembicara.
Caveat: Halaman ini tidak menandai pembicara. Anda membagi giliran sendiri setelah pass.
Anda sudah punya klip kelas di disk dan ingin kata yang bisa dicari di tab yang sama, bukan bot yang masuk panggilan.
Input: Cuplikan kuliah yang sudah disimpan lokal sebagai MP3, WAV, atau M4A.
Pengaturan: Batas kartu. Auto menulis bahasa yang diucapkan. Tidak ada kolom URL kursus jarak jauh.
Output: Teks yang bisa dicari di tab ini, lalu disalin ke catatan belajar.
Caveat: Kami tidak mengambil halaman kursus atau membelah video jarak jauh. Simpan audionya dulu.
FAQ
Pakai File, Tautan, atau Rekam. Taruh klip lokal, impor URL file audio atau video langsung, atau rekam di tab ini. Model ucapan jalan di perangkat ini dan transkrip muncul di halaman yang sama supaya bisa disalin atau disimpan sebagai txt.
Simpan rekamannya sebagai MP3, WAV, atau M4A, lalu taruh ke kartu File, atau buka Rekam dan bicara di tab ini. Setelah pass selesai, salin teks atau unduh txt. Tidak perlu membuka aplikasi lain.
Klik kartu, pilih satu file, dan tab ini langsung menjalankan Transkrip. Format yang biasa jalan: MP3, WAV, M4A, AAC, OGG, FLAC, dan WebM, selama browser bisa men-decode-nya. Tetap dalam batas yang tertera di kartu.
Ya. Tidak ada login dan tidak ada daftar. Tambah audio lalu transkrip. Kunjungan pertama mengunduh model ucapan on-device dan menyimpannya di browser ini supaya klip berikutnya melewati tunggu itu.
Ya. Browser membaca file atau rekaman di tab ini dan hanya memberinya ke model Whisper di browser. AudioToText.im tidak mengirim audio ke server kami atau menyimpan salinan setelah Anda pergi.
MP3, WAV, M4A, AAC, OGG, FLAC, dan WebM jalan jika browser bisa men-decode-nya. Tetap dalam batas kartu. Tautan hanya mengimpor URL file langsung. Halaman YouTube dan tautan lain tidak ditarik di sini.
Ya. Ponsel memakai model on-device yang lebih ringan dan otomatis menulis bahasa yang diucapkan. Tidak ada sakelar Auto / English faster di ponsel. Unduhan model pertama bisa sekitar satu menit; file berikutnya memakai cache. Komputer bisa menjalankan pass yang lebih kuat jika transkrip ponsel kurang bersih.
Satu file. Komputer bisa sekitar 200 MB atau 20 menit — pasangan itu kira-kira WAV 20 menit tanpa kompresi. Ponsel sekitar 80 MB atau 10 menit supaya tab lebih jarang macet. Pekerjaan yang lebih panjang milik API berhosting, bukan halaman ini.
Kunjungan pertama mengunduh model ucapan on-device dari file kami sendiri dan menyimpannya di browser ini. Komputer bisa memulai unduhan itu setelah halaman muncul. File berikutnya melewati tunggu kecuali data situs dibersihkan. Beralih Auto dan English faster di komputer bisa mengambil model kedua sekali.
Setelah Transkrip selesai, Unduh TXT menyimpan file .txt dan Salin menaruh teks yang sama ke papan klip. Lihat membuka dialog di halaman ini. Jika Anda merekam di tab ini, Anda juga bisa mengunduh klip audio. Tidak ada yang tersimpan setelah tab ditutup.
Auto mengenali bahasa yang diucapkan dan menulis teks yang cocok — bicara Indonesia, dapat Indonesia. Cakupan sekitar 99 bahasa dari set Whisper resmi. Kami tidak mengklaim 100+ bahasa, dan halaman ini tidak menerjemahkan ucapan ke bahasa lain.
Ya di Auto. Tab mendengarkan klip, memilih bahasa yang diucapkan, dan menulis bahasa itu. Komputer mengingat Auto atau English faster di perangkat ini. Ponsel selalu memakai Auto dengan model yang lebih ringan.
Di komputer, Auto adalah pass multibahasa. English faster hanya untuk ucapan bahasa Inggris; unduhannya lebih kecil dan biasanya lebih cepat. File, Tautan, dan Rekam memakai pilihan terakhir Anda. Ponsel menyembunyikan sakelar ini.
Ya. Buka Rekam, izinkan mikrofon, lalu berhenti jika sudah selesai. Klip tetap di tab ini sampai Anda unduh. Setelah berhenti, tab yang sama men-transkripnya. Izin mikrofon diperlukan.
Ini pass ucapan on-device, bukan meja caption studio. Ucapan tenang lebih baik daripada musik atau overlapping talk. Auto mempertahankan bahasa yang diucapkan; English faster hanya untuk bahasa Inggris. Kami tidak mengklaim akurasi kelas server atau waktu nyata.
Tidak. Tautan hanya mengimpor URL file audio atau video langsung. Halaman YouTube, ekspor chat, atau album awan tidak ditarik. Simpan audionya dulu, lalu pakai File — atau pilih Dropbox jika filenya sudah di sana. Audio WA ke teks hanya jalan setelah klip disimpan sebagai file.
Tidak. Halaman ini bukan ChatGPT, bukan Gemini, dan bukan asisten obrolan. Model Whisper jalan di tab Anda. Tidak ada prompt, tidak ada ringkasan, dan tidak ada terjemahan ke bahasa lain.
Tidak di dalam CapCut, Word, atau editor lain. AudioToText.im adalah halaman browser terpisah: ubah audio jadi teks di sini, lalu tempel txt ke tempat Anda sudah mengedit. Kami tidak membuka proyek CapCut dan tidak men-transkrip di Word.
Halaman ini tidak menerjemahkan. Auto menulis bahasa yang diucapkan. Jika Anda butuh terjemahan, unduh txt lalu pakai alat terjemahan terpisah. Kami tidak berpura-pura jadi penerjemah.
Ini situs web, bukan aplikasi dan bukan APK. Buka halaman ini di browser yang mutakhir, tambah file, tautan langsung, atau rekaman, lalu transkrip. Tidak ada unduhan toko, tidak ada ekstensi.
Bukan. Ini AudioToText.im. Satu transkrip polos yang bisa disalin atau diunduh sebagai txt. Label pembicara, SRT atau VTT, ringkasan, dan peta pikiran tidak ada di halaman ini.
Jika browser bisa men-decode soundtrack-nya, file video lokal atau URL file video langsung bisa jalan. Kami tidak mengambil atau membelah halaman YouTube atau situs lain yang bukan file.
Setelah model tersimpan di cache, tab bisa men-transkrip tanpa mengirim audio keluar. Anda tetap butuh file situs itu sendiri jika tab baru atau cache dibersihkan.
Taruh file di viewport pertama dan tekan Transkrip. Tautan ini hanya menggulir ke sana.
Ubah audio jadi teks