Di perangkat ini · Tidak diunggah · Tanpa akun

Ubah audio jadi teks online

Ubah audio jadi teks di browser ini. Model ucapan jalan di perangkat Anda dan file tidak diunggah. Audio ke teks Indonesia, Inggris, atau bahasa yang Anda ucapkan — Auto menulis bahasa itu.

Taruh file audio atau klik untuk memilih

MP3, WAV, M4A, OGG, FLAC, atau WebM. Satu file. Tidak diunggah. Komputer bisa sekitar 200 MB atau 20 menit; ponsel pakai klip yang lebih pendek.

Audio ke teks

Ucapan diubah di perangkat ini. Komputer bisa menyiapkan model yang lebih besar di latar setelah halaman muncul. Ponsel memakai model yang lebih ringan. Proses ucapan jalan di tab ini lewat WASM.

  • Diproses di perangkat ini
  • Audio tidak diunggah
  • Tanpa akun

Di halaman ini

Transkrip

Fitur

Yang benar-benar dilakukan halaman audio ke teks ini

Halaman ini adalah alat yang bekerja. Anda mengubah satu file lokal jadi teks, melihat bilah progres saat model ucapan tersimpan, lalu menyalin atau mengunduh transkrip tanpa meninggalkan tab.

Satu file, satu tombol Transkrip

Taruh MP3, WAV, M4A, atau klip serupa ke kartu, lalu tekan Transkrip. Teks tetap di halaman ini supaya bisa dibaca, disalin, atau diunduh sebagai txt tanpa pindah tab.

Whisper di perangkat

Model ucapan jalan di tab ini lewat Transformers.js. Auto menulis bahasa yang diucapkan — bicara Indonesia, dapat teks Indonesia. Komputer bisa menyiapkan model yang lebih besar di latar; ponsel memakai model yang lebih ringan.

Tidak diunggah dan tanpa akun

Audio tetap di browser. Tidak dikirim ke server kami, tidak perlu daftar, dan transkrip tidak disimpan setelah tab ditutup.

Salin atau unduh txt

Setelah pass selesai, Anda bisa menyalin teks, mengunduh file .txt, atau membuka Lihat untuk dialog yang lebih besar. Label pembicara dan file subtitle tidak ditawarkan di halaman ini.

File audio kecil jatuh ke kartu browser lalu menjadi halaman baris tulisan

Apa ini

Apa itu audio ke teks online?

Audio ke teks online di halaman ini adalah tab browser yang mengubah satu rekaman lokal menjadi baris tulisan dengan model ucapan on-device. File model datang dari host kami sendiri dan jalan di tab ini lewat Transformers.js. Auto menulis bahasa yang diucapkan. File tidak dikirim ke server kami dan tidak ditulis ke log yang kami simpan setelah Anda pergi.

Halaman Indonesia ini untuk klip yang sudah Anda punya, tautan file langsung, atau rekaman di tab. Halaman ini tidak mengambil URL video YouTube, tidak menandai pembicara, tidak mengekspor SRT, tidak meringkas rapat, dan tidak menerjemahkan ucapan. Jika itu pekerjaan yang Anda butuhkan, ini alat yang salah — kami mengatakannya daripada berpura-pura ada antrean di balik tombol.

Mesin
Ucapan on-device di browser
Unggah
Tidak ada — file tetap lokal
Akun
Tidak diperlukan
Cadangan
WASM jika WebGPU tidak ada

Cara pakai

Cara ubah audio jadi teks

Tiga langkah di halaman: tambah file, tekan Transkrip, lalu salin atau unduh txt. Langkah 1 adalah memilih klip. Tautan hanya untuk URL file langsung, bukan halaman YouTube atau CapCut.

Langkah 1

Pilih file audio lokal

Taruh satu klip atau klik kartu. Tetap dalam batas yang tertera di kartu supaya tab bisa selesai. Tautan halaman YouTube tidak ditarik di sini.

Tangan memilih satu klip audio ringkas di kartu taruh sederhana di dalam browser

Langkah 2

Tekan Transkrip

Kunjungan pertama mengunduh model ucapan dan menyimpannya. Bilah progres menandai tunggu itu. File berikutnya di browser yang sama melewati unduhan kecuali data situs dibersihkan.

Laptop menjalankan model ucapan dengan bilah progres sementara transkrip mengisi halaman

Langkah 3

Salin atau unduh txt

Cocokkan nama file, baca transkrip di sini, lalu salin atau simpan file teks. Tidak ada yang tersimpan setelah Anda pergi.

Lembar teks meninggalkan jendela browser menuju nampan unduhan dan papan klip

Mengapa halaman ini

Mengapa ubah audio di perangkat ini

Beberapa konverter mengunggah rekaman ke kluster. Halaman ini menahan file di tab supaya memo suara atau cuplikan wawancara tidak menjadi salinan yang bisa kami baca nanti. Tambahannya adalah privasi dan kejujuran, bukan daftar fitur yang lebih panjang.

Privat secara bawaan

Beberapa konverter mengunggah rekaman ke kluster. Halaman ini menahan file di tab supaya memo suara atau cuplikan wawancara tidak menjadi salinan yang bisa kami baca nanti.

Jalan tanpa WebGPU

Safari dan iPhone tetap menjalankan model di perangkat lewat WASM. Kunjungan pertama lebih lambat karena model diunduh; file berikutnya memakai cache di browser ini.

Batas yang jujur

Satu file, batas yang tertera di kartu, Auto menulis bahasa yang diucapkan. Kami tidak mengklaim caption waktu nyata, label pembicara, ekspor SRT, atau akurasi kelas server di halaman ini. Tambahan itu milik alat berhosting, bukan tab ini.

Satu pekerjaan, satu tombol

Halaman ini adalah alat yang bekerja. Mode ekstra yang tidak kami kirim tetap di luar halaman, bukan ubin abu-abu yang tidak bisa diklik.

Tips

Tips dan batas

Catatan praktis supaya unduhan model pertama dan transkrip tetap bisa ditebak. Ini batas, bukan poin pemasaran: ponsel memakai model yang lebih ringan, kartu menampilkan batas ukuran, dan ruangan ramai tetap akan terbaca buruk.

Siapa yang memakai

Siapa yang memakai ini di pekerjaan nyata

Orang yang sudah punya rekaman dan butuh teks yang bisa diedit. Setiap kartu adalah pekerjaan nyata dengan input, pengaturan, output, dan caveat — bukan slogan. Halaman ini hanya untuk file lokal itu, bukan URL video jarak jauh atau bot rapat.

Memo ponsel jadi catatan yang bisa diedit

Anda sudah merekam pikiran di ponsel dan butuh baris yang bisa ditempel ke aplikasi catatan tanpa mengirim klip ke host.

Input: Satu memo ponsel tersimpan sebagai M4A atau MP3, dalam batas kartu, sudah di perangkat.

Pengaturan: Default Transkrip. Auto menulis bahasa yang diucapkan. Tidak ada paket bahasa tambahan dan tidak ada mode pembicara.

Output: Transkrip polos di halaman ini plus txt yang bisa ditempel ke catatan.

Caveat: Ucapan tenang berhasil. Musik latar dan overlapping talk akan berantakan.

Pass pertama wawancara pendek

Anda merekam percakapan sendiri dan ingin transkrip pass pertama supaya nama dan kutipan bisa dibersihkan tangan.

Input: Wawancara yang Anda rekam sebagai WAV atau MP3, satu file, di bawah batas kartu.

Pengaturan: Tekan Transkrip sekali. Auto di komputer; ponsel selalu Auto dengan model yang lebih ringan.

Output: Satu blok teks di halaman ini. Salin atau unduh txt. Tidak ada kolom pembicara.

Caveat: Halaman ini tidak menandai pembicara. Anda membagi giliran sendiri setelah pass.

Cuplikan kuliah yang sudah diunduh

Anda sudah punya klip kelas di disk dan ingin kata yang bisa dicari di tab yang sama, bukan bot yang masuk panggilan.

Input: Cuplikan kuliah yang sudah disimpan lokal sebagai MP3, WAV, atau M4A.

Pengaturan: Batas kartu. Auto menulis bahasa yang diucapkan. Tidak ada kolom URL kursus jarak jauh.

Output: Teks yang bisa dicari di tab ini, lalu disalin ke catatan belajar.

Caveat: Kami tidak mengambil halaman kursus atau membelah video jarak jauh. Simpan audionya dulu.

FAQ

Pertanyaan soal audio ke teks

Cara ubah audio jadi teks?

Pakai File, Tautan, atau Rekam. Taruh klip lokal, impor URL file audio atau video langsung, atau rekam di tab ini. Model ucapan jalan di perangkat ini dan transkrip muncul di halaman yang sama supaya bisa disalin atau disimpan sebagai txt.

Cara ubah rekaman audio jadi teks?

Simpan rekamannya sebagai MP3, WAV, atau M4A, lalu taruh ke kartu File, atau buka Rekam dan bicara di tab ini. Setelah pass selesai, salin teks atau unduh txt. Tidak perlu membuka aplikasi lain.

Cara ubah file audio jadi teks?

Klik kartu, pilih satu file, dan tab ini langsung menjalankan Transkrip. Format yang biasa jalan: MP3, WAV, M4A, AAC, OGG, FLAC, dan WebM, selama browser bisa men-decode-nya. Tetap dalam batas yang tertera di kartu.

Audio ke teks online tanpa akun?

Ya. Tidak ada login dan tidak ada daftar. Tambah audio lalu transkrip. Kunjungan pertama mengunduh model ucapan on-device dan menyimpannya di browser ini supaya klip berikutnya melewati tunggu itu.

Apakah audio tetap di perangkat saya?

Ya. Browser membaca file atau rekaman di tab ini dan hanya memberinya ke model Whisper di browser. AudioToText.im tidak mengirim audio ke server kami atau menyimpan salinan setelah Anda pergi.

Format audio apa yang bisa dipakai?

MP3, WAV, M4A, AAC, OGG, FLAC, dan WebM jalan jika browser bisa men-decode-nya. Tetap dalam batas kartu. Tautan hanya mengimpor URL file langsung. Halaman YouTube dan tautan lain tidak ditarik di sini.

Apakah ini jalan di iPhone atau Safari?

Ya. Ponsel memakai model on-device yang lebih ringan dan otomatis menulis bahasa yang diucapkan. Tidak ada sakelar Auto / English faster di ponsel. Unduhan model pertama bisa sekitar satu menit; file berikutnya memakai cache. Komputer bisa menjalankan pass yang lebih kuat jika transkrip ponsel kurang bersih.

Apakah ada batas ukuran file?

Satu file. Komputer bisa sekitar 200 MB atau 20 menit — pasangan itu kira-kira WAV 20 menit tanpa kompresi. Ponsel sekitar 80 MB atau 10 menit supaya tab lebih jarang macet. Pekerjaan yang lebih panjang milik API berhosting, bukan halaman ini.

Apakah model diunduh setiap kali?

Kunjungan pertama mengunduh model ucapan on-device dari file kami sendiri dan menyimpannya di browser ini. Komputer bisa memulai unduhan itu setelah halaman muncul. File berikutnya melewati tunggu kecuali data situs dibersihkan. Beralih Auto dan English faster di komputer bisa mengambil model kedua sekali.

Bisakah saya mengunduh transkrip?

Setelah Transkrip selesai, Unduh TXT menyimpan file .txt dan Salin menaruh teks yang sama ke papan klip. Lihat membuka dialog di halaman ini. Jika Anda merekam di tab ini, Anda juga bisa mengunduh klip audio. Tidak ada yang tersimpan setelah tab ditutup.

Audio ke teks Indonesia — bahasa apa yang ditangani?

Auto mengenali bahasa yang diucapkan dan menulis teks yang cocok — bicara Indonesia, dapat Indonesia. Cakupan sekitar 99 bahasa dari set Whisper resmi. Kami tidak mengklaim 100+ bahasa, dan halaman ini tidak menerjemahkan ucapan ke bahasa lain.

Apakah bahasa saya dideteksi otomatis?

Ya di Auto. Tab mendengarkan klip, memilih bahasa yang diucapkan, dan menulis bahasa itu. Komputer mengingat Auto atau English faster di perangkat ini. Ponsel selalu memakai Auto dengan model yang lebih ringan.

Apa bedanya Auto dan English faster?

Di komputer, Auto adalah pass multibahasa. English faster hanya untuk ucapan bahasa Inggris; unduhannya lebih kecil dan biasanya lebih cepat. File, Tautan, dan Rekam memakai pilihan terakhir Anda. Ponsel menyembunyikan sakelar ini.

Bisakah saya merekam audio di browser?

Ya. Buka Rekam, izinkan mikrofon, lalu berhenti jika sudah selesai. Klip tetap di tab ini sampai Anda unduh. Setelah berhenti, tab yang sama men-transkripnya. Izin mikrofon diperlukan.

Seberapa akurat transkripnya?

Ini pass ucapan on-device, bukan meja caption studio. Ucapan tenang lebih baik daripada musik atau overlapping talk. Auto mempertahankan bahasa yang diucapkan; English faster hanya untuk bahasa Inggris. Kami tidak mengklaim akurasi kelas server atau waktu nyata.

Bisakah saya menempel tautan YouTube atau WhatsApp?

Tidak. Tautan hanya mengimpor URL file audio atau video langsung. Halaman YouTube, ekspor chat, atau album awan tidak ditarik. Simpan audionya dulu, lalu pakai File — atau pilih Dropbox jika filenya sudah di sana. Audio WA ke teks hanya jalan setelah klip disimpan sebagai file.

Apakah ChatGPT atau Gemini bisa transkrip audio ke teks di sini?

Tidak. Halaman ini bukan ChatGPT, bukan Gemini, dan bukan asisten obrolan. Model Whisper jalan di tab Anda. Tidak ada prompt, tidak ada ringkasan, dan tidak ada terjemahan ke bahasa lain.

Cara ubah audio jadi teks di CapCut atau Word?

Tidak di dalam CapCut, Word, atau editor lain. AudioToText.im adalah halaman browser terpisah: ubah audio jadi teks di sini, lalu tempel txt ke tempat Anda sudah mengedit. Kami tidak membuka proyek CapCut dan tidak men-transkrip di Word.

Cara menerjemahkan audio ke teks?

Halaman ini tidak menerjemahkan. Auto menulis bahasa yang diucapkan. Jika Anda butuh terjemahan, unduh txt lalu pakai alat terjemahan terpisah. Kami tidak berpura-pura jadi penerjemah.

Apakah ini aplikasi atau APK?

Ini situs web, bukan aplikasi dan bukan APK. Buka halaman ini di browser yang mutakhir, tambah file, tautan langsung, atau rekaman, lalu transkrip. Tidak ada unduhan toko, tidak ada ekstensi.

Apakah ini Monica atau alat caption lain?

Bukan. Ini AudioToText.im. Satu transkrip polos yang bisa disalin atau diunduh sebagai txt. Label pembicara, SRT atau VTT, ringkasan, dan peta pikiran tidak ada di halaman ini.

Bisakah saya transkrip file video?

Jika browser bisa men-decode soundtrack-nya, file video lokal atau URL file video langsung bisa jalan. Kami tidak mengambil atau membelah halaman YouTube atau situs lain yang bukan file.

Bisakah dipakai offline setelah kunjungan pertama?

Setelah model tersimpan di cache, tab bisa men-transkrip tanpa mengirim audio keluar. Anda tetap butuh file situs itu sendiri jika tab baru atau cache dibersihkan.

Kembali ke alat

Taruh file di viewport pertama dan tekan Transkrip. Tautan ini hanya menggulir ke sana.

Ubah audio jadi teks