Audio ke Teks — transkripsi dalam paragraf dengan label pembicara
Alat online untuk mentranskripsi rekaman audio dan video — rapat, wawancara, kuliah, podcast, dan catatan suara — menjadi teks. Hasilnya berupa paragraf dengan label pembicara dan penanda waktu; Anda bisa menyuntingnya langsung di halaman, menyalin, atau mengunduhnya sebagai DOCX, PDF, TXT, atau subtitle SRT/VTT. Berkas pendek dikenali di browser; berkas berjam-jam diproses di server kami dan Anda menerima email saat teks siap.
Cara mentranskripsi audio ke teks
MP3, WAV, M4A, FLAC, OGG, WebM, atau video — seret berkas ke halaman atau pilih dari perangkat.
Pilih bahasa dan kualitas, centang "Beri label pembicara", dan masukkan jumlah peserta jika Anda tahu.
Perbaiki kata dan nama pembicara langsung di halaman, lalu salin teks atau unduh DOCX, PDF, TXT, SRT, atau VTT.
Ubah percakapan yang direkam menjadi dokumen yang mudah dibaca: siapa mengatakan apa, dan kapan
Ingin mendikte langsung? 🎤 Mengetik dengan suara
Berkas ditranskripsi satu per satu; setiap teks yang selesai disimpan ke riwayat di bawah. Setiap berkas adalah proses terpisah.
📝 Nama & istilah (opsional)
Teks hasil transkripsi akan muncul di sini.
Transkripsi
Notulen disusun oleh model bahasa. Untuk analisis, teks dikirim ke penyedia AI pihak ketiga (Anthropic, AS). Sebelum dikirim kami mengganti nomor paspor, nomor pajak dan jaminan sosial, nomor rekening dan kartu, telepon serta email dengan penanda; nama, nama perusahaan, dan alamat tetap ada di teks — jangan unggah percakapan yang isinya tidak berhak Anda bagikan kepada pihak ketiga. Setiap poin diperiksa: poin hanya ditampilkan bila kutipannya ada persis di teks Anda. Itu menutup kemungkinan kesimpulan karangan, tetapi tidak membuat analisis bebas salah — cocokkan hal penting dengan rekamannya.
📖 Riwayat
Model mana yang dipilih dan berapa biayanya
Pengenalan berjalan di peramban Anda, jadi model diunduh sekali lalu tersimpan di cache. Model yang lebih besar lebih baik menangkap aksen dan derau, tetapi lebih lama pada mesin yang sama.
| Model | Unduhan sekali | Waktu per menit audio | Kapan dipilih |
|---|---|---|---|
| Cepat | ~75 MB | sekitar 1 mnt | Draf cepat, ucapan jernih, satu suara |
| Akurat | ~150 MB | sekitar 3 mnt | Rekaman sehari-hari — kompromi biasa |
| Akurasi Tinggi (small) | ~250 MB | sekitar 6 mnt | Aksen, derau latar, beberapa pembicara |
| Premium (Large v3 Turbo) | ~600 MB | tergantung GPU | Audio tersulit; perlu GPU atau CPU modern |
Dari video, jalur audionya diambil lebih dulu: satu jam rekaman ponsel berukuran 2–3 GB, suaranya sekitar 30 MB.