Text-to-speech lokal • 28 suara • AI berbasis browser • Mengutamakan privasi

Teks ke Ucapan

Konversikan teks menjadi ucapan yang terdengar alami secara lokal di browser Anda. 28 suara bawaan, kecepatan yang dapat disesuaikan, mengutamakan privasi — tidak perlu mengunggah server.

Fungsi alat text-to-speech ini

Alat ini menggunakan model AI Kokoro-82M untuk mengubah teks menjadi ucapan yang terdengar alami langsung di browser Anda. Ini mendukung 28 suara bawaan dengan aksen Amerika dan Inggris, kecepatan bicara yang dapat disesuaikan, dan teks panjang dengan segmentasi otomatis. Semua pemrosesan terjadi secara lokal — teks Anda tidak pernah keluar dari perangkat Anda.

Cara menggunakan text-to-speech di browser

  1. 1.Ketik atau tempel teks Anda ke area input
  2. 2.Pilih suara dan klik untuk melihat pratinjau bunyinya
  3. 3.Sesuaikan kecepatan bicara jika diperlukan
  4. 4.Klik Hasilkan dan unduh audionya

Mengapa alur kerja text-to-speech ini berguna

Semua pemrosesan terjadi di browser Anda setelah model dimuat

28 suara bawaan dengan aksen Amerika dan Inggris

Kecepatan bicara yang dapat disesuaikan dari 0,5x hingga 2,0x

Mendukung teks panjang hingga 5000 karakter dengan segmentasi otomatis

FAQ Teks ke Ucapan

Apakah SMS saya dirahasiakan?

Ya. Pemrosesan text-to-speech berjalan sepenuhnya di browser Anda. Teks Anda tidak pernah diunggah ke server mana pun — semuanya tetap ada di perangkat Anda.

Berapa banyak suara yang tersedia?

Ada 28 suara bawaan termasuk 11 suara perempuan Amerika, 9 suara laki-laki Amerika, 4 suara perempuan Inggris, dan 4 suara laki-laki Inggris. Klik suara apa pun untuk mempratinjaunya sebelum menghasilkan.

Mengapa generasi pertama lebih lambat?

Pertama kali Anda menghasilkan suara, model AI (~154MB) perlu diunduh ke browser Anda. Ini adalah unduhan satu kali — model di-cache dan digunakan kembali pada kunjungan berikutnya. Browser yang mendukung WebGPU diperlukan (Chrome 113+ atau Edge 113+).

Apa persyaratan sistemnya?

Anda memerlukan browser yang mendukung WebGPU seperti Chrome 113 atau lebih baru, atau Edge 113 atau lebih baru. Alat ini mengunduh model AI ~154 MB pada penggunaan pertama, yang di-cache di browser Anda untuk kunjungan mendatang. Kecepatan pemrosesan tergantung pada GPU Anda — GPU yang lebih cepat menghasilkan suara lebih cepat.

Apakah ini akan memperlambat komputer saya?

Menjalankan model AI mengonsumsi sumber daya GPU dan memori yang signifikan. Pada perangkat kelas bawah atau lama, Anda mungkin mengalami lag browser, penggunaan memori tinggi, atau ketidakresponsifan sementara selama pemrosesan. Untuk pengalaman terbaik, tutup tab dan aplikasi yang tidak perlu, dan gunakan perangkat dengan GPU dedicated jika memungkinkan.

Seberapa natural suaranya?

Model Kokoro-82M menghasilkan suara yang terdengar natural dengan kepribadian suara yang berbeda. Kualitas bervariasi tergantung suara — beberapa terdengar lebih kasual sementara yang lain lebih formal. Anda dapat mempratinjau suara apa pun sebelum menghasilkan untuk menemukan yang paling sesuai dengan kebutuhan Anda.