Synthèse vocale locale • 28 voix • IA basée sur un navigateur • Priorité à la confidentialité

Synthèse vocale

Convertissez du texte en discours naturel localement dans votre navigateur. 28 voix intégrées, vitesse réglable, priorité à la confidentialité — aucun envoi sur le serveur n'est nécessaire.

Que fait cet outil de synthèse vocale

Cet outil utilise le modèle d'IA Kokoro-82M pour convertir le texte en discours au son naturel directement dans votre navigateur. Il prend en charge 28 voix intégrées avec des accents américains et britanniques, une vitesse de parole réglable et des textes longs avec segmentation automatique. Tout le traitement s'effectue localement : votre texte ne quitte jamais votre appareil.

Comment utiliser la synthèse vocale dans le navigateur

  1. 1.Tapez ou collez votre texte dans la zone de saisie
  2. 2.Choisissez une voix et cliquez pour prévisualiser son son
  3. 3.Ajustez la vitesse de parole si nécessaire
  4. 4.Cliquez sur Générer et téléchargez l'audio

Pourquoi ce flux de travail de synthèse vocale est utile

Tout le traitement a lieu dans votre navigateur après le chargement du modèle

28 voix intégrées aux accents américains et britanniques

Vitesse de parole réglable de 0,5x à 2,0x

Prend en charge les textes longs jusqu'à 5000 caractères avec segmentation automatique

FAQ sur la synthèse vocale

Mon texte reste-t-il privé ?

Oui. Le traitement de la synthèse vocale s'exécute entièrement dans votre navigateur. Votre texte n'est jamais téléchargé sur aucun serveur - tout reste sur votre appareil.

Combien de voix sont disponibles ?

Il y a 28 voix intégrées, dont 11 voix féminines américaines, 9 voix masculines américaines, 4 voix féminines britanniques et 4 voix masculines britanniques. Cliquez sur n'importe quelle voix pour la prévisualiser avant de la générer.

Pourquoi la première génération est-elle plus lente ?

La première fois que vous générez de la parole, le modèle d'IA (~154 Mo) doit être téléchargé dans votre navigateur. C'est un téléchargement unique — le modèle est mis en cache et réutilisé lors des visites suivantes. Un navigateur compatible WebGPU est requis (Chrome 113+ ou Edge 113+).

Quels sont les conditions requises ?

Vous avez besoin d'un navigateur compatible WebGPU tel que Chrome 113 ou version ultérieure, ou Edge 113 ou version ultérieure. L'outil télécharge un modèle d'IA d'environ 154 Mo lors de la première utilisation, qui est mis en cache dans votre navigateur pour les visites futures. La vitesse de traitement dépend de votre GPU — les GPU plus rapides génèrent la parole plus rapidement.

Est-ce que cela ralentira mon ordinateur ?

L'exécution du modèle d'IA consomme des ressources GPU et mémoire importantes. Sur les appareils d'entrée de gamme ou plus anciens, vous pouvez rencontrer des ralentissements du navigateur, une utilisation mémoire élevée ou un manque de réactivité temporaire pendant le traitement. Pour la meilleure expérience, fermez les onglets et applications inutiles et utilisez un appareil avec GPU dédié si possible.

À quel point la parole est-elle naturelle ?

Le modèle Kokoro-82M produit une parole naturelle avec des personnalités vocales distinctes. La qualité varie selon la voix — certaines sonnent plus conversationnelles tandis que d'autres sont plus formelles. Vous pouvez prévisualiser n'importe quelle voix avant de générer pour trouver celle qui correspond le mieux à vos besoins.