Guide de l’utilisateur Référence de l’API

FAQ et dépannage

Questions fréquentes et solutions

Foire aux questions

Pourquoi le résultat est-il différent à chaque fois ?

L’IA est non déterministe. Tout comme un acteur humain, elle livre une prestation légèrement différente à chaque fois. Utilisez le curseur « Température » pour contrôler cette variabilité :

  • Température plus basse : Résultats plus cohérents et prévisibles
  • Température plus élevée : Plus de variation et d’expressivité

Pourquoi le choix de la voix est-il si important ?

Le choix de la voix a une incidence considérable sur le résultat. L’IA hérite des caractéristiques de la voix sélectionnée :

  • Si vous souhaitez une voix introspective, choisissez une voix qui donne une impression d’introspection.
  • Si vous souhaitez une voix énergique, sélectionnez-en une clonée à partir d’échantillons énergiques.
  • Si vous souhaitez un dialecte spécifique, choisissez une voix entraînée sur ce dialecte.
N’oubliez pas : bonnes données en entrée = bons résultats en sortie.

Si vous fournissez un fichier audio contenant du bruit, de la réverbération ou plusieurs locuteurs, l’IA manquera de stabilité. Utilisez toujours des sources propres et de haute qualité pour obtenir les meilleurs résultats.

Comment les crédits sont-ils calculés ?

Les crédits sont calculés en fonction du nombre de caractères de votre texte et du mode de normalisation sélectionné :

  • Normalisation de base : 1 crédit
  • Normalisation améliorée par l’IA : Crédits x2

Quel format audio est généré ?

Tout l’audio généré est fourni au format MP3 à 128 ou 192 kbps (44,1 kHz) pour une qualité et une compatibilité optimales.

Y a-t-il une limite de caractères ?

Mode Limite de caractères Durée approximative
Émotions et dialectes activés 3 000 caractères ~3 minutes
Mode standard 10 000 caractères ~10 minutes
Conversion texte-audio (rapide) 1 500 caractères ~1,5 minute

Pour un contenu plus long, utilisez le Studio de conversion texte-audio.

Puis-je utiliser l’audio généré à des fins commerciales ?

Oui, tous les fichiers audio générés avec votre compte peuvent être utilisés à des fins commerciales, conformément aux conditions de votre abonnement.


Dépannage

Le son est robotique.

  • Essayez d’augmenter le paramètre de température pour obtenir une variation plus naturelle.
  • Augmentez légèrement le curseur d’expressivité.
  • Activez le mode Émotions et dialectes pour un contenu expressif.
  • Essayez une voix différente qui correspond au style de votre contenu.

La sortie est irrégulière ou instable.

  • Réduisez le réglage de la température.
  • Baissez le curseur d’expressivité.
  • Utilisez des prompts plus longs (plus de 250 caractères recommandés pour le mode Émotions).
  • Vérifiez que votre audio source (pour le clonage de voix) est propre et exempt de bruit.

La génération est lente.

  • Le traitement des textes plus longs prend plus de temps.
  • La normalisation améliorée par l’IA nécessite un traitement supplémentaire.
  • Vérifiez votre connexion Internet.

Prononciation inattendue

  • Utiliser la normalisation assistée par IA pour le texte arabe (ajoute automatiquement les signes diacritiques)
  • Ajouter manuellement des signes diacritiques (tashkil) aux mots ambigus.
  • Écrivez les nombres en toutes lettres plutôt qu’en chiffres.
  • Développer les abréviations (par ex. « Dr » → « Doctor »)
  • Essayez une autre voix ; certaines gèrent mieux certains mots.

Le dialecte ne fonctionne pas correctement.

  • Assurez-vous que la voix sélectionnée correspond au dialecte de votre texte.
  • Utilisez la normalisation de base pour le contenu dialectal (sans amélioration par IA).
  • Commencez votre texte par un mot dialectal marqué pour « amorcer » le modèle.
  • Activer le mode Émotions et dialectes

La voix clonée ne ressemble pas à l’originale.

  • Augmentez le curseur de similarité.
  • Assurez-vous que l’audio utilisé pour l’entraînement était de haute qualité (sans bruit, écho ni réverbération).
  • Vérifiez que le ton et l’énergie de l’audio de formation sont restés constants tout au long de l’enregistrement.
  • Si la source présentait du bruit, réduisez la similarité pour atténuer les artefacts.

Contacter le support

Contactez notre équipe d’assistance à l’adresse support@moknah.io et nous vous aiderons à résoudre tout problème.