Contrôle du son et des performances
Orientation et maîtrise des émotions
En cochant la case d'activation des émotions, vous pouvez contrôler le mode d'expression à l'aide du contexte et des balises définies.
- Guidage contextuel : le modèle interprète le contexte directement à partir du texte. L'ajout d'une mention descriptive, telle que « dit-elle avec enthousiasme », ou l'utilisation de points d'exclamation influera sur l'émotion exprimée.
- Marqueurs sonores (relatifs au son) : insérez ces marqueurs dans le texte pour orienter le son.
Remarque : L'efficacité dépend du son sélectionné.
- [rit], [rit plus fort], [éclate de rire], [respiration sifflante]
- [chuchotements]
- [soupire], [expire]
- [sarcastique], [curieux], [enthousiaste], [en pleurs], [ricanant], [d'un air malicieux]
- Effets sonores :
- [coup de feu], [applaudissements], [battements de mains], [explosion]
- [avale], [déglutit]
- Marques expérimentales :
- [accent X marqué] (remplacez X par l'accent souhaité, par ex. [accent libanais marqué])
- [chante], [woo], [pet]
- La ponctuation et la construction du texte :
- Les points de suspension (…) : pour ajouter des pauses et du poids.
- Les majuscules : pour renforcer l'insistance.
- Ponctuation standard : pour assurer un rythme de parole naturel.
Conseil important : le modèle émotionnel est en phase Alpha. Des instructions trop courtes risquent d'entraîner des résultats incohérents. Nous vous encourageons à tester des instructions de plus de 250 caractères. Lorsque l'option d'activation des émotions n'est pas sélectionnée, le système privilégie la stabilité et la cohérence.
- Comment donner des instructions :
- Le contexte est la clé : misez sur le flux naturel de la phrase. L'intelligence artificielle lira le texte exactement tel qu'il est écrit.
- Séparateurs : utilisez des signes comme ceux-ci.
- Structure de la phrase :
- Remarque : n'utilisez pas trop de balises, car cela pourrait entraîner une instabilité.
- Remarque : cela peut fonctionner ou non, selon le contexte. Essayez d'augmenter l'expressivité et la température lors de son utilisation.
- Ponctuation : utilisez des tirets (-) pour les pauses brèves ou des points de suspension (...) pour les intonations hésitantes.
- Pas de marqueurs émotionnels : n'utilisez pas d'accolades {} ni d'indications vocales ici ; l'IA risque de les lire à voix haute ou de les ignorer.
Paramètres audio (commandes avancées)
Ajustez ces paramètres pour affiner les résultats.
- Coefficient de fidélité (constance).
- Plage : plus rigide (plus bas) ↔ plus flexible (plus haut).
- Effet : une température plus élevée confère à l'IA davantage de liberté et d'expressivité, mais au risque d'une instabilité (hallucinations). Une température plus basse rend le son plus rigide et plus stable.
- Recommandation : la valeur par défaut (environ 25 à 50) constitue un bon point de départ.
- La ressemblance
- Plage : Moins proche d'une voix off (plus bas) ↔ Proche d'une voix off (plus élevé).
- Effet : Augmenter ce paramètre renforce la ressemblance avec la version originale. Toutefois, si l'audio de référence contient du bruit, une forte ressemblance risque d'entraîner la reproduction de distorsions ou de crépitements.
- La vitesse
- Plage : 0,7 (plus lent) ↔ 1,2 (plus rapide). La valeur par défaut est 1,0.
- Effet : contrôle le rythme. Les valeurs extrêmes peuvent affecter la qualité.
- L'expressionnisme
- Échelle : ton neutre (plus bas) ↔ interprétation émotionnelle (plus élevée).
- Effet : Augmenter ce paramètre rapproche les résultats d'un fonctionnement naturel. Une augmentation excessive risque d'entraîner un comportement inhabituel.
Passez à l'article suivant du guide Makna.