Synthèse vocale de base
Le fichier talk.php ci-dessous synthétise la voix à partir d’un texte et l’écrit dans un fichier WAV.
PHP FFI est en général désactivé dans les environnements serveur web (FPM, etc.). Exécutez ce script en CLI, par exemple avec php talk.php.
Exécution :
Synthèse en une seule étape (méthode tts)
Pour éviter les deux étapes createAudioQuery + synthesis, utilisez la méthode tts() :
Synthèse à partir de notation katakana
Vous pouvez également synthétiser à partir de la notation katakana de style AquesTalk :
Utiliser un dictionnaire utilisateur
Pour enregistrer la prononciation de mots personnalisés, utilisez UserDict :
Ajuster l’AudioQuery
En ajustant le JSON obtenu via createAudioQuery avant la synthèse, vous pouvez contrôler finement l’intonation, le tempo, etc. :
Récupérer les accent phrases
Vous pouvez récupérer les informations d’accent phrases d’un texte pour vérification ou édition :
Utiliser le mode GPU
Sur un environnement où le GPU est disponible, spécifier AccelerationMode::Gpu accélère la synthèse :
Utiliser plusieurs modèles vocaux
En chargeant plusieurs fichiers .vvm, vous pouvez utiliser plusieurs voix de personnages en changeant d’ID de style :