Skip to main content

Synthèse vocale de base

Le fichier talk.php ci-dessous synthétise la voix à partir d’un texte et l’écrit dans un fichier WAV.
PHP FFI est en général désactivé dans les environnements serveur web (FPM, etc.). Exécutez ce script en CLI, par exemple avec php talk.php.
Exécution :

Synthèse en une seule étape (méthode tts)

Pour éviter les deux étapes createAudioQuery + synthesis, utilisez la méthode tts() :

Synthèse à partir de notation katakana

Vous pouvez également synthétiser à partir de la notation katakana de style AquesTalk :

Utiliser un dictionnaire utilisateur

Pour enregistrer la prononciation de mots personnalisés, utilisez UserDict :

Ajuster l’AudioQuery

En ajustant le JSON obtenu via createAudioQuery avant la synthèse, vous pouvez contrôler finement l’intonation, le tempo, etc. :

Récupérer les accent phrases

Vous pouvez récupérer les informations d’accent phrases d’un texte pour vérification ou édition :

Utiliser le mode GPU

Sur un environnement où le GPU est disponible, spécifier AccelerationMode::Gpu accélère la synthèse :

Utiliser plusieurs modèles vocaux

En chargeant plusieurs fichiers .vvm, vous pouvez utiliser plusieurs voix de personnages en changeant d’ID de style :
Dernière modification le 13 juillet 2026