Grundlegende Sprachsynthese
Die folgende talk.php ist ein Beispiel, das aus Text Audio synthetisiert und in eine WAV-Datei schreibt.
PHP-FFI ist in Webserver-Umgebungen (wie FPM) normalerweise deaktiviert. Führen Sie dieses Skript wie php talk.php über die CLI aus.
Ausführen:
Sprachsynthese in einem Schritt (tts-Methode)
Wenn Sie die zwei Schritte createAudioQuery + synthesis überspringen möchten, können Sie die tts()-Methode verwenden:
Sprachsynthese mit Katakana-Notation
Sie können auch aus Katakana in AquesTalk-ähnlicher Notation synthetisieren:
Benutzerwörterbuch verwenden
Um die Aussprache benutzerdefinierter Wörter zu registrieren, verwenden Sie UserDict:
Anpassung der AudioQuery
Wenn Sie das mit createAudioQuery gewonnene JSON vor der Synthese anpassen, können Sie Intonation und Tempo fein steuern:
Akzentphrasen abrufen
Sie können die Akzentphrasen-Informationen eines Textes abrufen und prüfen bzw. bearbeiten:
GPU-Modus verwenden
In Umgebungen mit GPU können Sie durch Angabe von AccelerationMode::Gpu die Geschwindigkeit erhöhen:
Mehrere Audiomodelle verwenden
Sie können mehrere .vvm-Dateien laden und durch Wechseln der Style-ID mehrere Charakterstimmen verwenden:
Zuletzt geändert am 13. Juli 2026