Skip to main content

Grundlegende Sprachsynthese

Die folgende talk.php ist ein Beispiel, das aus Text Audio synthetisiert und in eine WAV-Datei schreibt.
PHP-FFI ist in Webserver-Umgebungen (wie FPM) normalerweise deaktiviert. Führen Sie dieses Skript wie php talk.php über die CLI aus.
Ausführen:

Sprachsynthese in einem Schritt (tts-Methode)

Wenn Sie die zwei Schritte createAudioQuery + synthesis überspringen möchten, können Sie die tts()-Methode verwenden:

Sprachsynthese mit Katakana-Notation

Sie können auch aus Katakana in AquesTalk-ähnlicher Notation synthetisieren:

Benutzerwörterbuch verwenden

Um die Aussprache benutzerdefinierter Wörter zu registrieren, verwenden Sie UserDict:

Anpassung der AudioQuery

Wenn Sie das mit createAudioQuery gewonnene JSON vor der Synthese anpassen, können Sie Intonation und Tempo fein steuern:

Akzentphrasen abrufen

Sie können die Akzentphrasen-Informationen eines Textes abrufen und prüfen bzw. bearbeiten:

GPU-Modus verwenden

In Umgebungen mit GPU können Sie durch Angabe von AccelerationMode::Gpu die Geschwindigkeit erhöhen:

Mehrere Audiomodelle verwenden

Sie können mehrere .vvm-Dateien laden und durch Wechseln der Style-ID mehrere Charakterstimmen verwenden:
Zuletzt geändert am 13. Juli 2026