Skip to main content

Sintesi vocale di base

Il seguente talk.php è un esempio che sintetizza audio dal testo e lo scrive in un file WAV.
PHP FFI è normalmente disabilitato negli ambienti server Web (come FPM). Esegui questo script da CLI, ad esempio con php talk.php.
Esecuzione:

Sintesi in un solo passo (metodo tts)

Se vuoi evitare i due passaggi createAudioQuery + synthesis, puoi usare il metodo tts():

Sintesi da notazione katakana

È possibile sintetizzare anche partendo da una notazione katakana in stile AquesTalk:

Usare il dizionario utente

Per registrare la lettura di parole personalizzate, usa UserDict:

Regolare l’AudioQuery

Regolando il JSON ottenuto con createAudioQuery prima di sintetizzare, puoi controllare finemente intonazione, ritmo, ecc.:

Ottenere le frasi accentate

Puoi ottenere le informazioni sulle frasi accentate del testo per verificarle o modificarle:

Usare la modalità GPU

Negli ambienti in cui è disponibile una GPU, specificare AccelerationMode::Gpu velocizza l’esecuzione:

Usare più modelli vocali

Caricando più file .vvm e cambiando l’ID di stile puoi utilizzare più voci di personaggi diversi:
Ultima modifica il 13 luglio 2026