Sintesi vocale di base
Il seguente talk.php è un esempio che sintetizza audio dal testo e lo scrive in un file WAV.
PHP FFI è normalmente disabilitato negli ambienti server Web (come FPM). Esegui questo script da CLI, ad esempio con php talk.php.
Esecuzione:
Sintesi in un solo passo (metodo tts)
Se vuoi evitare i due passaggi createAudioQuery + synthesis, puoi usare il metodo tts():
Sintesi da notazione katakana
È possibile sintetizzare anche partendo da una notazione katakana in stile AquesTalk:
Usare il dizionario utente
Per registrare la lettura di parole personalizzate, usa UserDict:
Regolare l’AudioQuery
Regolando il JSON ottenuto con createAudioQuery prima di sintetizzare, puoi controllare finemente intonazione, ritmo, ecc.:
Ottenere le frasi accentate
Puoi ottenere le informazioni sulle frasi accentate del testo per verificarle o modificarle:
Usare la modalità GPU
Negli ambienti in cui è disponibile una GPU, specificare AccelerationMode::Gpu velocizza l’esecuzione:
Usare più modelli vocali
Caricando più file .vvm e cambiando l’ID di stile puoi utilizzare più voci di personaggi diversi: