Skip to main content

Síntesis de voz básica

El siguiente talk.php es un ejemplo que sintetiza voz desde texto y la escribe en un archivo WAV.
PHP FFI está normalmente deshabilitado en entornos de servidor web (FPM, etc.). Ejecuta este script desde CLI, con php talk.php.
Ejecución:

Síntesis de voz en un solo paso (método tts)

Si quieres saltarte los 2 pasos de createAudioQuery + synthesis, puedes usar el método tts():

Síntesis de voz con notación katakana

También puedes sintetizar desde notación katakana estilo AquesTalk:

Uso del diccionario de usuario

Para registrar la lectura de palabras personalizadas se usa UserDict:

Ajuste del AudioQuery

Si ajustas el JSON que obtienes con createAudioQuery antes de sintetizar, puedes controlar con detalle la entonación, el tempo, etc.:

Obtener frases acentuadas

Puedes obtener la información de las frases acentuadas del texto para revisarla y editarla:

Uso del modo GPU

En entornos con GPU disponible, indicar AccelerationMode::Gpu acelera el procesamiento:

Uso de varios modelos de voz

Cargando varios archivos .vvm y cambiando el style ID, puedes alternar entre distintas voces de personajes:
Última modificación el 13 de julio de 2026