Skip to main content

기본적인 음성 합성

아래의 talk.php는 텍스트에서 음성을 합성해 WAV 파일로 출력하는 샘플입니다.
PHP FFI는 웹 서버 환경(FPM 등)에서는 통상 무효화되어 있습니다. 이 스크립트는 php talk.php처럼 CLI에서 실행하세요.
실행:

1단계로 음성 합성 (tts 메서드)

createAudioQuery + synthesis의 2단계를 생략하고 싶은 경우 tts() 메서드를 사용할 수 있습니다:

카타카나 표기로 음성 합성

AquesTalk 풍의 카타카나 표기에서도 합성할 수 있습니다:

사용자 사전 사용

커스텀 단어의 읽는 법을 등록하려면 UserDict를 사용합니다:

AudioQuery 조정

createAudioQuery로 획득한 JSON을 조정한 뒤 합성함으로써 억양이나 템포 등을 세밀하게 제어할 수 있습니다:

액센트 구 획득

텍스트의 액센트 구 정보를 획득해 확인·편집할 수 있습니다:

GPU 모드 사용

GPU를 사용할 수 있는 환경에서는 AccelerationMode::Gpu를 지정하면 고속화할 수 있습니다:

여러 음성 모델 사용

여러 .vvm 파일을 로드하고, 스타일 ID를 전환함으로써 여러 캐릭터 보이스를 구분하여 사용할 수 있습니다:
마지막 수정일 2026년 7월 13일