The TTSClient provides synchronous and asynchronous methods to generate speech. You can specify the text, voice, audio format, and playback speed.
Note: Speed adjustment requires ffmpeg to be available in your environment.
from ttsfm import TTSClient, AudioFormat, Voice
client = TTSClient()
# Basic usage
response = client.generate_speech(
text="来自 TTSFM 的问候!",
voice=Voice.ALLOY,
response_format=AudioFormat.MP3,
)
response.save_to_file("hello") # -> hello.mp3
# With speed adjustment (requires ffmpeg)
response = client.generate_speech(
text="这段语音会更快!",
voice=Voice.NOVA,
response_format=AudioFormat.MP3,
speed=1.5, # Range: 0.25 - 4.0
)
response.save_to_file("fast") # -> fast.mp3
from ttsfm import TTSClient, AudioFormat, Voice
client = TTSClient()
# 基础用法
response = client.generate_speech(
text="来自 TTSFM 的问候!",
voice=Voice.ALLOY,
response_format=AudioFormat.MP3,
)
response.save_to_file("hello") # -> hello.mp3
# 使用语速调节(需要 ffmpeg)
response = client.generate_speech(
text="这段语音会更快!",
voice=Voice.NOVA,
response_format=AudioFormat.MP3,
speed=1.5, # 1.5 倍速(范围:0.25 - 4.0)
)
response.save_to_file("fast") # -> fast.mp3