文本转语音(TTS)
实时语音
文本转语音(TTS)
POST
文本转语音(TTS)
简介
将文本转换为自然流畅的语音音频。该接口完全兼容 OpenAI 格式,您可以直接使用 OpenAI SDK 或兼容的客户端调用。认证
Bearer Token,如
Bearer sk-xxxxxxxxxx请求参数
模型名称,如
gpt-4o-mini-tts要转换为语音的文本。
合成使用的音色,如
alloy、echo、fable、onyx、nova、shimmer音频输出格式:
mp3、opus、aac、flac、wav 或 pcm播放速度,范围
0.25 到 4.0cURL 示例
Python 示例
支持的音色
| 音色 | 说明 |
|---|---|
| alloy | 均衡、中性 |
| echo | 平静、清晰 |
| fable | 温暖、富有表现力 |
| onyx | 低沉、有权威感 |
| nova | 明亮、有活力 |
| shimmer | 柔和、轻柔 |
注意事项
- 响应体为原始二进制音频 —— 请将其写入文件(如
speech.mp3),不要直接打印 response_format默认为mp3;如需无损音频可使用wav或pcm- 依赖
openai库:pip install openai
