拖拽音频文件到此处,或点击选择

支持 mp3、wav、m4a、flac、aac、ogg、webm、amr、3gp,最大 10MB

OpenAI SDK (Python)

兼容 OpenAI SDK,可直接用于大模型应用中的语音合成。

from openai import OpenAI

client = OpenAI(
    api_key="your-api-key",
    base_url="http://127.0.0.1:8787/v1",
)

response = client.audio.speech.create(
    model="tts-1",
    voice="zh-CN-XiaoxiaoNeural",  # 或别名: alloy, echo, nova ...
    input="你好,这是语音合成测试。",
    speed=1.0,
)
response.write_to_file("speech.mp3")

OpenAI SDK (Node.js)

import OpenAI from "openai";
import fs from "fs";

const client = new OpenAI({
    apiKey: "your-api-key",
    baseURL: "http://127.0.0.1:8787/v1",
});

const response = await client.audio.speech.create({
    model: "tts-1",
    voice: "zh-CN-YunxiNeural",
    input: "你好,这是语音合成测试。",
});

const buffer = Buffer.from(await response.arrayBuffer());
fs.writeFileSync("speech.mp3", buffer);

cURL — 文字转语音

curl http://127.0.0.1:8787/v1/audio/speech   -H "Authorization: Bearer your-api-key"   -H "Content-Type: application/json"   -d '{
    "model": "tts-1",
    "input": "你好,这是语音合成测试。",
    "voice": "zh-CN-XiaoxiaoNeural",
    "speed": 1.0
  }'   --output speech.mp3

cURL — 语音转文字

curl http://127.0.0.1:8787/v1/audio/transcriptions   -H "Authorization: Bearer your-api-key"   -F "file=@speech.mp3"

可用接口

接口方法说明
/v1/audio/speechPOST文字转语音
/v1/audio/transcriptionsPOST语音转文字
/v1/audio/voicesGET查询可用音色
/v1/modelsGET查询可用模型
/healthzGET健康检查(无需鉴权)

全部可用语音

voice 参数中传入以下值(也可通过 GET /v1/audio/voices 查询):

voice 参数值名称类型
zh-CN-XiaoxiaoNeural晓晓女声·温柔
zh-CN-XiaoyiNeural晓伊女声·甜美
zh-CN-XiaochenNeural晓辰女声·知性
zh-CN-XiaohanNeural晓涵女声·优雅
zh-CN-XiaomengNeural晓梦女声·梦幻
zh-CN-XiaomoNeural晓墨女声·文艺
zh-CN-XiaoqiuNeural晓秋女声·成熟
zh-CN-XiaoruiNeural晓睿女声·智慧
zh-CN-XiaoshuangNeural晓双女声·活泼
zh-CN-XiaoxuanNeural晓萱女声·清新
zh-CN-XiaoyanNeural晓颜女声·柔美
zh-CN-XiaoyouNeural晓悠女声·悠扬
zh-CN-XiaozhenNeural晓甄女声·端庄
zh-CN-YunxiNeural云希男声·清朗
zh-CN-YunyangNeural云扬男声·阳光
zh-CN-YunjianNeural云健男声·稳重
zh-CN-YunfengNeural云枫男声·磁性
zh-CN-YunhaoNeural云皓男声·豪迈
zh-CN-YunxiaNeural云夏男声·热情
zh-CN-YunyeNeural云野男声·野性
zh-CN-YunzeNeural云泽男声·深沉

OpenAI 音色别名

支持以下 OpenAI 音色别名,自动映射到对应的中文语音:

别名映射语音
alloy晓晓 (XiaoxiaoNeural)
ash云希 (YunxiNeural)
ballad晓伊 (XiaoyiNeural)
coral晓辰 (XiaochenNeural)
echo云扬 (YunyangNeural)
fable云健 (YunjianNeural)
nova晓萱 (XiaoxuanNeural)
onyx云枫 (YunfengNeural)
sage晓睦 (XiaoruiNeural)
shimmer晓涵 (XiaohanNeural)

TTS 请求参数

参数类型默认值说明
inputstring要转换的文本(必填)
voicestringXiaoxiaoNeural语音名称或别名
speednumber1.0语速 (0.5 - 2.0)
pitchstring"0"音调 (-50 到 50)
volumestring"0"音量调节
stylestring"general"语音风格