跳转至

MaaS_Az_tts/Op_tts

文本转语音接口

请求URL

POST https://genaiapi-m2.cloudsway.net/v1/ai/${ENDPOINT_PATH}/audio/speech

请求参数

参数 描述 示例
model 使用模型 MaaS ASpeech
input 需要生成音频的文本 how are you
voice 当生成音频时可选用的声音 可选值: "alloy", "echo", "fable", "onyx", "nova", "shimmer" alloy
response_format 音频格式 可选值: "mp3", "opus", "aac", "flac", "wav", "pcm" mp3
speed 音频速度 范围是: 0.25 to 4.0. MaaS_Op_tts 支持 1

响应

文件流

请求示例

Request

MaaS_Az_tts

curl --location --request POST ' https://genaiapi-m2.cloudsway.net/v1/ai/${ENDPOINT_PATH}/audio/speech' \
--header 'Authorization: Bearer ${your ak}' \
--header 'Content-Type: application/json' \
--header 'Connection: keep-alive' \
--data-raw '{

    "input":"<speak version='\''1.0'\'' xml:lang='\''en-US'\''><voice xml:lang='\''en-US'\'' xml:gender='\''Female'\'' name='\''en-US-AvaMultilingualNeural'\''>吃葡萄不吐葡萄皮</voice></speak>",

    "response_format":"audio-16khz-128kbitrate-mono-mp3"

}'

MaaS_Op_tts

curl 'http://genaiapi-m2.cloudsway.net/v1/audio/speech' \
-H 'Authorization: Bearer {Your_AK}' \
-H 'Content-Type: application/json' \
-d '{
    "input":"hi,what is your name?",
    "voice":"alloy",
    "speed":1.0,
    "response_format":"mp3"
}'

Response

file

文本转语音http流式接口(仅MaaS_Az_tts )

请求URL

POST https://genaiapi-m2.cloudsway.net/v1/ai/${ENDPOINT_PATH}/audio/speech/stream

请求参数

参数 描述 示例
model 使用模型 MaaS ASpeech
input 需要生成音频的文本(SSML格式) \\吃葡萄不吐葡萄皮\\
response_format 音频格式 可选值: "mp3", "opus", "aac", "flac", "wav", "pcm" 可选值(Streaming): amr-wb-16000hz audio-16khz-32kbitrate-mono-mp3 audio-16khz-64kbitrate-mono-mp3 audio-16khz-128kbitrate-mono-mp3 audio-24khz-48kbitrate-mono-mp3 audio-24khz-96kbitrate-mono-mp3 audio-24khz-160kbitrate-mono-mp3 audio-48khz-96kbitrate-mono-mp3 audio-48khz-192kbitrate-mono-mp3 g722-16khz-64kbps ogg-16khz-16bit-mono-opus ogg-24khz-16bit-mono-opus ogg-48khz-16bit-mono-opus raw-8khz-8bit-mono-alaw raw-8khz-8bit-mono-mulaw raw-8khz-16bit-mono-pcm raw-16khz-16bit-mono-pcm raw-16khz-16bit-mono-truesilk raw-22050hz-16bit-mono-pcm raw-24khz-16bit-mono-pcm raw-24khz-16bit-mono-truesilk raw-44100hz-16bit-mono-pcm raw-48khz-16bit-mono-pcm webm-16khz-16bit-mono-opus webm-24khz-16bit-24kbps-mono-opus webm-24khz-16bit-mono-opus 可选值(NonStreaming): riff-8khz-8bit-mono-alaw riff-8khz-8bit-mono-mulaw riff-8khz-16bit-mono-pcm riff-22050hz-16bit-mono-pcm riff-24khz-16bit-mono-pcm riff-44100hz-16bit-mono-pcm riff-48khz-16bit-mono-pcm audio-16khz-32kbitrate-mono-mp3

请求示例

curl --location --request POST 'http://genaiapi-m2.cloudsway.net/v1/ai/${ENDPOINT_PATH}/audio/speech/stream'
--header 'Authorization: Bearer ${your ak}' \
--header 'Content-Type: application/json' \
--header 'Accept: */*' \
--header 'Connection: keep-alive' \
--data-raw '{

    "input":"<speak version='\''1.0'\'' xml:lang='\''en-US'\''><voice xml:lang='\''en-US'\'' xml:gender='\''Female'\'' name='\''en-US-AvaMultilingualNeural'\''>吃葡萄不吐葡萄皮</voice></speak>",

    "response_format":"audio-16khz-32kbitrate-mono-mp3"

}'

注意事项

此 HTTP 请求使用 SSML 指定语音和语言。如果请求体过长,导致生成的音频超过 10 分钟,则会拦截报错,建议拆分文本后重新请求。

获取MaaS_Az_tts 区域语音列表

请求URL

POST https://genaiapi-m2.cloudsway.net/v1/ai/${ENDPOINT_PATH}/cognitiveservices/voices/list

请求参数

响应

参数 描述 示例
Name 语音全称 Microsoft Server Speech Text to Speech Voice (af-ZA, AdriNeural)
DisplayName 展示名称 Adri
LocalName 本地名称 Adri
ShortName 简称 af-ZA-AdriNeural
Gender 语音性别 Female
Locale 语言环境 af-ZA
LocaleName 语言环境名称 Afrikaans (South Africa)
SampleRateHertz 采样赫兹 48000
VoiceType 语音类型 Neural
Status 状态 GA
WordsPerMinute 每分钟读单词数量 147

请求示例

Request

curl --location --request GET 'http://genaiapi-m2.cloudsway.net/v1/ai/${ENDPOINT_PATH}/cognitiveservices/voices/list' \
--header 'Authorization: Bearer ${your ak}' \
--header 'Content-Type: application/json' \
--header 'Connection: keep-alive' \
--data-raw ''

Response

[
    {
        "Name": "Microsoft Server Speech Text to Speech Voice (af-ZA, AdriNeural)",
        "DisplayName": "Adri",
        "LocalName": "Adri",
        "ShortName": "af-ZA-AdriNeural",
        "Gender": "Female",
        "Locale": "af-ZA",
        "LocaleName": "Afrikaans (South Africa)",
        "SampleRateHertz": "48000",
        "VoiceType": "Neural",
        "Status": "GA",
        "VoiceTag": {
            "ModelSeries": [
                "Monolingual"
            ],
            "Source": [
                "Azure"
            ],
            "TailoredScenarios": [
                "Assistant",
                "Narration"
            ],
            "VoicePersonalities": [
                "Well-Rounded",
                "Animated",
                "Bright"
            ]
        },
        "WordsPerMinute": "147"
    },
......
]

融合接口调用

注意融合接口的参数与非融合接口的一样,但model字段为必填,传入模型商品编码。

请求URL

POST https://genaiapi-m2.cloudsway.net/v1/audio/speech

MaaS_Az_tts

请求示例

curl 'http://genaiapi-m2.cloudsway.net/v1/audio/speech' \
-H 'Authorization: Bearer {Your_AK}' \
-H 'Content-Type: application/json' \
-d '{
    "input": "<speak version=\"1.0\" xml:lang=\"en-US\"><voice xml:lang=\"en-US\" xml:gender=\"Female\" name=\"en-US-AvaMultilingualNeural\">my voice is my passport verify me</voice></speak>",
    "response_format": "audio-16khz-128kbitrate-mono-mp3",
    "model": "MaaS_Az_tts"
}'

MaaS_Op_tts

请求示例

curl 'http://genaiapi-m2.cloudsway.net/v1/audio/speech' \
-H 'Authorization: Bearer {Your_AK}' \
-H 'Content-Type: application/json' \
-d '{
    "input":"hi,what is your name?",
    "voice":"alloy",
    "speed":1.0,
    "response_format":"mp3",
    "model": "MaaS_Op_tts"
}'