跳到主要内容

使用AI声音制作一个音频

使用获得场景视频数字人功能,可以快速制作音频内容,主要有以下步骤:

1.创建项目

首先,请求创建项目接口,创建一个项目,接口返回项目ID,后续步骤使用。例如:88BC616C6237CE18。

curl --request POST \
--url 'https://digitbot.bokecc.com/api/project/create?accountId=950234CBB7F04284&version=1.0.0&time=1706523797&hash=b1ed7de9e3178fd97bb19d9cb2c7a508' \
--header 'content-type: application/json' \
--data '{
"name": "制作音频演示项目"
}'

也可以重复利用已经创建好的项目,通过查询项目列表接口,获取项目ID信息。

2.配置项目

项目创建成功后,请求 配置项目 接口,配置上一步创建的项目属性,更新以下内容:

使用AI声音制作音频时,只能使用文本驱动。

请参照下面示例中的要求说明进行配置。

curl --request POST \
--url 'https://digitbot.bokecc.com/api/project/update?accountId=950234CBB7F04284&version=1.0.0&projectId=88BC616C6237CE18&time=1706523797&hash=b1ed7de9e3178fd97bb19d9cb2c7a508' \
--header 'content-type: application/json' \
--data '{
"name": "演示项目", // 可以不配置,保持创建时的默认值 - 未命名项目。
"scenes": [{ // 必需,至少要配置一个场景。
"driverType": 0, // 必需,指定场景的驱动类型为0=文本驱动。
"textDriver": { // 必需。
"text": "这是一个测试文本驱动的场景。", // 必需,设置合成视频时播报的文本内容。
"speed": 1.00, // 可以不配置,保持创建时的默认值 - 1。
"volume": 2.0 // 可以不配置,保持创建时的默认值 - 1。
},
"voiceModel": { // 必需。
"type": 0, // 必需。指定使用声音类型为0=AI声音。
"modelId": "950234CBB7F04284" // 必需。指定使用的AI声音数字人ID,可以从声音数字人相关的列表查询接口中获取。
},
}, ...]
}'

请求上述接口,根据要制作的音频需求,设置参数组合,更新项目属性。

3.合成音频

项目配置成功后,请求合成作品 接口,制作一个音频。

合成视频请求:

curl --request POST \
--url 'https://digitbot.bokecc.com/api/project/compose?accountId=950234CBB7F04284&version=1.0.0&projectId=88BC616C6237CE18&time=1706523797&hash=b1ed7de9e3178fd97bb19d9cb2c7a508' \
--header 'content-type: application/json' \
--data '{
"type": 1, // 必需,指定合成的作品为音频。
"name": "合成音频演示", // 可以不设置,不设置时,使用项目名称,做为作品名称。
"callbackUrl": "https://xxxxx.xxxxx" // 可以不设置,不设置时,作品合成完成后不会回调给客户。
}'

4.接收回调或轮询结果

请求合成音频成功时,接口返回作品ID。

若请求合成音频时配置了回调地址,客户需要在回调接口中匹配作品ID,处理回调结果。

若请求合成音频时未配置回调地址,客户可以使用作品ID请求查询作品详情接口,查询音频合成状态、进度,以及合成结果。