doubao-seedance-2.0 · 图文音多模态参考生成 · 完整流程
curl -X POST https://startoken.link/v1/video/generations \ -H "Authorization: Bearer sk-xxx" \ -H "Content-Type: application/json" \ -d '{ "model": "doubao-seedance-xxx", "prompt": "全程使用视频1的第一视角构图,全程使用音频1作为背景音乐。第一人称视角果茶宣传广告,seedance牌「苹苹安安」苹果果茶限定款;首帧为图片1,你的手摘下一颗带晨露的阿克苏红苹果,轻脆的苹果碰撞声;2-4 秒:快速切镜,你的手将苹果块投入雪克杯,加入冰块与茶底,用力摇晃,冰块碰撞声与摇晃声卡点轻快鼓点,背景音:「鲜切现摇」;4-6 秒:第一人称成品特写,分层果茶倒入透明杯,你的手轻挤奶盖在顶部铺展,在杯身贴上粉红包标,镜头拉近看奶盖与果茶的分层纹理;6-8 秒:第一人称手持举杯,你将图片2中的果茶举到镜头前(模拟递到观众面前的视角),杯身标签清晰可见,背景音「来一口鲜爽」,尾帧定格为图片2。背景声音统一为女生音色。", "content": [ { "type": "image_url", "image_url": { "url": "https://ark-project.tos-cn-beijing.volces.com/doc_image/r2v_tea_pic1.jpg" }, "role": "reference_image" }, { "type": "image_url", "image_url": { "url": "https://ark-project.tos-cn-beijing.volces.com/doc_image/r2v_tea_pic2.jpg" }, "role": "reference_image" }, { "type": "video_url", "video_url": { "url": "https://ark-project.tos-cn-beijing.volces.com/doc_video/r2v_tea_video1.mp4" }, "role": "reference_video" }, { "type": "audio_url", "audio_url": { "url": "https://ark-project.tos-cn-beijing.volces.com/doc_audio/r2v_tea_audio1.mp3" }, "role": "reference_audio" } ], "generate_audio": true, "ratio": "16:9", "duration": 11, "watermark": false }'
curl -X GET "https://startoken.link/v1/video/generations/{task_id}" \ -H "Authorization: Bearer sk-xxx"
调用 POST /v1/video/generations 接口,传入模型、提示词、参考内容(图片/视频/音频)和输出参数。接口会立即返回一个 task_id。
使用上一步返回的 task_id,调用 GET /v1/video/generations/{task_id} 接口。视频生成需要时间,建议每 5-10 秒查询一次,直到状态变为 completed 或 failed。
当任务状态为 completed 时,响应体中包含生成的视频 URL。下载后即可使用。
sk-xxx 替换为你的真实 API Keydoubao-seedance-xxx 替换为所需模型 (2.0 / 1.5 / 1.0 / t2i-2.0){task_id} 替换为 Step 1 返回的实际任务 ID