运行时依赖
安装命令
点击复制技能文档
类别:提供者 Model Studio VideoRetalk 验证 mkdir -p output/aliyun-videoretalk python -m py_compile skills/ai/video/aliyun-videoretalk/scripts/prepare_retalk_request.py && echo "py_compile_ok" > output/aliyun-videoretalk/validate.txt 通过标准:命令退出 0 且 output/aliyun-videoretalk/validate.txt 被生成。 输出和证据 在 output/aliyun-videoretalk/ 下保存归一化的请求负载、目标面部选择设置和任务轮询快照。 记录确切的视频/音频输入 URL 和是否启用了 video_extension。 当输入已经是一个人视频,并且工作是用新的语音轨道替换唇部同步时,使用 VideoRetalk。 关键模型名称 使用此确切的模型字符串:videoretalk 先决条件 此模型目前仅支持中国大陆(北京)。 API 是 HTTP 异步のみ;没有在线控制台体验。 在环境中设置 DASHSCOPE_API_KEY,或在 ~/.alibabacloud/credentials 中添加 dashscope_api_key。 归一化接口(video.retalk) 请求模型(字符串,optional):默认 videoretalk video_url(字符串,required) audio_url(字符串,required) ref_image_url(字符串,optional):当输入视频包含多个面部时的目标面部 video_extension(布尔,optional):扩展视频以匹配更长的音频 query_face_threshold(整数,optional):120 到 200 响应 task_id(字符串) task_status(字符串) video_url(字符串,当完成时) usage(对象,optional) 端点和执行模型 提交任务:POST https://dashscope.aliyuncs.com/api/v1/services/aigc/image2video/video-synthesis/ 轮询任务:GET https://dashscope.aliyuncs.com/api/v1/tasks/{task_id} HTTP 调用是异步のみ,必须设置头 X-DashScope-Async:enable。 快速开始 python skills/ai/video/aliyun-videoretalk/scripts/prepare_retalk_request.py \ --video-url "https://example.com/talking-head.mp4" \ --audio-url "https://example.com/new-voice.wav" \ --video-extension 操作指南 保持输入视频正面和足够近,以便进行稳定的面部跟踪。 如果视频包含多个面部,提供 ref_image_url 以锚定预期目标。 如果新音频比输入视频长,明确决定是否扩展图片轨道或截断音频。 URL 必须是公共 HTTP/HTTPS 链接;本地文件路径不被 API 接受。 输出位置 默认输出:output/aliyun-videoretalk/request.json 使用 OUTPUT_DIR 覆盖基目录。 参考 references/sources.md GitHub CLI API