运行时依赖
安装命令
点击复制技能文档
类别:任务 Alibaba Cloud Model Studio 入口(路由) 将请求路由到现有的本地技能,以避免重复模型/参数详细信息。
前提条件 安装 SDK(推荐使用虚拟环境以避免 PEP 668 限制):
python3 -m venv .venv
. .venv/bin/activate
python -m pip install dashscope
配置 DASHSCOPE_API_KEY(推荐使用环境变量;或在 ~/.alibabacloud/credentials 中配置 dashscope_api_key)。 路由表(当前支持的技能) 需要 | 目标技能 -----|----- 文本生成 / 推理 / 工具调用技能 | ai/text/aliyun-qwen-generation/ 编码 / 仓库推理技能 | ai/code/aliyun-qwen-coder/ 深度多步骤研究技能 | ai/research/aliyun-qwen-deep-research/ 文本到图像 / 图像生成技能 | ai/image/aliyun-qwen-image/ 图像编辑技能 | ai/image/aliyun-qwen-image-edit/ 文本到视频 / 图像到视频(t2v/i2v)技能 | ai/video/aliyun-wan-video/ 非 Wan PixVerse 视频生成技能 | ai/video/aliyun-pixverse-generation/ 参考到视频(r2v)技能 | ai/video/aliyun-wan-r2v/ 数字人谈话 / 唱歌头像技能 | ai/video/aliyun-wan-digital-human/ 富有表现力的肖像视频(EMO)技能 | ai/video/aliyun-emo/ 轻量级肖像动画(LivePortrait)技能 | ai/video/aliyun-liveportrait/ 动作转移 / 跳舞头像(AnimateAnyone)技能 | ai/video/aliyun-animate-anyone/ 表情符号 / 模因肖像视频技能 | ai/video/aliyun-emoji/ 文本到语音(TTS)技能 | ai/audio/aliyun-qwen-tts/ 语音识别/转录(ASR)技能 | ai/audio/aliyun-qwen-asr/ 实时语音识别技能 | ai/audio/aliyun-qwen-asr-realtime/ 实时 TTS 技能 | ai/audio/aliyun-qwen-tts-realtime/ 实时语音翻译技能 | ai/audio/aliyun-qwen-livetranslate/ CosyVoice 声音克隆技能 | ai/audio/aliyun-cosyvoice-voice-clone/ CosyVoice 声音设计技能 | ai/audio/aliyun-cosyvoice-voice-design/ 声音克隆技能 | ai/audio/aliyun-qwen-tts-voice-clone/ 声音设计技能 | ai/audio/aliyun-qwen-tts-voice-design/ 全能多模态交互技能 | ai/multimodal/aliyun-qwen-omni/ 视觉推理技能 | ai/multimodal/aliyun-qvq/ OCR / 文档解析 / 表格解析技能 | ai/multimodal/aliyun-qwen-ocr/ 文本嵌入技能 | ai/search/aliyun-qwen-text-embedding/ 多模态嵌入技能 | ai/search/aliyun-qwen-multimodal-embedding/ 重新排序技能 | ai/search/aliyun-qwen-rerank/ 向量检索技能 | ai/search/aliyun-dashvector-search/ 或 ai/search/aliyun-opensearch-search/ 或 ai/search/aliyun-milvus-search/ 文档理解技能 | ai/text/aliyun-docmind-extract/ 视频编辑技能 | ai/video/aliyun-wan-edit/ 视频唇-sync 替换 / retalk 技能 | ai/video/aliyun-videoretalk/ 模型列表爬取/更新技能 | ai/misc/aliyun-modelstudio-crawl-and-skill/
当不匹配时 首先澄清模型能力和输入/输出类型。如果能力在仓库中缺失,请先添加一个新技能。
常见缺失能力 图像翻译 虚拟试穿 / 数字人 / 高级视频人物
对于多模态/ASR 下载失败,推荐使用上述公共 URL。对于 ASR 参数错误,请使用 data URI 在 input_audio.data 中。对于多模态嵌入 400 错误,请确保 input.contents 是一个数组。
异步任务轮询模板(视频/长时间运行任务) 当 X-DashScope-Async: enable 返回 task_id 时,按照以下方式轮询:
GET https://dashscope.aliyuncs.com/api/v1/tasks/
Authorization: Bearer $DASHSCOPE_API_KEY
示例结果字段(成功):
{
"output": {
"task_status": "SUCCEEDED",
"video_url": "https://..."
}
}
注意:推荐的轮询间隔为 15-20 秒,最大 10 次尝试。成功后,下载 output.video_url。 澄清问题(当不确定时) 您正在处理文本、图像、音频还是视频? 这是生成、编辑/理解还是检索? 您需要语音(TTS/ASR/实时翻译)还是检索(嵌入/重新排序/向量 DB)? 您想要可运行的 SDK 脚本还是仅 API/参数指导?
参考 模型列表和链接: output/alicloud-model-studio-models-summary.md API/参数/示例:请参阅目标子技能 SKILL.md 和 references/*.md 官方源列表: references/sources.md
验证 创建 output/aliyun-modelstudio-entry 目录
mkdir -p output/aliyun-modelstudio-entry
echo "validation_placeholder" > output/aliyun-modelstudio-entry/validate.txt
通过标准:命令退出 0 且 output/aliyun-modelstudio-entry/validate.txt 被生成。 输出和证据 将工件、命令输出和 API 响应摘要保存在 output/aliyun-modelstudio-entry/ 下。 在证据文件中包含关键参数(区域/资源 ID/时间范围)以实现可复现性。
工作流程 确认用户意图、区域、标识符和操作是否为只读或可变。 首先运行一个最小的只读查询以验证连接性和权限。 使用显式参数和有界范围执行目标操作。 验证结果并保存输出/证据文件。