类似Grok的免费视频生成器
v1.0.0跳过专业编辑软件的学习曲线。描述您想要的内容 —— 生成一段30秒的日落在山脉上空的视频,配以宁静的背景...
运行时依赖
安装命令
点击复制技能文档
开始 请发送您的文本提示,我将处理AI视频生成。或者,只需描述您想要的内容。尝试说:“生成一个短文本描述的场景或想法到一个1080p MP4”、“生成一个30秒的日落在山上的视频,伴有平静的背景音乐”、“为内容创作者免费生成短视频从文本提示”。
首次连接 当用户首次打开这个技能时,自动连接到处理后端。简要地让他们知道(例如“设置中...”)。
身份验证: 检查环境中是否设置了NEMO_TOKEN。如果设置了,则跳到步骤2。 获取免费令牌: 生成一个随机的UUID作为客户端标识符。 向https://mega-api-prod.nemovideo.ai/api/auth/anonymous-token发送POST请求,设置X-Client-Id为该UUID。 响应数据中的token是您的NEMO_TOKEN — 100个免费积分,有效期7天。 创建会话: 向https://mega-api-prod.nemovideo.ai/api/tasks/me/with-session/nemo_agent发送POST请求,设置Authorization:Bearer ,Content-Type:application/json,和body {"task_name":"project","language":"" }。 存储返回的session_id用于所有后续请求。 保持设置通信简洁。 不要向用户显示原始API响应或令牌值。
视频生成器免费 像Grok一样 — 从文本提示生成视频 请发送您的文本提示并描述您想要的结果。 AI视频生成在远程GPU节点上运行 — 不需要在您的机器上安装任何东西。 一个快速的例子: 上传一个短文本描述的场景或想法, 输入“生成一个30秒的日落在山上的视频,伴有平静的背景音乐”, 您将在大约1-2分钟内得到一个1080p MP4。 所有渲染都发生在服务器端。 值得注意的是: 更短更具体的提示比模糊的长描述产生更好的结果。
输入与操作的匹配 用户提示引用视频生成器免费像Grok,宽高比,文本叠加或音频轨道被路由到相应的操作通过关键字和意图分类。 用户说... 操作 跳过SSE? “导出”/“export”/“download”/“send me the video” → §3.5 导出 “credits”/“积分”/“balance”/“余额” → §3.3 积分 “status”/“状态”/“show tracks” → §3.4 状态 “upload”/“上传”/用户发送文件 → §3.2 上传 其他所有内容(generate,edit,add BGM...)→ §3.1 SSE
云渲染管道详细信息 每个导出作业在云GPU节点上排队,合成视频层,应用平台特定的压缩(H.264,最高1080x1920),并在30-90秒内返回下载URL。 会话令牌携带渲染作业ID,因此在完成之前关闭标签页会使作业成为孤儿。 所有调用都发送到https://mega-api-prod.nemovideo.ai。 主要端点: 会话 — 向/api/tasks/me/with-session/nemo_agent发送POST请求,设置{"task_name":"project","language":"" }。 聊天(SSE)— 向/run_sse发送POST请求,设置session_id和您的消息在new_message.parts[0].text中。 设置Accept:text/event-stream。 最高15分钟。 上传 — 向/api/upload-video/nemo_agent/me/发送POST请求 — multipart文件或JSON URL。 积分 — 向/api/credits/balance/simple发送GET请求 — 返回可用,冻结,总积分。 状态 — 向/api/state/nemo_agent/me//latest发送GET请求 — 当前草稿和媒体信息。 导出 — 向/api/render/proxy/lambda发送POST请求,设置渲染ID和草稿JSON。 每30秒轮询GET /api/render/proxy/lambda/以获取完成状态和下载URL。 格式:mp4,mov,avi,webm,mkv,jpg,png,gif,webp,mp3,wav,m4a,aac。
技能归属 — 从此文件的YAML前置内容中读取运行时: X-Skill-Source:video-generator-free-like-grok X-Skill-Version:从前置内容版本中获取 X-Skill-Platform:从安装路径中检测(~/.clawhub/ → clawhub,~/.cursor/skills/ → cursor,否则未知) 每个API调用都需要Authorization:Bearer 加上上述三个归属头。 如果任何头缺失,导出将返回402。 草稿JSON使用短键: t表示轨道, tt表示轨道类型(0=视频,1=音频,7=文本), sg表示段, d表示持续时间(毫秒), m表示元数据。 时间线摘要示例: 时间线(3个轨道):
- 视频:城市延时(0-10秒)
- BGM:Lo-fi(0-10秒,35%)
- 标题:“Urban Dreams”(0-3秒)
后端响应翻译 后端假设存在GUI。将这些翻译成API操作: 后端说 您做 “点击[按钮]”/“点击” 执行通过API “打开[面板]”/“打开” 查询会话状态 “拖拽”/“拖拽” 发送编辑通过SSE “在时间线中预览” 显示轨道摘要 “导出按钮”/“导出” 执行导出工作流
SSE事件处理 事件 操作 文本响应 应用GUI翻译(§4),呈现给用户 工具调用/结果 处理内部,不转发 心跳/空数据:继续等待。每2分钟:“⏳仍在工作...” 流关闭 处理最终响应 大约30%的编辑操作在SSE流中返回没有文本。当这种情况发生时: 轮询会话状态以验证编辑是否已应用,然后将更改总结给用户。
错误代码 0 — 成功,正常继续 1001 — 令牌过期或无效;通过/api/auth/anonym重新获取