没有找到匹配的文档“”。
可以尝试功能或资源名称,例如 video、avatar、MCP。
开发文档
先生成一个口播视频,再逐步组合声音克隆、语音、图像、AI 视频、自动化和 Agent 能力。
了解认证方式、异步任务、核心资源、响应结构与模型发现。
使用 REST API 或 Python SDK 生成并下载第一个口播视频。
浏览公共形象,或通过一张肖像创建可复用的专属形象。
浏览公共声音,或通过音频样本克隆专属 AI 声音。
生成文生视频、图生视频和参考素材驱动的视频。
使用公共或克隆声音,将文本转换为 MP3 语音。
转写语音、生成 SRT 字幕,或将文本与音频逐词对齐。
生成或编辑 AI 图像,并在视频工作流中复用。
从图片、音频或视频中提取符合指定 JSON Schema 的结构化数据。
在 Python 中完成认证、媒体生成、任务轮询和文件下载。
在终端、脚本或 CI 中调用完整的 VisionStory API。
通过 MCP、Agent Skill、SDK、CLI 或 OpenAPI 连接 AI Agent。