让你的应用生成数字人视频
通过 API、Python SDK 或 CLI,将文本或音频转为数字人视频。也可连接 AI Agent,完成生成与下载。
- 输入
- 文本或音频
- 输出
- MP4 视频
- 接入方式
- API · SDK · CLI · MCP
from visionstory import VisionStoryClient, build_video_payload
client = VisionStoryClient.from_env()
video = client.generate_video(build_video_payload(
avatar_id="your_avatar_id",
text="Welcome to VisionStory.",
voice_id="your_voice_id",
))
client.download(video["video_url"], "result.mp4")开发者工具
选择接入方式
用 Python SDK 构建应用,用 CLI 自动化任务,或通过 MCP 与 Skill 连接 AI Agent。
Agent 就绪
连接你常用的 AI Agent
复制一段设置说明交给编码 Agent,或连接 MCP Server,将 VisionStory 作为可复用工具提供给 Agent。
VisionStory CLI
在终端中调用全部 API
安装脚本会在隔离环境中升级到最新 PyPI 版本,不会影响你现有的 Python 项目。
curl -fsSL https://developers.visionstory.ai/cli | bashHelp me set up VisionStory and generate a talking-avatar video.1. Install or update the CLI and Agent Skill: curl -fsSL https://developers.visionstory.ai/cli | bash npx skills add visionstory-ai/skills --skill visionstory-api2. Run visionstory doctor. If I need a key, send me to https://developers.visionstory.ai/api-keys, wait while I create one, then ask me to run visionstory login in my terminal. Never ask me to paste the key into chat or expose it.3. Verify access with visionstory credits. Stop and help me if it fails.4. Discover current models, avatars, and voices, then use the CLI and visionstory-api skill to create and download the video. Never delete anything unless I explicitly request and confirm it.
第一次使用? 创建 API Key,然后把这段提示词发送给 Claude Code。它会引导你完成 visionstory login、查询剩余点数,并在不暴露密钥的情况下生成视频。
一个完整流程
四步生成并下载视频
选好形象,提供文本或音频,剩下的交给 VisionStory。
- 01
选择形象
使用现成的数字人,或上传肖像创建专属形象。
- 02
添加内容
输入文本并选择声音,也可直接使用录好的音频。
- 03
提交生成
提交一次请求,由 VisionStory 在后台异步渲染。
- 04
下载视频
任务完成后,通过返回的链接下载 MP4 文件。
API 能力
覆盖完整媒体流程的 API
先从口播视频开始,再按业务需要组合声音、图像生成、前沿视频模型和可复用媒体素材。
媒体理解
从图片、音频或视频中提取符合指定 JSON Schema 的结构化数据。
数字人形象
浏览公共 AI 形象,或通过一张肖像创建可复用的专属形象。
声音
浏览公共声音,或通过音频样本克隆专属 AI 声音。
模型
查询支持的口播视频模型、分辨率和画面比例。
用量与计费
查看当前订阅方案和剩余生成点数。
AI 视频
生成文生视频、图生视频和参考素材驱动的 AI 视频。
文本转语音
使用公共或克隆声音,将文本转换为自然的 MP3 语音。
语音转文字
转写语音、区分说话人的发言、导出 SRT 字幕,或将已知文本与音频逐词对齐。
图像生成
根据文本提示和可选参考素材生成或编辑 AI 图像。
素材
上传并复用图像、音频和视频素材,供多个生成任务使用。
- 1配置认证
VISIONSTORY_API_KEY - 2发送请求
POST
/api/v1/video - ✓获得任务 ID
video_123456
{
"data": {
"video_id": "video_123456"
},
"message": "success",
"server_time": "2026-08-24T08:00:00Z"
}