公共 API 模型
可通过 API 调用的模型
这些模型直接对应 VisionStory 公共 API 工作流。具体可用性和参数请在运行时查询。




使用 Kling 3.0 通过文本或首帧生成最高 4K 视频,或使用 Kling 3.0 Omni 加入图片与视频参考素材。
- 文本或首帧输入
- Kling 3.0 支持 4K
- Omni 支持图片和视频参考
模型选择指南
按任务选择模型
在满足质量、控制、时长和成本要求的前提下,选择足够可靠、规模尽量小的模型。
数字人视频
推荐
vs_character_v4数字人视频使用 V-Character 4.0。支持 720p、1080p 和 2K 输出,动作稳定、口型自然。
前沿 AI 视频
推荐
seedance-2.5最长 30 秒的视频可选 Seedance 2.5;图片、视频和音频参考可选 Wan;4K 输出可选 Kling 3.0。提交前请比较各模型的限制与点数成本。
AI 图像生成
推荐
nano-banana-2通用生成和编辑选择 Nano Banana 2;控制成本选择基础模型;追求最高质量与 2K 输出时选择 Pro。
文本转语音
推荐
自动选择TTS 接口会根据公共或克隆声音及输入语言选择合成策略,无需传入公共模型 ID。
VisionStory 工作区
探索更多创作模型
这些模型可在 VisionStory 创作工作区使用;模型名称不一定是公共 API 模型 ID。
开发者规则
只传入三个公共模型列表接口返回的模型 ID,不要根据工作区模型名称推测 API ID。
运行时查询
通过 API 查询可用模型与参数
模型目录会持续演进,而接口契约保持稳定。应用启动时获取目录,根据响应校验用户选择,并为每个生成任务保存返回的稳定 ID。
- 支持的画幅、分辨率与时长
- 参考素材限制与模型默认值
- 图像点数成本与当前可用状态
查询可用模型
# Talking-avatar rendering models
curl -s -H "X-API-Key: $VISIONSTORY_API_KEY" \
https://openapi.visionstory.ai/api/v1/models
# Frontier AI video models and parameter limits
curl -s -H "X-API-Key: $VISIONSTORY_API_KEY" \
https://openapi.visionstory.ai/api/v1/ai_video/models
# Image models, resolutions, reference limits, and credits
curl -s -H "X-API-Key: $VISIONSTORY_API_KEY" \
https://openapi.visionstory.ai/api/v1/image/models
