技术披露

AI 模型

目前用于支持 Vozmi 的生成模型和辅助模型。

2026 年 8 月 17 日

01

生成模型和访问提供商

Vozmi 目前使用以下第三方 AI 模型和访问提供商,为用户提供生成相关功能。随着提供商更新服务,模型的可用性可能发生变化;生产环境配置发生变化时,我们会更新本页面。

  • 音乐生成:Suno V4,通过 Kie.ai API 访问。
  • 图像生成和分镜:GPT Image 2 (gpt_image_2),通过 Aireiter API 访问。
  • 视频生成:Seedance 2.0 Fast Reference-to-Video (seedance-2.0-fast-reference-to-video),通过 Evolink API 访问。
02

辅助 AI 模型

音乐视频工作流程还使用辅助模型进行规划、转录、审核和人声分析。这些模型用于准备生成内容,但不作为最终的图像或视频生成器呈现。

  • 音乐视频规划:GPT-5.6 Luna,通过兼容 OpenAI 的 API 端点连接。
  • 方案审核:DeepSeek V4 Flash,通过兼容 Anthropic 的 API 端点连接。
  • 音频转录:OpenAI Whisper Large V3 Turbo,通过 OpenRouter 访问。
  • 人声分析:Xiaomi MiMo V2.5,通过 OpenRouter 访问。
03

提供商如何处理请求

为完成生成请求,Vozmi 会将必要的提示词、媒体文件和技术设置发送给适用的提供商。提供商对数据的处理受其自身服务条款和安全措施的约束。Vozmi 不声明拥有这些第三方模型。有关数据处理的更多信息,请参阅我们的隐私政策。

04

许可和合规问题

如对模型访问、许可或 Vozmi 当前使用的配置有任何疑问,请联系我们。

[email protected]