AI工具导航

Step-Video-T2V

开源,基于文本生成 204 帧视频

Step-Video-T2V 是什么?

Step-Video-T2V是StepFun的开源文本到视频模型系列。支持高达204帧的生成,采用高压缩的Video-VAE,并通过基于视频的DPO提升质量。在Step-Video-T2V-Eval上达到了SOTA水平。

产品详细介绍

开源,基于文本生成 204 帧视频

Step-Video-T2V是StepFun的开源文本到视频模型系列。支持高达204帧的生成,采用高压缩的Video-VAE,并通过基于视频的DPO提升质量。在Step-Video-T2V-Eval上达到了SOTA水平。

定价方案

需要付费
官网查看
定制方案
  • 暂未采集到具体套餐,价格以官网为准

查看官网价格

官网信息