stable-video-diffusion-img2vid-xt stabilityai
- 类型
- model
- 任务
- image-to-video
- 框架
- diffusers
- 下载量
- 144,447
- 点赞
- 3,377
- 访问
- public
- 文件
- 0
标签
- 图生视频
- 视频生成
- 扩散模型
- 生成式AI
- 视觉模型
- diffusers
摘要
该模型是 Stability AI 的 Stable Video Diffusion(SVD-XT)图像转视频扩散模型,以单张静态图像作为条件帧,生成约25帧、分辨率576x1024的短视频片段。它在 SVD 14帧版本基础上微调,并对解码器进行了时序一致性微调,可应用于生成模型研究、艺术创作、设计及教育/创意工具等场景。模型不支持文本控制,生成视频较短(约4秒),且人物、人脸和文字渲染可能存在局限。
README
--- pipeline_tag: image-to-video license: other license_name: stable-video-diffusion-community license_link: LICENSE.md --- # Stable Video Diffusion 图像到视频模型卡 <!-- 简要概述该模型是什么/能做什么。 -->  Stable Video Diffusion(SVD)图像到视频是一种扩散模型,它以静止图像作为条件帧,并从中生成视频。 请注意:商业用途请参考 https://stabilit…