minimax-h3 multimodalart

类型
space
点赞
255
访问
public
文件
15

标签

  • 文生视频
  • 音视频生成
  • 扩散模型
  • Gradio演示
  • 多模态
  • 推理部署
  • 本地部署

摘要

该Space是MiniMax-H3视频生成模型拆分的"去噪半区",负责transformer、视频VAE与音频VAE,以bfloat16无量化方式运行,与另一Space中的Qwen3-VL条件编码器配合,通过gradio API通信完成单次去噪即同步输出视频和配乐。它通过AoTI编译加速Transformer块、避免GPU offload换取更快的推理速度(最快约10.6s/step),并针对ZeroGPU的150GB存储配额做出拆分设计,适合在受限GPU环境中部署高质量无量化文生视频推理。

README

--- title: MiniMax H3 emoji: 🎬 colorFrom: purple colorTo: indigo sdk: gradio sdk_version: 6.20.0 app_file: app.py pinned: true short_description: Video generation with a synchronized soundtrack suggested_hardware: zero-a10g --- # MiniMax-H3 — 未量化,拆分为两个 Space 单次去噪过程同时生成视频**和**音轨,全程使用 **bfloat16,无任何…

查看完整页面 · 查看原文