minimax-h3 multimodalart
- 类型
- space
- 点赞
- 255
- 访问
- public
- 文件
- 15
标签
- 文生视频
- 音视频生成
- 扩散模型
- Gradio演示
- 多模态
- 推理部署
- 本地部署
摘要
该Space是MiniMax-H3视频生成模型拆分的"去噪半区",负责transformer、视频VAE与音频VAE,以bfloat16无量化方式运行,与另一Space中的Qwen3-VL条件编码器配合,通过gradio API通信完成单次去噪即同步输出视频和配乐。它通过AoTI编译加速Transformer块、避免GPU offload换取更快的推理速度(最快约10.6s/step),并针对ZeroGPU的150GB存储配额做出拆分设计,适合在受限GPU环境中部署高质量无量化文生视频推理。
README
--- title: MiniMax H3 emoji: 🎬 colorFrom: purple colorTo: indigo sdk: gradio sdk_version: 6.20.0 app_file: app.py pinned: true short_description: Video generation with a synchronized soundtrack suggested_hardware: zero-a10g --- # MiniMax-H3 — 未量化,拆分为两个 Space 单次去噪过程同时生成视频**和**音轨,全程使用 **bfloat16,无任何…