MiniMax-H3 MiniMaxAI

유형
model
라이선스
other
태스크
image-text-to-video
프레임워크
minimax-h3
다운로드
2,212,155
좋아요
3,978
파라미터 수
33,122,992,896
접근
public
파일
280

태그

  • 文生视频
  • 图像生成
  • 视频生成
  • 多模态
  • 音频生成
  • 扩散模型
  • diffusers
  • 生成式AI

요약

MiniMax H3는 텍스트, 이미지, 비디오, 오디오를 통합 이해하고 최대 2K 해상도·15초 길이의 스테레오 사운드가 포함된 영상을 생성할 수 있는 범용 옴니모달 생성 시스템입니다. 다양한 종횡비와 초점·종점 프레임 모드, 멀티모달 참조 모드를 지원하며 복잡한 멀티모달 지시를 따르는 데 뛰어납니다. 영상·오디오 창작 도구, 광고·콘텐츠 제작 등 멀티모달 영상 생성이 필요한 시나리오에 적합합니다.

README

--- pipeline_tag: image-text-to-video license: other license_name: minimax-h3-community-license-agreement license_link: LICENSE library_name: minimax-h3 tags: - text-to-video - image-to-video - image-text-to-video - video-to-video - text-to-audio-video - image-to-audio-video - image-text-to-audio-v…

查看完整页面 · 查看原文