MiniMax-H3 MiniMaxAI
- 유형
- model
- 라이선스
- other
- 태스크
- image-text-to-video
- 프레임워크
- minimax-h3
- 다운로드
- 2,212,155
- 좋아요
- 3,978
- 파라미터 수
- 33,122,992,896
- 접근
- public
- 파일
- 280
태그
- 文生视频
- 图像生成
- 视频生成
- 多模态
- 音频生成
- 扩散模型
- diffusers
- 生成式AI
요약
MiniMax H3는 텍스트, 이미지, 비디오, 오디오를 통합 이해하고 최대 2K 해상도·15초 길이의 스테레오 사운드가 포함된 영상을 생성할 수 있는 범용 옴니모달 생성 시스템입니다. 다양한 종횡비와 초점·종점 프레임 모드, 멀티모달 참조 모드를 지원하며 복잡한 멀티모달 지시를 따르는 데 뛰어납니다. 영상·오디오 창작 도구, 광고·콘텐츠 제작 등 멀티모달 영상 생성이 필요한 시나리오에 적합합니다.
README
--- pipeline_tag: image-text-to-video license: other license_name: minimax-h3-community-license-agreement license_link: LICENSE library_name: minimax-h3 tags: - text-to-video - image-to-video - image-text-to-video - video-to-video - text-to-audio-video - image-to-audio-video - image-text-to-audio-v…