MiniMax H3 通用多模态视频模型将于 8 月 3 日开源,最高可支持 15s 2K 分辨率

浏览12次 点赞0次 收藏0次

7 月 31 日消息,稀宇科技今天宣布推出 MiniMax H3 通用多模态视频模型,魔搭社区显示,这款模型将于北京时间 8 月 3 日 0 点正式开源

MiniMax H3 支持对文本、图像、视频、声音组成的多模态上下文的统一理解能力、能够输出具备原生双声道的音视频,最高可支持 15s 2K 分辨率

获悉,得益于 Contextual Omni Representation,H3-VAE,H3-Omni Transformer,In-context Regeneration 等多项技术,MiniMax 称有能力提供行业内最优的性价比,默认提供 2K 的分辨率,模型在 2K 分辨率下每秒价格不到主流模型的 1/3,768P 分辨率下是主流模型 720P 的 1/2

官方表示,这款模型有以下亮点:

  • 原生多模态理解与生成:支持文字、图片、音频、视频等多种输入,理解不同素材中的人物、动作、声音、情绪、镜头、风格与表达意图,并将多种参考信息自然融合。

  • 多模态精准编辑与控制:支持对人物、物体、场景、声音与节奏进行多维度编辑,并具备精细化指令遵循能力。

  • 商用级多场景内容生成:面向影视、广告、品牌、电商与游戏等真实商业内容场景,兼顾文字字幕、品牌信息、创意特效、产品展示、UI / UX 动态演示、游戏视觉及风格化表达。

声明:本文转载自IT 之家,转载目的在于传递更多信息,并不代表本社区赞同其观点和对其真实性负责,本文只提供参考并不构成任何建议,若有版权等问题,点击这里查看更多信息!本站拥有对此声明的最终解释权。如涉及作品内容、版权和其它问题,请联系我们删除,我方收到通知后第一时间删除内容。

点赞(0) 收藏(0)
0条评论
珍惜第一个评论,它往往能得到较好的回响。
评论
游客
游客
登录后再评论
  • 鸟过留鸣,人过留评。
  • 和谐社区,和谐点评。
最新资讯