MiniMax正式推出新一代多模态生成模型H3,并计划在近期向公众开放源代码。
H3标志着MiniMax从面向特定任务的专用模型,转向构建通用型多模态智能体的关键一步。该模型突破传统任务边界的限制,能够在融合文本、图像、音频与视频的多模态语境中,整体理解用户的创作意图,实现更自然、更连贯的内容生成与表达。
H3支持多种输入形式,包括文字、静态图像、语音及动态影像,并具备直接输出2K分辨率内容的能力,可一次性生成时长最长15秒的音画同步内容,显著降低了高质量视频创作与应用的技术门槛。
在实际应用表现上,H3已达到商用标准,可稳定服务于多种业务场景。其在精准响应指令、准确呈现文字及品牌要素、以及实现视频间动作迁移等核心能力方面均展现出优异性能,尤其适用于广告制作、品牌传播与电商内容生产等领域。
根据权威第三方评估机构发布的视频生成模型综合测评结果,H3在视频编辑能力维度位居全球首位。

评论
更多评论