来源:新浪科技
新浪科技讯 7 月 31 日上午消息,MiniMax 发布新一代多模态生成模型 MiniMax H3,并宣布将于近期开源。
H3 是 MiniMax 从 " 特化任务模型 " 迈向 " 通用多模态智能 " 的重要探索,其不再以图片、视频、声音的生成、编辑和参考等单一任务为边界,而是在多模态上下文中统一理解创作意图,完成更加自然、连贯的生成与表达。
MiniMax H3 支持文本、图片、音频和视频等多种输入形式,支持 2K 分辨率直出,可生成最长 15 秒的音画内容,在提升视听生成能力的同时,进一步降低高质量视频内容的创作和使用门槛。
在模型效果方面,MiniMax H3 具备商用级的多场景内容生成能力,在指令遵循、文字与品牌信息呈现、V2V Motion Transfer(视频到视频动作迁移)等方面表现出色,可实现精准、可控的多模态内容编辑与生成,并广泛适用于广告、品牌、电商、产品设计、UI/UX、游戏等商业场景。
在 Artificial Analysis 视频模型榜单中,MiniMax H3 在视频编辑能力项排名全球第一。(文猛)
