MiniMax多模态模型H3发布,将于近期开源

七颜百科 °C 栏目:历史大事记
MiniMax多模态模型H3发布,将于近期开源

  新浪科技讯 7 月 31 日上午消息,MiniMax发布新一代多模态生成模型 MiniMax H3,并宣布将于近期开源。

  H3是MiniMax 从“特化任务模型”迈向“通用多模态智能”的重要探索,其不再以图片、视频、声音的生成、编辑和参考等单一任务为边界,而是在多模态上下文中统一理解创作意图,完成更加自然、连贯的生成与表达。

  MiniMax H3 支持文本、图片、音频和视频等多种输入形式,支持 2K 分辨率直出,可生成最长 15 秒的音画内容,在提升视听生成能力的同时,进一步降低高质量视频内容的创作和使用门槛。

  在模型效果方面,MiniMax H3 具备商用级的多场景内容生成能力,在指令遵循、文字与品牌信息呈现、V2V Motion Transfer(视频到视频动作迁移)等方面表现出色,可实现精准、可控的多模态内容编辑与生成,并广泛适用于广告、品牌、电商、产品设计、UI/UX、游戏等商业场景。

  在 Artificial Analysis 视频模型榜单中,MiniMax H3 在视频编辑能力项排名全球第一。(文猛)