MiniMax H3 发布:开源全能多模态生成模型,支持 2K 原生立体声视频
推荐理由
MiniMax 发布多模态模型 H3 并计划开源,性能与价格优势明确,或推动视频生成行业成本下降。
ROBOAIRADAR BRIEF
结构化情报
01
发生了什么
MiniMax 正式推出全能多模态生成模型 H3,可联合理解文本、图像、视频和音频,生成最高 2K 分辨率、15 秒时长且带原生立体声的视频。H3 在指令跟随、文字与品牌呈现、V2V 动作迁移上表现突出,2K 下每秒价格低于主流模型三分之一,768p 下低于主流 720p 价格一半。官方计划近日开源模型权重,以支持开源社区并加速硬件兼容。
02
为什么重要
MiniMax 发布多模态模型 H3 并计划开源,性能与价格优势明确,或推动视频生成行业成本下降。
03
行业影响
模型能力变化可能影响机器人感知、规划和交互技术栈,但落地仍取决于硬件与实时性能。
信息说明
RoboAIRadar 对公开信源进行聚合、中文整理和价值判断,不替代原始报道。 涉及产品参数、交易金额或公司声明时,请以原文为准。
查看原始报道