详情
产业
洞察
+
AI 多模态新突破
7 月 31 日,MiniMax 发布新一代多模态生成模型 MiniMax H3,并宣布近期开源。

MiniMax H3 全新发布
综合实力领跑全球
01
7 月 31 日, MiniMax 推出首款开源通用多模态模型 H3,该模型打通文、图、音、视频多模态输入,支持 2K 分辨率、最长 15 秒音画生成,视频编辑能力位列 Artificial Analysis 全球榜单首位。模型适配电商、广告、游戏等商用场景,依托自研优化技术将 2K 视频生成成本压至 0.8 元 / 秒,仅为同类旗舰三分之一,短期内将全面开源,支持企业本地部署定制化开发。




开源 + 低成本重构
AI 多模态产业竞争
02
MiniMax H3将多模态模型的竞争进一步带向效果、成本、开放性与生态协同的综合维度,丰富了模型企业与国产AI芯片软硬件协同生态。H3 核心突破在于三点:一是将文本模型成熟推理、优化技术复用至多模态训练,大幅提升复杂指令理解能力;二是以高压缩 Tokenizer、异构算力调度实现效果与成本平衡,解决商用落地贵的痛点;三是选择开源路线打破闭源模型壁垒,兼顾企业数据安全合规需求,行业竞争正式进入性能、成本、开源生态综合比拼阶段。
MiniMax H3生成游戏界面和电影开头


产业启示
03
对广东而言,广东电商、文创、游戏产业基础雄厚,应加快引入开源多模态模型落地;联动本土国产 AI 芯片企业开展软硬件适配协同;搭建开发者开源生态平台,降低中小内容企业 AI 创作成本,依托海量产业场景推动多模态技术规模化商业化,构筑数字内容新质生产力优势。
《纸手机》在可灵AI上的制作过程。

