新模型发布
MiniMax H3开源全能视频模型:2K原生立体声,成本仅为竞品三分之一
2026年7月31日,稀宇科技(MiniMax)推出新一代多模态生成模型MiniMax H3。该模型统一理解文本、图像、视频和音频四种模态,可生成最高2K分辨率、15秒时长、原生双声道立体声的视频内容——这是视频生成领域首次在开源模型中实现原生立体声音频同步生成。H3已上线Vercel AI Gateway,计划8月3日在魔搭社区正式开源权重。
在性价比方面,H3展现出极致竞争力:2K分辨率下每秒生成价格不到主流模型的三分之一,768P分辨率价格甚至低于主流模型720P的一半。这意味着使用H3生成一段15秒2K视频的成本,可能仅为使用Runway或Kling AI的几分之一。结合开源策略,H3将大幅降低视频创作的门槛,使个人创作者和小型工作室也能负担高质量视频生成。
H3的发布标志着视频生成赛道进入"开源普惠+极致性价比"的新阶段。此前视频生成市场由Runway ML、Kling AI、Pika等闭源产品主导,定价较高且功能受限。H3以开源+低价的组合拳切入,可能像Kimi K3对编程领域的影响一样,对视频生成领域产生颠覆性冲击。对内容创作者而言,H3的开源意味着可以在本地部署或以极低成本使用顶级视频生成能力,加速AI视频创作从"尝鲜"走向"日常生产工具"。