36氪8/3 10:4974 分精选
MiniMax H3正式开源:全模态视频生成模型
MiniMax H3正式开源
推荐理由:我认为这是视频生成领域的重要开源事件,值得AI创作者和产品孵化者直接关注。MiniMax H3作为全模态生成系统,能统一理解文本、图像、视频和音频并生成2K分辨率、15秒带立体声的视频,为开发者提供了可直接部署的工程化方案,尤其适合需要多模态内容生成能力的超级个体和团队。
MiniMax 正式开源新一代通用视频模型 MiniMax H3,这是一个全模态生成系统,能够统一理解由文本、图像、视频和音频构成的多模态上下文,并生成最高 2K 分辨率、最长 15 秒、带有原生立体声音频的视频。该模型在 GitHub 上开源,旨在推动视频生成技术的普及与创新。目前该项目已获得社区关注,公开热度体现在 GitHub 仓库的星标和讨论中,但具体排名数据未披露。MiniMax H3 解决了多模态内容理解与高质量视频生成的整合问题,为开发者提供了可部署的工程化方案。