Skip to main content

MiniMax 发布全模态模型 H3,将开源权重7 月 31 日,MiniMax 正式发布通用全模态生成模型 H3,支持对文本、图像、视频、声音的多模态上下文统一理解与生成,可输出原生双声道音视频,最高支持 15 秒 2K 分辨率

  1. 科技圈🎗在花频道📮
    MiniMax 发布 M3 模型:1M 上下文、原生多模态,编程能力领先 MiniMax 正式发布 M3 模型,采用全新 MSA 稀疏注意力架构,支持最高 100 万 token 上下文窗口,可原生处理图片、视频和桌面操作。在编程评测 SWE-Bench Pro 上,M3 得分 59%,超过 GPT-5.5 和 Gemini 3.1 Pro;在多模态 OmniDocBench 和 Agent 评测 Claw-Eval 中也达到领先水平。M3 是国内首个同时具备超长上下文、前沿编程与原生多模态能力且开源的模型。…
    MiniMax 发布全模态模型 H3,将开源权重

    7 月 31 日,MiniMax 正式发布通用全模态生成模型 H3,支持对文本、图像、视频、声音的多模态上下文统一理解与生成,可输出原生双声道音视频,最高支持 15 秒 2K 分辨率。该模型在指令遵循、文字呈现及视频动作迁移方面表现突出,适用于广告、电商、游戏等商业场景。

    H3 默认提供 2K 分辨率,同分辨率下每秒价格不到主流模型的三分之一。公司计划在未来几天内开放模型权重,以推动开源社区发展并加速国产芯片适配。H3 是继 Hailuo 01、02 后的第三代模型,在预训练阶段即融合多模态数据与任务,追求任务的统一与泛化。

    MiniMax 稀宇科技

    🌸 在花频道 · 茶馆水群 · 投稿通道
    😁 84 👍 43 🥰 6 👎 5 🔥 2 ❤️ 1 😈 1