MiniMax预告生图模型:基于H3架构,生图、修图单个模型包办

火星财经快讯

08月08日 17:03
据动察 Beating 监测,MiniMax H3 团队在 Reddit AMA 中透露,正在开发一款专门的图像模型,并计划开放权重。它会把文生图和通用图片编辑放进同一个模型,目前已经进入后训练优化阶段。 这款模型和 H3 来自同一套架构思路。它会沿用 H3 的 VAE Encoder,并为图片生成单独设计 VAE Decoder。MiniMax 设想的工作流是,先用图像模型生成首帧,再交给 H3 继续生成视频。 团队还提到,H3 本身已经表现出一定的生图和修图潜力。此前他们只训练模型根据「首帧 + 文字描述」预测尾帧,没有专门做图片编辑训练,但模型在多项图片编辑评测中仍表现出较强的零样本能力。这也是 MiniMax 继续把这套架构扩展到图像模型的重要依据。

查看原文 >
本内容旨在传递行业动态,不构成投资建议或承诺。
看更多快讯,下载火星财经 APP