MiniMax发布全模态生成模型H3,一个模型包办图片、视频和声音

MiniMax发布全模态生成模型H3,一个模型包办图片、视频和声音

2026-07-31 10:36

ChainThink 消息,7 月 31 日,据官方消息,MiniMax 发布全模态生成模型 H3,可同时理解文字、图片、视频和声音,并根据一条自然语言指令生成或编辑视频。

H3 支持将动作迁移、人物参考、声音参考和视频编辑放入同一次任务。例如,用户可让模型参考一段视频的镜头运动、另一张图片中的人物以及第三段音频的声音。

该模型最长可生成 15 秒视频,支持 2K 分辨率和原生双声道声音。官方 API 价格方面,2K 为每秒 0.13 美元,生成 15 秒视频约 1.95 美元;

768P 为每秒 0.09 美元。单次任务最多可输入 9 张图片、3 段视频和 3 段音频,总数不超过 12 个文件。

MiniMax 计划未来几天开放模型权重,官方尚未公布其与 Seedance、Veo 等模型的统一评测。

#AI巨头动态

免责声明:含第三方意见,不构成财务建议

推荐阅读

DeepSeek-V4-Pro越跑越猛:三轮找回87.5%漏洞,超过Claude Opus 5和Qwen3.8 Max

1 小时前
DeepSeek-V4-Pro越跑越猛:三轮找回87.5%漏洞,超过Claude Opus 5和Qwen3.8 Max

Codex活跃用户突破1500万,OpenAI再送全员额度重置

2 小时前
Codex活跃用户突破1500万,OpenAI再送全员额度重置

Anthropic据悉将斥资60亿美元收购AI初创公司Decart

3 小时前
Anthropic据悉将斥资60亿美元收购AI初创公司Decart

DeepSeek版Claude Code疑似今日公测,将随V4-Pro一起发布

3 小时前
DeepSeek版Claude Code疑似今日公测,将随V4-Pro一起发布

马斯克再捧Grok 4.7:将会超过所有现有模型

4 小时前
马斯克再捧Grok 4.7:将会超过所有现有模型

谷歌因内存短缺而提高新手机价格

14 小时前
谷歌因内存短缺而提高新手机价格

腾讯AI开始同时吃掉现金流和利润:Q2自由现金流转负138亿

19 小时前
腾讯AI开始同时吃掉现金流和利润:Q2自由现金流转负138亿