ChainThink 消息,7 月 31 日,据官方消息,MiniMax 发布全模态生成模型 H3,可同时理解文字、图片、视频和声音,并根据一条自然语言指令生成或编辑视频。
H3 支持将动作迁移、人物参考、声音参考和视频编辑放入同一次任务。例如,用户可让模型参考一段视频的镜头运动、另一张图片中的人物以及第三段音频的声音。
该模型最长可生成 15 秒视频,支持 2K 分辨率和原生双声道声音。官方 API 价格方面,2K 为每秒 0.13 美元,生成 15 秒视频约 1.95 美元;
768P 为每秒 0.09 美元。单次任务最多可输入 9 张图片、3 段视频和 3 段音频,总数不超过 12 个文件。
MiniMax 计划未来几天开放模型权重,官方尚未公布其与 Seedance、Veo 等模型的统一评测。
免责声明:含第三方意见,不构成财务建议
传Anthropic内部文化冲突加剧:士气跌至低谷,估值低于融资价14%
20 分钟前
DeepSeek-V4-Pro越跑越猛:三轮找回87.5%漏洞,超过Claude Opus 5和Qwen3.8 Max
2 小时前
Codex活跃用户突破1500万,OpenAI再送全员额度重置
3 小时前
Anthropic据悉将斥资60亿美元收购AI初创公司Decart
4 小时前
DeepSeek版Claude Code疑似今日公测,将随V4-Pro一起发布
4 小时前
马斯克再捧Grok 4.7:将会超过所有现有模型
5 小时前
谷歌因内存短缺而提高新手机价格
15 小时前






