MiniMax · 多模态模型

MiniMax 模型家族

以 MiniMax-M3 为最新 Agent 主线,覆盖原生多模态、百万上下文、代码与工具调用,并延伸到语音、视频、图像和音乐。

查看官方模型文档 官方资料核验于 2026/08/27

资料待复核:以下为 2026/08/27 的研究快照,型号、价格与可用性可能已变化。请通过上方官方文档确认最新信息。

当前主线MiniMax-M3
上下文MiniMax-M3 为 1M;M2.7 为 204,800
输入模态文本、图像、音频、视频、音乐
交付形态MiniMax 开放平台、OpenAI 兼容接口、多模态 API、企业服务
Current Models

当前重点型号

MiniMax-M3MiniMax-M2.7Hailuo H3Speech 2.8image-01

价格与采购观察

M3 在 512K 以内每百万 Token 输入 2.1 元、缓存读取 0.42 元、输出 8.4 元;超过 512K 价格翻倍。页面当前标注长期半价,采购仍应复核活动与区域。

进入全量模型端点与价格目录

当前主线

MiniMax-M3 提供原生多模态输入、1M 上下文,并聚焦 Agent 推理、代码和工具使用;M2.7 保留为 204,800 上下文的成熟文本档位。Hailuo H3、Speech 2.8、image-01 与音乐模型覆盖视频、语音、图像和音乐生产。

Agent 与企业评估

文本 Agent 应测试工具调用、长任务状态、代码执行与 OpenAI 兼容层差异;语音与视频则应独立测首帧/首包时延、异步任务失败率、风格一致性和并发。百万上下文场景还要验证信息召回率,而不是只验证请求能否发送。

风险与边界

超过 512K 的输入会进入更高价格区间,长任务也会扩大输出成本。媒体端点涉及肖像、声音克隆、版权与内容审核,必须使用授权素材和审批流程。

Continue Research

继续完成企业模型决策