MiniMax 是什么?

MiniMax 成立于 2021 年 12 月,是一家在通用人工智能领域迅速崛起的科技公司,秉持"与用户共创智能"的核心理念。公司自主研发了多模态的通用大模型,覆盖文本、语音、图像、视频、音乐等多个领域,为全球企业和个人开发者提供强大的 AI 技术支持。
MiniMax 的产品线包括:
MiniMax 开放平台(platform.minimaxi.com):面向开发者,提供 M3、M2.7、H3、Speech 2.8、Music 3.0 等模型 API
海螺 AI:面向个人用户的生产力工具,接入 MiniMax 自研多模态大模型
MiniMax Code:AI 编程助手,支持构建 Agent 团队
MiniMax Design:AI 设计创作平台
Talkie:AI 角色扮演与陪伴应用
2026 年,MiniMax 发布旗舰模型 M3,以前沿代码/Agent 能力、1M 上下文和原生多模态"一模型通吃",再次定义国产多模态大模型新高度。
MiniMax 核心功能
功能 | 说明 |
|---|---|
文本对话 | 多轮对话、知识问答、深度推理(M3 / M2.7) |
代码生成 | 前沿 Coding / Agentic 能力(M3),支持 Agent 开发 |
图像理解 | 原生多模态,图片内容识别与分析 |
语音合成 | 超自然、高保真语音(Speech 2.8),音色设计/克隆 |
视频生成 | 文生视频、图生视频、导演级运镜(H3) |
音乐生成 | 音乐创作(Music 3.0,已开源) |
实时语音对话 | 低延迟语音交互(海螺 AI) |
文件处理 | 长文档阅读、表格分析、链接提取 |
MiniMax 模型家族(2026 年 8 月)
最新旗舰:MiniMax M3 新上线
MiniMax M3 是 MiniMax 迄今能力最强的旗舰模型,核心特性:
前沿 Coding / Agentic 能力:软件工程任务表现领先
MSA · 1M Context:支持 1M tokens 上下文窗口
原生多模态:文本、图像统一处理
其他模型
模型 | 类型 | 上下文 | 特点 |
|---|---|---|---|
M3 | 旗舰 | 1M tokens | 前沿 Coding/Agentic、原生多模态 |
M2.7 | 通用 | 长上下文 | 通用对话、性价比之选 |
M2.7-highspeed | 高速 | — | 响应更快的高速版本 |
H3 | 视频 | — | 开放通用多模态视频模型,2K/768P 生成 |
Speech 2.8 | 语音 | — | 超自然语音合成,HD/Turbo 两档 |
Music 3.0 | 音乐 | — | 开源音乐模型,生产级 |
历史模型
Text-01 / VL-01:新一代文本与视觉-语言多模态模型
abab6.5s:万亿参数 MoE 大语言模型,200k tokens 上下文
speech-01 / speech-01-hd:语音大模型,音色克隆,字错率低至万分之五
music-01:音乐生成模型
I2V-01 / S2V-01 / T2V-01:视频生成模型系列

MiniMax API 定价(2026 年 8 月)
MiniMax 开放平台提供按量计费 API,价格为(单位:元/百万 tokens):
语言模型
模型 | 输入 | 输出 | 缓存读取 |
|---|---|---|---|
M3(≤512k 输入,永久五折后) | 2.10 | 8.40 | 0.42 |
M3(>512k 输入,永久五折后) | 4.20 | 16.80 | 0.84 |
M2.7 | 2.1 | 8.4 | 0.42 |
M2.7-highspeed | 4.2 | 16.8 | 0.42 |
M3 原价:≤512k 输入 4.2 元/输出 16.8 元;>512k 输入 8.4 元/输出 33.6 元。目前永久五折。
语音模型(元/万字符)
模型 | 单价 |
|---|---|
speech-2.8-hd(同步/异步) | 3.5 元 |
speech-2.8-turbo(同步/异步) | 2 元 |
音色设计 Voice Design | 9.9 元/音色 |
快速复刻 Voice Cloning | 9.9 元/音色 |
视频模型(H3)
项目 | 价格 |
|---|---|
2K 视频生成 | 0.80 元/秒 |
768P 视频生成 | 0.50 元/秒 |
图片素材 | 5 张以内免费,超出 0.20 元/张 |
H3-Context-IR(视频理解) | 输入 5.80 / 输出 23.00 元/百万 tokens |
MiniMax 的核心优势
旗舰 M3 一模型通吃:前沿代码/Agent 能力 + 1M 上下文 + 原生多模态
全模态覆盖:文本、语音、视频、音乐、图像五大模态
语音技术领先:Speech 2.8 超自然合成,音色设计/克隆快速便捷
视频能力突出:H3 开放通用多模态视频模型,2K 高清生成
开源生态:Music 3.0、H3 等模型开源,支持二次开发
价格亲民:M3 永久五折,语音/视频按量计费透明
MiniMax 的应用场景
AI 编程:M3 前沿 Coding 能力,MiniMax Code 构建 Agent 团队
语音交互:客服机器人、有声书、播客、数字人(Speech 2.8)
视频创作:短视频、广告、影视级运镜(H3)
音乐制作:AI 作曲、配乐(Music 3.0)
智能对话:海螺 AI 个人助手、角色扮演(Talkie)
企业服务:智能客服、内容生成、多模态分析
MiniMax 常见问题(FAQ)
Q1:MiniMax 收费吗?
海螺 AI 等 C 端产品对个人用户提供免费体验。开发者调用 API 按量计费,M3 目前永久五折。
Q2:M3 和 M2.7 有什么区别?
M3 是旗舰模型,1M 上下文 + 前沿 Coding/Agentic + 原生多模态;M2.7 是通用模型,性价比高,适合日常对话。
Q3:MiniMax 支持哪些模态?
文本、语音、图像、视频、音乐五大模态全覆盖,M3 支持原生多模态输入输出。
Q4:如何调用 MiniMax API?
通过 MiniMax 开放平台(platform.minimaxi.com)注册,获取 API Key,参考官方文档接入。
Q5:MiniMax 模型开源吗?
部分模型已开源,如 Music 3.0(Hugging Face / ModelScope)、H3 视频模型等。
Q6:MiniMax 语音合成效果如何?
Speech 2.8 支持超自然、高保真的语音合成,提供 HD/Turbo 两档,支持音色设计和快速克隆。
如何开始使用 MiniMax
海螺 AI:下载海螺 AI App 或访问网页版,免费体验多模态能力
开发者:通过 MiniMax 开放平台注册,接入 M3 / M2.7 / H3 / Speech 2.8 API
编程:使用 MiniMax Code 构建 Agent 团队
设计:使用 MiniMax Design 进行 AI 创作
开源模型:在 Hugging Face / ModelScope 获取 Music 3.0、H3 等开源模型
结语
从 2021 年成立到 2026 年发布 M3 旗舰,MiniMax 用五年时间构建了覆盖文本、语音、视频、音乐、图像的全模态 AI 生态。凭借 M3 的前沿能力、H3 的视频生成、Speech 2.8 的语音技术和亲民的价格策略,MiniMax 已经成为国产多模态大模型领域不可忽视的力量。无论你是开发者、创作者还是企业用户,MiniMax 都值得一试。







