MiniMax

♨10 热度

MiniMax 是一家成立于 2021 年的通用人工智能科技公司,自主研发多模态大模型,覆盖文本、语音、图像、视频、音乐。最新旗舰 MiniMax M3 以前沿代码能力、1M 上下文和原生多模态著称。本文基于 MiniMax 官网与开放平台最新信息,全面解析 MiniMax 产品、模型家族、API 定价、应用场景与常见问题。

直达网站
MiniMax 工具界面或产品展示图
工具介绍

MiniMax 是什么?

MiniMax Logo
MiniMax——与用户共创智能

MiniMax 成立于 2021 年 12 月,是一家在通用人工智能领域迅速崛起的科技公司,秉持"与用户共创智能"的核心理念。公司自主研发了多模态的通用大模型,覆盖文本、语音、图像、视频、音乐等多个领域,为全球企业和个人开发者提供强大的 AI 技术支持。

MiniMax 的产品线包括:

  • MiniMax 开放平台(platform.minimaxi.com):面向开发者,提供 M3、M2.7、H3、Speech 2.8、Music 3.0 等模型 API

  • 海螺 AI:面向个人用户的生产力工具,接入 MiniMax 自研多模态大模型

  • MiniMax Code:AI 编程助手,支持构建 Agent 团队

  • MiniMax Design:AI 设计创作平台

  • Talkie:AI 角色扮演与陪伴应用

2026 年,MiniMax 发布旗舰模型 M3,以前沿代码/Agent 能力、1M 上下文和原生多模态"一模型通吃",再次定义国产多模态大模型新高度。

MiniMax 核心功能

功能

说明

文本对话

多轮对话、知识问答、深度推理(M3 / M2.7)

代码生成

前沿 Coding / Agentic 能力(M3),支持 Agent 开发

图像理解

原生多模态,图片内容识别与分析

语音合成

超自然、高保真语音(Speech 2.8),音色设计/克隆

视频生成

文生视频、图生视频、导演级运镜(H3)

音乐生成

音乐创作(Music 3.0,已开源)

实时语音对话

低延迟语音交互(海螺 AI)

文件处理

长文档阅读、表格分析、链接提取

MiniMax 模型家族(2026 年 8 月)

最新旗舰:MiniMax M3 新上线

MiniMax M3 是 MiniMax 迄今能力最强的旗舰模型,核心特性:

  • 前沿 Coding / Agentic 能力:软件工程任务表现领先

  • MSA · 1M Context:支持 1M tokens 上下文窗口

  • 原生多模态:文本、图像统一处理

其他模型

模型

类型

上下文

特点

M3

旗舰

1M tokens

前沿 Coding/Agentic、原生多模态

M2.7

通用

长上下文

通用对话、性价比之选

M2.7-highspeed

高速

—

响应更快的高速版本

H3

视频

—

开放通用多模态视频模型,2K/768P 生成

Speech 2.8

语音

—

超自然语音合成,HD/Turbo 两档

Music 3.0

音乐

—

开源音乐模型,生产级

历史模型

  • Text-01 / VL-01:新一代文本与视觉-语言多模态模型

  • abab6.5s:万亿参数 MoE 大语言模型,200k tokens 上下文

  • speech-01 / speech-01-hd:语音大模型,音色克隆,字错率低至万分之五

  • music-01:音乐生成模型

  • I2V-01 / S2V-01 / T2V-01:视频生成模型系列

MiniMax 开放平台定价文档截图
MiniMax 开放平台定价(图片来源:platform.minimaxi.com)

MiniMax API 定价(2026 年 8 月)

MiniMax 开放平台提供按量计费 API,价格为(单位:元/百万 tokens):

语言模型

模型

输入

输出

缓存读取

M3(≤512k 输入,永久五折后)

2.10

8.40

0.42

M3(>512k 输入,永久五折后)

4.20

16.80

0.84

M2.7

2.1

8.4

0.42

M2.7-highspeed

4.2

16.8

0.42

M3 原价:≤512k 输入 4.2 元/输出 16.8 元;>512k 输入 8.4 元/输出 33.6 元。目前永久五折。

语音模型(元/万字符)

模型

单价

speech-2.8-hd(同步/异步)

3.5 元

speech-2.8-turbo(同步/异步)

2 元

音色设计 Voice Design

9.9 元/音色

快速复刻 Voice Cloning

9.9 元/音色

视频模型(H3)

项目

价格

2K 视频生成

0.80 元/秒

768P 视频生成

0.50 元/秒

图片素材

5 张以内免费,超出 0.20 元/张

H3-Context-IR(视频理解)

输入 5.80 / 输出 23.00 元/百万 tokens

MiniMax 的核心优势

  1. 旗舰 M3 一模型通吃:前沿代码/Agent 能力 + 1M 上下文 + 原生多模态

  2. 全模态覆盖:文本、语音、视频、音乐、图像五大模态

  3. 语音技术领先:Speech 2.8 超自然合成,音色设计/克隆快速便捷

  4. 视频能力突出:H3 开放通用多模态视频模型,2K 高清生成

  5. 开源生态:Music 3.0、H3 等模型开源,支持二次开发

  6. 价格亲民:M3 永久五折,语音/视频按量计费透明

MiniMax 的应用场景

  • AI 编程:M3 前沿 Coding 能力,MiniMax Code 构建 Agent 团队

  • 语音交互:客服机器人、有声书、播客、数字人(Speech 2.8)

  • 视频创作:短视频、广告、影视级运镜(H3)

  • 音乐制作:AI 作曲、配乐(Music 3.0)

  • 智能对话:海螺 AI 个人助手、角色扮演(Talkie)

  • 企业服务:智能客服、内容生成、多模态分析

MiniMax 常见问题(FAQ)

Q1:MiniMax 收费吗?

海螺 AI 等 C 端产品对个人用户提供免费体验。开发者调用 API 按量计费,M3 目前永久五折。

Q2:M3 和 M2.7 有什么区别?

M3 是旗舰模型,1M 上下文 + 前沿 Coding/Agentic + 原生多模态;M2.7 是通用模型,性价比高,适合日常对话。

Q3:MiniMax 支持哪些模态?

文本、语音、图像、视频、音乐五大模态全覆盖,M3 支持原生多模态输入输出。

Q4:如何调用 MiniMax API?

通过 MiniMax 开放平台(platform.minimaxi.com)注册,获取 API Key,参考官方文档接入。

Q5:MiniMax 模型开源吗?

部分模型已开源,如 Music 3.0(Hugging Face / ModelScope)、H3 视频模型等。

Q6:MiniMax 语音合成效果如何?

Speech 2.8 支持超自然、高保真的语音合成,提供 HD/Turbo 两档,支持音色设计和快速克隆。

如何开始使用 MiniMax

  1. 海螺 AI:下载海螺 AI App 或访问网页版,免费体验多模态能力

  2. 开发者:通过 MiniMax 开放平台注册,接入 M3 / M2.7 / H3 / Speech 2.8 API

  3. 编程:使用 MiniMax Code 构建 Agent 团队

  4. 设计:使用 MiniMax Design 进行 AI 创作

  5. 开源模型:在 Hugging Face / ModelScope 获取 Music 3.0、H3 等开源模型

结语

从 2021 年成立到 2026 年发布 M3 旗舰,MiniMax 用五年时间构建了覆盖文本、语音、视频、音乐、图像的全模态 AI 生态。凭借 M3 的前沿能力、H3 的视频生成、Speech 2.8 的语音技术和亲民的价格策略,MiniMax 已经成为国产多模态大模型领域不可忽视的力量。无论你是开发者、创作者还是企业用户,MiniMax 都值得一试。