MiniMax

访问官网

MiniMax是自主研发多模态通用大模型的AI科技公司,推出M3旗舰语言模型(1M上下文)、海螺AI视频生成、MiniMaxCode编程智能体和Audio语音音乐等产品,面向全球开发者和企业客户。

分类: AI开发与模型模型与训练 #大语言模型 #开发平台 #模型训练 #模型与训练 #多模态模型

MiniMax 是什么

MiniMax 是一家成立于 2022 年初的通用人工智能科技公司,以"与所有人共创智能"为使命,致力于多模态通用大模型的自主研发和 AGI 前沿探索。

公司已构建了覆盖文本、视频、语音、音乐等多种模态的模型矩阵,并基于自研模型推出了多款面向终端用户和开发者的产品。根据官网数据,MiniMax 的产品和服务已经覆盖超过 200 个国家和地区,全球个人用户过亿,企业客户和开发者超过 21.4 万。

旗舰模型 MiniMax M3

MiniMax M3 是公司最新推出的旗舰语言模型,有三个核心技术亮点:

第一,MSA 稀疏注意力架构。与传统的 GQA(分组查询注意力)或 MHA(多头注意力)不同,M3 采用了自研的 MiniMax Sparse Attention 机制,在长序列处理时能更高效地利用计算资源,使得模型可以实际支持高达 1M token 的超长上下文。

第二,原生多模态能力。M3 从训练的第一阶段(Step 0)就采用混合训练策略,在超过 100T 的 interleaved(图文交错)数据上进行训练,使得模型天然具备理解文本和图像的能力,不需要后期拼接视觉模块。

第三,编程与智能体优化。M3 在代码生成和 Agent 任务方面做了针对性强化,官方定位为"前沿 Coding/Agentic 模型"。

产品矩阵

MiniMax 围绕自研模型构建了完整的产品生态:

MiniMax Code:面向开发者的编程智能体,支持桌面版下载。它可以自主根据任务复杂度召集 Agent 小队协作解决问题,能够记住用户的偏好和工作习惯并沉淀为专属技能。用户只需在对话框中下达指令,即可完成代码编写、技能创建、定时任务等操作。

海螺 AI(Hailuo):视频生成产品,已迭代至 2.3 版本,用户可以通过文字描述或图片输入生成视频内容。

MiniMax Audio:涵盖语音合成(Speech 2.8)和音乐生成(Music 2.6)两大能力,面向内容创作、音频制作等场景。

开放平台:为企业和开发者提供 API 接入服务,支持 Token Plan 订阅模式,月费从 ¥119 起,宣称在同等容量下价格具有竞争力。

开发者接入建议

对于开发者而言,MiniMax 开放平台提供了较完整的接入文档和 Token Plan 订阅方案。建议根据实际使用场景选择模型:如果主要需求是长文档处理或多轮 Agent 交互,M3 模型的 1M 上下文是一个值得关注的特性;如果需要视频生成能力,可以关注海螺 AI 的 API;语音和音乐方面则有 Speech 和 Music 系列模型可选。

需要注意,各模型的 API 调用价格和速率限制有所不同,建议在接入前详细阅读官方文档中的定价和限额说明。

继续探索 AI 工具

从同类、热门或新收录工具里快速找下一站。

返回工具列表