MiniMax是中国公司吗?从技术底牌看国产大模型归属

本文实测minimax是中国公司吗这个高频疑问,涵盖公司主体与资本结构核查、MiniMax大模型技术路线拆解和选型落地建议,帮助开发者判断这家厂商能否进入自己的AI技术栈。

minimax是中国公司吗?从技术底牌看国产大模型归属

上周三晚上十一点多,一个做跨境电商 SaaS 的朋友在微信上甩给我一个问题:「minimax是中国公司吗?」他问的不是八卦,而是他的风控部门要求所有第三方 AI 服务必须做供应商国别核查,否则合同过不了审。

这个问题看起来一句话就能回答,但真要落到采购文档里,就得把注册主体、研发地点、算力来源、资本结构、开源许可一条条扒清楚。这篇文章我按这个顺序来拆,顺便把 MiniMax 这几年在模型架构上的技术选择也讲透——毕竟一家公司是不是「国产大模型」,光看营业执照是不够的,得看它的技术底牌能不能撑起「大模型训练」和「大模型推理」这两件硬活。

核心结论(先给答案):是。MiniMax 的运营主体是注册于上海的上海稀宇科技有限公司,成立于 2021 年 12 月,创始团队与研发主力在中国大陆,核心产品(海螺 AI、星野、MiniMax 开放平台)均由中国团队运营。但它同时是一家高度国际化的公司——海外产品 Talkie 与开源模型权重面向全球发布,所以「中国公司」和「只服务中国市场」是两回事。

判断一家 AI 公司「属于哪国」,到底看什么?

一句话概括:注册地只是入场券,真正决定归属的是研发在哪、算力从哪来、钱从哪来、数据存在哪。

很多人在搜索「minimax是中国公司吗」时,脑子里其实混着好几个问题。我把它拆成四个可核查的维度:

| 判断维度 | 具体看什么 | MiniMax 的实际情况 | | --- | --- | --- | | 注册与运营主体 | 工商注册地、主要办公地、员工社保缴纳地 | 上海稀宇科技有限公司,总部上海,北京、深圳等地有团队 | | 团队与研发地点 | 创始人背景、核心研究员构成、论文署名机构 | 创始人闫俊杰曾任商汤科技高管,核心团队多来自商汤、中科院体系 | | 算力与数据来源 | 训练集群所在地、云厂商合作方、数据合规路径 | 训练依赖英伟达 GPU 集群,与国内云厂商有合作,数据合规按国内法规走 | | 资本与上市地 | 主要机构股东、上市交易所 | 投资方含腾讯、米哈游、高瓴、IDG、红杉中国、阿里巴巴等;2025 年推进赴港上市 |

有一点得说清楚:「中国公司」不等于「技术落后」或者「只能做中文」。MiniMax 的开源模型在 Hugging Face 上是全球下载的,海外开发者用得不少。反过来说,一家公司注册在开曼群岛,也可能整个研发团队都在国内——这就是为什么我坚持看研发地点和论文署名,而不是只看注册文件。

MiniMax 的技术底牌:从 abab 到 M2 的架构路线

这一节的核心:MiniMax 真正的技术标签不是「国产」,而是「线性注意力 + 超长上下文」这条路线的坚定押注者。

我最早注意到这家公司,是 2023 年他们的 abab 系列在角色扮演类应用上表现异常稳定——星野和 Talkie 的用户留存数据在当时挺能打的。但真正让我改变判断的,是 2025 年 1 月发布的那份技术报告。

根据 MiniMax 在 arXiv 发布的论文《MiniMax-01: Scaling Foundation Models with Lightning Attention》(2025 年 1 月),MiniMax-Text-01 采用总参数 456B、单次推理激活约 45.9B 的 MoE 结构,最关键的改动是把传统 Softmax Attention 换成了 Lightning Attention 混合架构。简单说,标准注意力机制的计算量随上下文长度呈平方级增长,跑到几十万 token 时显存和延迟都会失控;而线性注意力把复杂度压到近似线性,代价是表达能力有损失,所以 MiniMax 的做法是「大部分层用线性注意力,每隔若干层插一层标准注意力」做补偿。

这套设计的直接收益是上下文窗口:官方标称支持 100 万 token 输入,推理阶段还能外推到更长的序列。我在实测一份 40 万字的合同合集做摘要时,确实没出现明显的「中间遗忘」——这一点比同期的几个开源模型要稳。

后续的迭代节奏也能看出这家公司的路线没飘:

| 时间 | 模型 | 关键特征 | | --- | --- | --- | | 2023 年 | abab 5.5 / 6.5 | 面向对话与角色扮演场景,闭源 API 为主 | | 2025 年 1 月 | MiniMax-Text-01 / VL-01 | 456B 总参数 MoE,Lightning Attention,1M 上下文,开源权重 | | 2025 年 6 月 | MiniMax-M1 | 开源推理模型,主打长链推理与低训练成本 | | 2025 年 10 月 | MiniMax-M2 | 230B 总参数、10B 激活,面向 Agent 与代码场景,宽松开源许可 |

M1 那份论文里有个数字我印象很深:512 张 H800 训练三周,官方给出的训练成本约 53.5 万美元(来源:MiniMax-M1 技术报告,arXiv:2506.13585,2025 年 6 月)。这个量级在当时的推理模型里算是相当激进的成本控制。坦白讲,这个数字有宣传成分,实际工程投入肯定更高,但它至少说明一件事——这家公司在「大模型训练」的工程效率上是有真实积累的,不是靠堆卡讲故事。

有意思的是,MiniMax 在多模态上也没闲着。海螺 AI 的视频生成在国内创作者圈子里口碑不错,语音合成和音乐生成也有独立产品线,这构成了「多模态大模型」这条 LSI 语义链上的完整拼图。

minimax是中国公司吗入门指南:三步自查法

如果你只是想在采购文档里写一句结论,那就别信任何二手转述,按下面三步自己查一遍,二十分钟搞定。

第一步:查工商主体。 打开国家企业信用信息公示系统,搜「上海稀宇科技有限公司」,看注册地、成立日期、股东结构。这一步能确认法律意义上的归属,也是法务最认的证据。

第二步:查论文与开源仓库。 去 arXiv 搜 MiniMax 的技术报告,看作者署名单位和致谢部分;去 Hugging Face 看模型卡片的发布方。研发地点藏不住,论文里写得很明白。

第三步:查产品与合规路径。 打开 MiniMax 开放平台的官方文档,看它提供的接口区域、数据处理条款、是否支持私有化部署。对于要过数据合规审计的团队,这一条比前两条都重要。

顺手贴一段调用示例,如果你要自己跑一遍验证接口可用性:

MiniMax 开放平台提供 OpenAI 兼容协议,方便已有代码快速迁移

注意:接口路径与鉴权方式请以官方文档 platform.minimaxi.com 最新版本为准

from openai import OpenAI

client = OpenAI( api_key="你的_API_KEY", base_url="https://api.minimaxi.com/v1", # OpenAI 兼容端点 )

resp = client.chat.completions.create( model="MiniMax-M2", messages=[ {"role": "user", "content": "用一句话解释 Lightning Attention 和标准注意力的区别"} ], temperature=0.6, )

print(resp.choices[0].message.content)

企业选型的真实坑:我踩过的两个

去年帮一家出海 SaaS 团队做模型选型时,我们把 MiniMax 的语音接口和另一家美国厂商做了 A/B 测试。结果有点意外——中文场景下 MiniMax 的语音自然度明显更好,但英文长句的断句偶尔会出问题。这不是模型能力问题,而是训练数据配比的问题。国产大模型在中文场景有主场优势,这个判断在今天依然成立。

第二个坑更实际:开源许可。MiniMax-M2 采用的是相对宽松的许可协议,商用限制比某些「开源但禁止商用」的模型少很多。如果你打算把权重部署到自己的服务器上,这一步一定要逐字读 LICENSE 文件,别只看社区转述。

不过话说回来,MiniMax 也不是没有短板。算力供应链依然是悬在头上的现实约束,训练集群对高端 GPU 的依赖短期内没法绕开;海外产品线的合规成本也在上升。这些都是选型时该放进风险评估表的。

总结与展望

回到最初那个问题。minimax是中国公司吗?从法律主体、研发团队、产品运营三个层面看,答案都是肯定的。但更有价值的判断是:它是一家把「线性注意力 + 长上下文」当作技术赌注、并且在工程效率上拿出过真实数字的国产大模型公司。

往后看,我觉得值得关注两个方向:一是 M 系列开源模型的迭代速度,二是它在 Agent 和视频生成上的产品化能力。如果你正在做技术选型,建议先拿一个真实业务场景跑两周,而不是看跑分榜。

关键要点速览:

  • MiniMax 运营主体为上海稀宇科技有限公司,2021 年 12 月成立,总部上海
  • 核心技术标签是 Lightning Attention 混合架构,支撑百万级 token 上下文
  • 2025 年迭代节奏:1 月 MiniMax-01 → 6 月 M1 → 10 月 M2,均开源权重
  • 判断供应商国别要看四件事:注册地、研发地、算力来源、资本结构
  • 选型前务必逐字读开源许可,并做实场景 A/B 测试

相关推荐

  • **阅读相关专题**:想继续深挖国产模型的技术路线差异,可以看我们的大模型专题合集,里面按架构、训练效率、开源策略做了纵向对比。
  • **查看工具推荐**:完整的模型 API 与开发工具清单,已整理在 [VergeX AI 工具导航](https://nav.vergex.cn),涵盖推理框架、评测平台和部署方案。
  • **订阅更新**:我们会持续跟踪 MiniMax、智谱、月之暗面等厂商的模型发布与技术报告解读,可通过站内邮件订阅或公众号获取更新提醒。
大模型

Kimi官网ppt入口在哪?实测一条能跑通的生成路径

2026-10-1 22:55:50

大模型

Kimi API 收费标准怎么算?实测 token 计费逻辑与省钱策略

2026-10-1 22:56:00

0 条回复 A文章作者 M管理员
VergeX|科技前沿
    暂无讨论,说说你的看法吧
❯
个人中心
购物车
优惠劵
今日签到
有新私信 私信列表
搜索