百川大模型和国内哪些大模型齐名?聊聊我眼里的国产第一梯队
上周三晚上快十一点,一个做企业知识库的朋友给我发微信:"百川大模型和国内哪些大模型齐名?老板让我下班前交一份选型报告,我翻了两天榜单,越翻越糊涂。"
这个问题我这两年至少被问过二十次。有意思的是,几乎没人真的只想要字面答案——大家真正想问的是:我到底该用谁。
所以这篇文章我打算讲三件事:百川处在什么位置、它跟谁在同一张牌桌上、以及不同场景下究竟怎么选。
核心结论先给:百川大模型属于国产大模型第一梯队,与通义千问(Qwen)、DeepSeek、智谱GLM基本同处一个竞争层级。从开源社区影响力看,Qwen、DeepSeek、GLM是它最直接的对照物;从C端产品声量看,则是Kimi、豆包、文小言。
百川大模型是什么?先把它自己的谱系理清楚
百川大模型是指百川智能研发的系列大语言模型。这家公司2023年4月由搜狗前CEO王小川创立,据公开报道,2024年7月完成了50亿元人民币A轮融资,投资方包括阿里、腾讯、小米等。当年6月就开源了Baichuan-7B,是国内最早把"开源"当成战略武器的团队之一。
它的模型演进大致是这样:
| 发布时间 | 模型 | 参数规模 | 是否开源 | 当时的定位 | | --- | --- | --- | --- | --- | | 2023.06 | Baichuan-7B | 7B | 开源可商用 | 中文开源模型的开局之作 | | 2023.07 | Baichuan-13B | 13B | 开源可商用 | 补齐长上下文能力 | | 2023.09 | Baichuan 2 | 7B / 13B | 开源

