中国 AI 初创公司 MiniMax 正在开发一个拥有 2.7 万亿参数的大语言模型,并计划于今年晚些时候开源。

发生了什么

据 The Decoder 报道,中国 AI 初创公司 MiniMax 正在开发一个参数规模达 2.7 万亿的大语言模型,并计划在今年晚些时候将其开源。MiniMax 此前已推出多个 AI 产品,包括聊天机器人、语音合成和视频生成工具,但其模型参数规模从未公开达到如此量级。

为什么重要

2.7 万亿参数将使该模型成为目前已知最大的开源模型之一。作为对比,Meta 的 Llama 3 最大版本为 4050 亿参数,而 GPT-4 的参数规模据估计在 1.7 万亿左右(未官方确认)。如果 MiniMax 成功开源该模型,将大幅提升开源社区可用的模型能力上限。

MiniMax 选择开源而非闭源,可能出于多种考虑:吸引全球开发者生态、加速技术迭代、以及应对中美 AI 竞争中的技术封锁风险。开源策略也有助于降低用户对数据隐私的担忧,尤其在企业级应用中。

影响与看点

对于开发者而言,一个 2.7 万亿参数的开源模型意味着更强的推理能力,但同时也对部署硬件提出了极高要求。当前消费级 GPU 难以运行如此规模的模型,可能需要依赖云端 API 或分布式推理方案。

从行业格局看,MiniMax 此举可能加剧开源与闭源模型的竞争。如果开源模型在性能上接近甚至超越闭源模型,将推动更多企业采用开源方案,改变 AI 商业化的路径。

值得关注的是,MiniMax 能否如期兑现开源承诺,以及模型的实际性能是否与参数规模匹配。参数数量并非唯一指标,训练数据质量、架构设计和优化同样关键。此外,开源许可证的选择将影响商业使用和衍生作品的发布方式。

总体而言,MiniMax 的 2.7 万亿参数开源计划是 AI 领域的一个重要信号,预示着开源大模型正迈向新的量级。