字节跳动正在训练一个参数规模高达十万亿的AI模型,这可能是中国迄今最大的AI模型。

发生了什么

据英国《金融时报》报道,字节跳动正在训练一个参数高达十万亿的AI模型。这一规模是当前中国最大模型——月之暗面(Moonshot)的Kimi K3的三倍。Kimi K3的参数规模约为3万亿,而字节跳动的这一新模型将大幅超越这一数字。

目前,该模型仍处于训练阶段,具体发布时间和产品形态尚未公布。字节跳动此前已推出自研的豆包大模型,并广泛应用于其旗下产品,如抖音、今日头条等。

为什么重要

这一消息背后,折射出中国AI大模型竞赛的激烈程度。当前,中国头部AI公司如百度、阿里、腾讯、字节跳动等都在积极投入大模型研发,参数规模成为衡量技术实力的重要指标之一。

字节跳动此次押注十万亿参数,意味着其技术路线选择上更倾向于“大力出奇迹”,即通过扩大模型规模来提升智能水平。这与一些公司转向高效小模型(如Moonshot的Kimi)的路线形成对比。

此外,字节跳动拥有庞大的用户基础和丰富的应用场景,其大模型的落地能力不容小觑。若该模型成功,可能进一步巩固其在AI领域的竞争力,并对现有市场格局产生冲击。

影响与看点

对于行业而言,这一消息将加剧大模型军备竞赛,推动其他公司跟进或调整策略。对于开发者来说,未来可能有机会通过API使用这一超大模型,但成本和技术门槛也是需要考虑的因素。

值得关注的是,如此大规模的模型训练需要巨大的算力资源,字节跳动在GPU采购和数据中心建设上的投入将十分可观。此外,模型训练的效率、数据质量以及最终性能表现,都是决定其成败的关键。

一个独立的判断是:参数规模并非智能的全部,但字节跳动的这一举动表明,中国AI公司仍将规模视为重要突破口,而这也将推动整个行业在算力、算法和数据上的进一步创新。