据报字节跳动正开发参数规模或达10万亿的AI模型

据报字节跳动正开发参数规模或达10万亿的AI模型

该项目仍处于早期阶段,规模将约为月之暗面Kimi K3的3倍,并延续字节跳动在接受大语言模型短期落后的同时推进独立研发的策略。

事实核查
Benzinga的报道(援引英国《金融时报》)以及WTVB和The Standard转载的路透社来源报道,都印证了这一核心说法:据报道,字节跳动正在训练一款参数规模最高可达10万亿的AI模型,约为Moonshot的Kimi K3(2.8万亿)的3倍,目前处于早期预训练阶段(3至6个月),最终规模和发布时间均未敲定。这与该说法中关于一个处于早期阶段、规模约为Kimi K3 3倍项目的表述,以及其独立开发的定性相符。所有报道都可追溯至《金融时报》的同一篇原始报道;根据这些来源,将该说法准确表述为“据报道”或“处于早期阶段”,而非已确认产品,是符合事实的。
    参考链接123
摘要

据报,字节跳动正在对一款参数规模或达10万亿的AI模型进行预训练。按这一规模计算,该模型将约为月之暗面Kimi K3的3倍;Kimi K3是中国已发布的最大AI模型。该模型还有望与Anthropic最先进的Mythos系统相媲美。该项目仍处于早期阶段,而预训练通常会持续3至6个月,之后字节跳动才会决定模型的最终规模、是否进行微调以及是否发布。 这一举措进一步印证了字节跳动所宣示的独立研发偏好:创始人张一鸣曾敦促AI团队打造世界一流模型,而非着眼于短期竞争;CEO梁汝波也曾表示,公司核心大语言模型与海外顶尖竞争对手之间的差距正在进一步拉大。 不过,字节跳动在应用层面仍已建立强势地位:豆包以3.24亿月活跃用户领跑中国消费级AI市场;SeeDance被视为全球最先进的视频生成模型之一;豆包、飞书与火山引擎之间更紧密的协同,也在推动企业销售。

术语与概念
  • 参数: AI模型中的内部数值权重,会在训练过程中调整,并有助于决定模型能够表征的信息量。
  • 预训练: 模型训练的初始阶段,模型在此阶段先从大型数据集中学习广泛模式,随后再针对特定任务进行调优。
  • 大语言模型: Large language model,一种在海量文本上训练、用于理解和生成语言的AI系统。