群发资讯网

昨晚看到一条关于字节的深度报道,信息量太大了。字节跳动正在讨论训练一个参数规模超

昨晚看到一条关于字节的深度报道,信息量太大了。

字节跳动正在讨论训练一个参数规模超过5万亿的模型。这个数字什么概念?目前国内最大的Kimi K3是2.8万亿,阿里的Qwen3.8-Max是2.4万亿。字节直接翻倍。

但比参数更值得关注的是张一鸣的态度。

他在Seed全员会上说了几个关键的话:

第一,"团队可以暂时落后,但目标是把模型能力推进到世界第一梯队"。第二,明确反对模型蒸馏。他认为蒸馏"本质上是在复制Claude已有的能力,最多只能逼近,很难超越"。第三,字节内部已经禁止蒸馏开源模型,甚至通过API检测来追溯排查疑似蒸馏行为。

CEO梁汝波在全员会上的态度更直接:"接受短期落后,坚持自研和优化长期。"

翻译一下就是:宁可慢,也不抄捷径。

说实话这个态度在当下的大模型行业挺罕见的。别的公司都在疯狂蒸馏、追排名、刷榜,字节选择了一条最难走的路。

而且字节不是没能力走捷径——它有国内最充足的算力储备、最多的卡、最多的人才。它是不愿意走。

但5万亿参数模型也不是闹着玩的,涉及完全不同量级的系统工程和数据处理。接近Seed的人说:"像一场赌博。"

字节从来不缺"大力出奇迹"的勇气。当年抖音就是这样出来的。

就看这次赌不赌得赢了。