8月6日,字节跳动CEO梁汝波在公司全员会上承认,Seed大语言模型与海外领先模型的差距正在扩大,要求团队接受一段时间的落后,坚持自研和长期优化。同日,《晚点LatePost》披露,字节正在讨论训练一个参数规模超过5万亿的大模型。
该计划由Seed Foundation负责人项亮主导,与大语言模型预训练数据负责人沈科合作。张一鸣在更早的内部会议上明确反对蒸馏竞争对手模型。报道称,计划仍处早期讨论阶段,最终未必发布。
推动这项计划的直接原因是Seed上半年表现未达内部预期。2月中旬发布的Seed 2.0市场反响有限,而GLM-5、Kimi K3等国内模型在编程、工具调用和复杂任务上取得进展。
