利好
字节跳动启动 10 万亿参数大模型预训练
08-07
Woofun AI 获悉,字节跳动已启动最高 10 万亿参数大模型的预训练工作,该项目目前处于早期阶段,最终规模尚未确定。若按上限执行,该模型参数量将是 的三倍以上,成为已知中国团队中规模最大的模型,并在参数量级上接近 Anthropic 的 (行业估算约 8 万亿参数)。
目前模型正处于利用海量数据训练基础能力的预训练阶段,该过程通常耗时 3 至 6 个月,随后还需进行后训练方可发布。字节跳动创始人近期在 内部明确反对蒸馏竞争对手模型,要求团队接受短期落后,依靠自研技术冲击世界第一梯队,此次大规模参数投入被视为字节最激进的自研下注。
WOOFUN AI
影响力评估 · 一键速读
字节跳动以 10 万亿参数规模正面硬刚美国顶尖闭源模型,标志着国内大厂从‘跟随优化’转向‘规模竞赛’的战略升级。此举虽能提升算力壁垒,但预训练与后训练的漫长周期意味着短期内难以直接转化为产品竞争力。若架构与数据质量未能匹配规模增长,单纯堆叠参数可能面临边际效应递减的风险。
WOOFUN AI 生成 · 仅供参考,非投资建议

评论
暂无评论