两件事同时在推,都是张一鸣自己督导。
第一件是空间视频模型。字节跳动正在准备一款面向实时空间视频生成的AI模型,最快10月发布,基于 Seedance。它能生成响应 Pico 头显用户语音或动作的互动虚拟世界,指标是约0.05秒延迟、每秒20帧,高强度计算放云端,目的是把VR设备的硬件门槛压下去。
0.05秒这个数字是关键。人对画面延迟的容忍阈值大概就在这一带,超过了就晕。把生成式视频塞进实时交互,卡的从来不是画质是延迟。
应用方向说的是直播、短剧和游戏,对手点名了 Meta 和谷歌。
第二件更靠底层。字节正在讨论训练一个参数规模超5万亿的大模型,Seed Foundation 负责人项亮主导,和大语言模型预训练数据负责人沈科合作。目前还在早期阶段。真做出来的话会超过阿里 Qwen 3.8-Max 和月之暗面 Kimi K3,成为国内已知参数规模最大的模型。
比参数更值得看的是两周前 Seed 全员会上的表态。张一鸣明确反对蒸馏路线,理由是那只是复制别家已有的能力,难以实现超越。他鼓励团队以追求智能上限为目标,接受短期落后,做出有特色的模型。他还认可编程是当下的关键方向。
“接受短期落后”这句在国内大模型圈里不常听到。过去两年主流做法恰恰相反——先追平榜单,再谈别的。
© 版权声明
文章版权归作者所有,未经允许请勿转载。






张一鸣亲自盯两条线:实时空间视频模型,和一个5万亿参数的大模型