据彭博社9月7日报道,字节跳动正开发一款用于实时生成空间视频的AI模型,创始人张一鸣亲自监督该项目。报道援引匿名知情人士消息称,张一鸣近期一直在协调公司各业务部门的协作,并调动AI资源及算力全力推进该项目。
其中一位知情人士指出,该模型最早可能于下月推出,但具体时间尚未最终确定,计划仍存变数。
据介绍,该模型将基于字节跳动现有视频生成系统Seedance构建,支持用户创建用于直播、短剧及游戏的交互式虚拟世界。技术层面,模型可实现约每秒20帧的视频按需生成,端到端延迟控制在0.05秒左右,视频渲染在云端完成而非本地设备。
知情人士称,张一鸣将空间视频模型定位为驱动整个生态的「飞轮(Flywheel)」——该模型能够将用户置于高度沉浸的三维虚拟环境中,功能与谷歌的 Genie 类似。字节跳动得以将其自研 AI 模型、云计算底层资源,与旗下的内容平台以及 XR 业务分支 Pico 的硬件终端深度串联、协同发力。
报道指出,字节跳动发言人未对彭博社的置评请求作出回应。目前,字节跳动官方尚未就上述信息发布任何公开声明。
若该模型成功落地,对字节跳动而言,这将成为其从“内容推荐引擎”向“实时交互内容生成平台”转型的关键支点。当前抖音、TikTok的直播和短视频生态已趋于成熟,实时空间视频模型有望大幅降低3D虚拟内容的生产门槛,使普通主播也能一键生成虚拟直播间或互动短剧场景,从而开辟新的付费场景和用户时长增长点,强化其在国内外的竞争壁垒。
对行业而言,该模型若以20 FPS、0.05秒延迟的性能实现规模化商用,将把视频生成从“离线渲染工具”推向“实时交互基础设施”的层级。这或将对现有的3D渲染引擎(如Unity、Unreal)及云游戏服务商形成分流压力,同时推动算力需求从训练侧向推理侧显著倾斜。更深远地,它可能重新定义“视频”的边界——视频不再是被观看的固定内容,而是可实时响应、可进入的交互空间,从而催生新的内容形态和商业模式。
2026年10月29-30日,诚邀您相聚江西南昌。让思想先于趋势,用实践回应未来,在每一次能力涌现中寻找机遇,在每一次时代争流中定义未来。
责任编辑:凌美
24小时热文
流 • 视界
专栏文章更多
- [常话短说] 【曝】给广电:一封用户手写信! 2026-09-08
- [常话短说] 【解局】广电搞光伏? 2026-09-07
- [常话短说] 【快讯】广东广电网络斩获一等奖! 2026-09-07
- [常话短说] 【重磅】广电总局发文,有线/IPTV管理终于一视同仁! 2026-09-04
- [常话短说] 【利好】又一个有线电视免费看?! 2026-09-03


