前字节实习生田柯宇转向世界模型创业:未发布产品已融资近3000万美元
据 IT之家援引彭博社 10 月 8 日报道,前字节跳动实习生田柯宇正在推进一家面向世界模型方向的 AI 创业公司。来源显示,这家公司目前尚未公开名称和产品,但已获得五源资本、IDG 资本等机构支持,融资规模接近 3000 万美元,投后估值约 2 亿美元。对于中文 AI 行业而言,这一事件的看点不只在于融资金额,更在于资本正在把赌注提前押向具备研究能力的年轻技术团队。
世界模型成为新一轮 AI 竞争焦点
世界模型通常被理解为让 AI 学会理解、预测和模拟现实世界运行机制的一类技术路线。它并不只关注文本生成,而是试图让模型掌握视觉、空间、物理变化等更复杂的信息结构,潜在应用包括机器人、交互式视频、自动驾驶和新一代内容生成工具。
报道提到,李飞飞、杨立昆等 AI 学者都在推动这一方向。李飞飞创办的 World Labs 此前被 AMD 以数十亿美元收购,AMD 管理层也曾将交易重点指向人才获取。这意味着,世界模型已经从学术概念逐步走向产业资本和大厂战略布局的核心区域。
田柯宇过去一年也将研究重点放在这一方向。他曾以第一作者身份发表 NeurIPS 2024 最佳论文,论文提出一种更高效的图像生成方法:让模型像语言模型预测后续内容一样,通过预测下一组像素块逐步生成图像。按照报道中的说法,他希望把相关研究进一步用于创业,探索面向视觉内容处理的 AI 专用符号系统。
未命名公司为何能获得高估值
这家公司目前仍处于早期阶段,既没有正式名称,也没有对外发布产品。来源显示,团队规模约 10 人,其中包括其他字节跳动前员工。田柯宇称,团队已经构建了一套类似 AI“词典”的系统,包含约 20 万个普通人无法识读的符号,用于帮助模型处理视频信息。
从技术逻辑看,这一路线试图绕开人类自然语言在描述视频时的低效率问题。视频中包含大量连续变化、动作关系和空间细节,很难仅靠文字完整表达。若能为模型建立更适合视觉世界的内部表达方式,理论上可能提升视频理解与生成效率。
- 融资阶段更早:公司尚未公开产品,资本已进入,显示投资人正在前置押注研发人才。
- 方向更偏基础模型:团队暂时不把重点放在消费级应用或商业模式,而是优先验证底层技术。
- 应用想象空间大:若世界模型能力成熟,可能影响视频生成、机器人训练、仿真环境和自动驾驶等场景。
- 人才竞争加剧:World Labs 等案例表明,顶尖研究者和小团队正成为大厂与风投关注对象。
据报道,田柯宇计划在 2027 年正式发布完整模型之前,通过现场活动展示技术能力。他还认为,相关方法有望显著降低视频生成成本。不过,这类成本下降的实际幅度仍需要等待公开演示和第三方验证。
争议经历与创业前景并存
田柯宇的履历也伴随争议。来源显示,他曾在字节跳动实习三年,并于 2024 年被辞退。字节跳动当时曾发布声明称,因“严重违规”辞退一名前实习生,同时表示网络上有关其破坏基础模型训练的传言存在误导性。
报道还提到,田柯宇在采访中承认当时处理方式有错:他曾关闭另一名实习生运行的程序,希望释放算力给其他研究人员使用,但这相当于绕过正常流程自行解决问题。随后字节跳动提起民事诉讼,法院认定其违约,并判令其支付 50 万元,同时失去全部工资收入。字节跳动方面未就相关置评请求作出回应。
对 AI 创业生态而言,这一案例具有复杂性。一方面,田柯宇的学术成果和融资进展说明,前沿模型创业仍高度依赖少数核心研发人才;另一方面,算力资源、团队协作和研发规范也正在成为 AI 公司治理的重要议题。尤其在基础模型训练成本高、实验流程复杂的背景下,技术能力之外的组织纪律同样会影响团队长期发展。
影响解读:AI 投资正在从产品押注转向人才押注
这起融资事件反映出一个更大的产业变化:AI 投资的评估对象正在从“已有产品与收入”前移到“研究方向与人才密度”。在大模型红利扩散后,单纯做应用包装的空间正在收窄,而能够提出新架构、新表示方法或新训练范式的团队,更容易获得早期资本关注。
不过,世界模型仍处于早期竞争阶段。它距离稳定落地到机器人、自动驾驶或高质量交互视频,还需要跨越数据、算力、评测、安全和商业化等多重门槛。田柯宇团队能否把论文思路转化为可扩展模型,将是决定其估值能否兑现的关键。
对于中文科技读者来说,这家公司值得关注的原因并不是“挑战某位 AI 名人”本身,而是它展示了 AI 基础研究创业的新范式:先争夺技术路线,再寻找产品形态。如果这一路线跑通,未来的视频生成工具、仿真训练平台和具身智能系统,可能都会受其影响。