据彭博社10月8日报道,前字节跳动实习生田柯宇已创办一家专注于世界模型方向的AI公司。该公司尚未公开亮相,既无正式名称也无产品发布,但已从五源资本、IDG资本等机构获得近3000万美元融资,投后估值达到2亿美元。五源资本此前曾投资月之暗面。
田柯宇的研究方向为世界模型。这一技术路线旨在让AI学习并模拟现实世界的物理规律与运行机制,可应用于机器人、交互式视频和自动驾驶等领域。目前,李飞飞、杨立昆等知名AI学者均在推动该方向的研究。李飞飞创办的World Labs上月被AMD以数十亿美元收购,AMD CEO苏姿丰称这笔交易的核心目的是“获得世界一流人才”。
田柯宇曾在字节跳动实习三年,2024年被辞退。字节跳动当时发布声明称,公司因“严重违规”辞退一名前实习生,但未披露具体细节,仅表示社交媒体上有关田柯宇破坏基础模型训练的传言具有误导性。田柯宇在接受采访时承认自身做法有误,称当时关闭了另一名实习生运行的程序,希望腾出算力供其他研究人员使用,相当于越过正常程序自行解决问题。字节跳动随后提起民事诉讼,法院认定田柯宇违约,判令其支付50万元赔偿,并失去全部工资收入。田柯宇对此表示,如果能带着今天的认识回到当时,会采用更明智的方式处理。字节跳动发言人未回应有关辞退一事的置评请求。
学术方面,田柯宇曾以第一作者身份发表一篇NeurIPS 2024最佳论文,提出一种更高效的图像生成方法,使模型能够像大语言模型预测后续内容一样,通过预测下一组像素块逐步生成图像。田柯宇计划将获奖论文中的技术应用于创业,为AI设计一套专门处理视觉内容的符号语言。他认为,视频所包含的信息很难通过人类语言高效表达。
目前该公司团队规模为10人,其中包括其他字节跳动前员工。田柯宇称,团队已开发出一套类似AI“词典”的系统,包含20万个普通人无法识读的符号,用于帮助模型处理视频。按照他的说法,这套方法可以将生成1秒视频的成本至少降至原来的十分之一。他计划在2027年正式发布完整模型前,通过现场活动展示技术能力。现阶段团队的首要任务是完成技术开发,暂不将精力投入消费级产品或商业模式探索。
该公司在无名称、无产品阶段即获得大额融资,反映出当前AI投资的一种趋势:资本正越来越早地寻找并押注具有潜力的研发人才。世界模型作为AI领域的前沿方向,已吸引多家机构与知名学者布局,但技术路径和商业化前景仍处于早期探索阶段。
该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。