新浪财经

被字节开除的田柯宇创业冲上热搜,项目投后估值2亿美元

界面新闻

关注

界面新闻记者 | 宋佳楠

近日有媒体报道称,曾被字节跳动开除的田柯宇创办了自己的人工智能实验室,完成近3000万美元融资,投资方包含五源资本与IDG资本,项目投后估值达到2亿美元。该消息今日冲上微博热搜。

目前其实验室尚未对外公布名称,也没有推出成型产品,主攻方向是世界模型。团队的目标,是训练AI理解现实世界的物理规则,预判物体运动、环境随动作发生的变化,技术落地场景覆盖机器人、自动驾驶、交互式视频等方向。

不同于主流大模型依靠文字描述世界,田柯宇团队选择搭建一套拥有20万个符号的专属“视觉词典”。这些符号人类无法直接解读,可供AI完成视频信息压缩、表征与未来画面预测。

按照田柯宇的规划,团队计划向模型输入约1亿小时视频数据,借助这套视觉符号体系,让AI自主学习现实世界物理规律。他对外介绍,这套技术路径,有望把生成1秒视频的成本降低至少一个数量级,完整模型预计在2027年对外发布。现阶段团队重心集中在基础模型研发,消费级产品和商业化方案暂未列入推进日程。

实验室团队规模约10人,成员中包含多名曾在字节跳动任职的技术人员。在AI基础模型赛道,十人的小规模团队,很难承担完整的算力基建、数据治理、大规模模型训练工程。资本的投入,更多是押注田柯宇本人的技术积累。

回看田柯宇的个人履历,伴随着巨大的行业争议。他本科毕业于北京航空航天大学软件学院,师从王立威教授,研究方向为深度学习的优化与算法,后在北京大学攻读博士学位。就读北大期间,他进入字节跳动担任实习生。

但在2024年10月,多个微信群流传着一则消息,称某头部大厂的大模型训练被实习生入侵,注入了破坏性代码,导致其训练成果不可靠,可能需要重新训练。据称遭到入侵的代码注入了8000多张卡,带来的损失可能超过千万美元。

当时界面新闻曾从知情人士处获悉,该头部大厂为字节跳动。事情发生在2024年6月,起因是田柯宇因对团队资源分配不满,使用攻击代码破坏团队的模型训练任务。该事件在行业内被称作“模型投毒”。

字节跳动随后向法院提起民事诉讼,最初索赔800万元。字节官方当时对外澄清,网传事件波及8000张GPU卡、造成上千万美元损失的说法严重夸大,受影响项目仅为商业化技术团队内部研究任务,并未影响字节线上业务和主力大模型项目。

据中新经纬报道,字节起诉前实习生田柯宇篡改代码攻击公司内部模型训练一案,已获北京市海淀区人民法院正式受理。字节跳动请求法院,判令田柯宇赔偿公司侵权损失800万元及合理支出2万元,并公开赔礼道歉。有其他媒体报道显示,法院最终判决田柯宇赔偿50万元,同时没收其全部实习薪资。

值得注意的是,被字节辞退后,田柯宇作为第一作者完成的论文《Visual Autoregressive Modeling》,曾拿下NeurIPS 2024最佳论文,也就是业内熟知的VAR图像生成方案。论文提出让模型按照图像的不同尺度逐层生成,而不是像传统模型一样逐个像素或逐个视觉Token处理。这种方法能够提高图像生成的速度和效率。NeurIPS官方曾对外说明,论文评审采用盲审机制,评奖仅以科学质量作为评判标准,不受作者个人争议事件影响。

谈及当年在字节的违纪事件,田柯宇承认自身行为存在严重问题。他形容当年举动属于一种“以暴制暴”,彼时他认为自己项目价值更高,于是采取干扰他人训练任务的方式抢夺GPU算力资源。

“如果我能带着今天所知道的一切回到过去,我肯定会采取更明智的做法。”田柯宇在接受媒体采访时这样表述。他同时强调,“对于(创业实验室)‘世界模型’这个标签,我们并不急于命名或更名。我们秉持简单的原则,即构建基础模型,扩大规模,让结果说话。”

上述事件也撕开AI行业人才评价体系里的固有矛盾。这一领域长期渴求具备顶尖原创能力的研究者,而算力资源紧张的环境下,算力争夺、项目优先级冲突,本身就是实验室常态。田柯宇涉及争议的核心,主要在于他绕过公司制度,用技术手段破坏同事工作,触碰科研协作与企业安全底线。

对于田柯宇创业获融资,社交平台上看法不一。有观点认为,顶尖科研人才难免个性强烈,犯错之后付出法律代价,就应当拥有重新创业的机会,技术成果才是最终评判标尺。另一部分从业者则坚持,科研协作建立在信任之上,破坏规则的行为会伤害整个行业协作秩序,资本不应该为这类行为买单。

而就田柯宇团队选择的视觉符号路线而言,属于差异化技术方向,未来能否兑现成本下降、世界模拟的承诺,仍然需要后续模型实测数据来验证。

责任编辑:刘万里 SF014

加载中...