新浪科技

张一鸣“叫板”梁文峰?

新浪财经头条

关注
听新闻

来源:圆方你怎么看啊

01

许久未曾公开发言的张一鸣,最近就字节的大模型研发表态了。

张一鸣在字节Seed大模型团队内部会议就自研大模型定调:

他认为,训练大模型难度很高,团队无需过度焦虑,短期内可以接受模型落后行业,目标冲击全球第一梯队的智能上限。

他也认可编程是当下关键赛道,所以需整合火山引擎、飞书、豆包资源,夯实算力与数据优势。

同时也认为不能被热点裹挟,编程之外仍存在广阔机会。

也肯定Seedance(AI生成视频)差异化的技术优势,鼓励走出自有技术路线,而非一味追随竞品。

张一鸣还谈到了自己对模型蒸馏的看法。

他反对蒸馏,认为蒸馏能在短期内改善模型表现,但本质上仍是在复制 Claude 已有的能力。

沿着这条路走,最多只能不断逼近对方,很难真正实现超越。他也希望 Seed 可以从更底层的维度去构建自己在 AGI 上的壁垒。

大家好,我是圆方,今天我们一起聊聊:

张一鸣“叫板”梁文峰?

02

印象中,张一鸣已经很久没有在媒体舆论场上出现发声了。

即便是有一些内部的讲话,在外部传播上也是控制得特别严。

这次关于大模型的表态,想来不是无心之失的流传出来,而是深思熟虑之后的一个发声考虑。。

在前不久,梁文峰2026年7月投资人闭门交流会速记被流传出来,对于大模型下一阶段的演化态势也做了一个研判

他认为,DeepSeek长期愿景就是做成AGI,产品只是通往AGI路上的副产物。

不能把精力分散到各类支线业务,所有决策优先考量“提升实现AGI的概率”,流量、商业化、市值都排在后面。

明确当下重心重点攻坚Coding Agent,它可以直接辅助模型研发,加速AGI推进;

视频、3D生成等属于支线,暂时不投入主力资源。

还有说到,克制是一种战略,资源有限,每一次非主线扩张,都会降低抵达AGI的概率,主动放弃C端超级App路线,不为短期风口分散力量。

03

如果我们一条一条对应来看,可以看到张一鸣的表态几乎都回应了梁文峰提到的几个关键点。

围绕聚焦与多元,梁文峰的选择是极致的克制。他将几乎全部主力资源倾注于Coding Agent,视频生成等方向被明确归为支线,暂不投入主力。

张一鸣的表态则呈现出一幅截然不同的图景。

他专门肯定Seedance的差异化优势,鼓励团队走出自己的技术路线,更强调编程之外仍有广阔机会。

这番定调等于是宣告,字节将同时押注编程、视频生成等多条战线,通过整合火山引擎、飞书、豆包所积蓄的算力与数据,寻求多维突破。

一方主张把力量集中到一个点上,一方选择多线并行,背后的判断差异极为鲜明。

04

关于技术路径的争论更具根本性。

张一鸣对蒸馏的反对语气格外坚决。

在他看来,蒸馏能在短期内改善模型表现,本质上仍是在复制Claude已有的能力,沿着这条路走,最多只能逼近对方,很难真正实现超越。

他要Seed团队从更底层的维度去构建AGI壁垒。

梁文峰虽未直接提及蒸馏,但DeepSeek长期以高效训练和开源为人所知,模型能力跃升迅速,外界难免会将其技术路线与各种提效方法联系起来。

张一鸣此刻高调亮出反对蒸馏的底牌,等于在基础方法论层面,与一种较为普遍的跟随做法划清了界限。

他传达的信息很清晰:

字节追求的是真正的原始创新,哪怕短期落后也绝不走复制捷径。

这构成了两个团队在技术信仰上的深度交锋。

05

再看模型进度的表态,同样耐人寻味。

DeepSeek系列模型在多个评测中已展现出强劲实力,市场普遍认为其处于领先身位。

张一鸣却在内部坦然承认训练难度极高,短期内可以接受模型落后,目标直指全球第一梯队的智能上限。

这种公开接受落后的姿态,配上一个无比宏大的终极目标,表达的是一套全然不同的竞赛逻辑。

C端应用的路线分歧同样无法忽视。

梁文峰明确提出放弃C端超级App,他认为流量和商业化会降低实现AGI的概率。

张一鸣的整合策略则走向相反方向。豆包作为C端超级应用被纳入大模型战略的核心资源圈,其算力与大规模用户数据积累将直接反哺模型训练。

这是把AGI探索与用户生态深度耦合的思路。

一个向内极致收敛,一个向外持续延展,从理念到落地方案都针锋相对。

06

这是极其罕见的中国两位科技创新型企业家,在同一赛道上公开亮出“不完全一样”的路线图。

而这件事的意义,可能远远超出个人风格之争。它意味出中国AI在迈向AGI的关键阶段,出现了真正意义上的路径分化。

圆方觉得,这是一件好事。

过去,中国在创新的路上往往都是跟随和模仿,所以步调很多时候都是一致的,不管是当年的百团大战,还是后面的千模大战,都是这样。

而今天,不再所有人都顺着同一种共识前行,最顶尖的头脑开始就核心命题进行公开辩论。这种竞争和争论的空间,不管是对行业,甚至对社会都极为宝贵。

当梁文峰用克制来集中力量,张一鸣用整合来拓展边界,两种模式都会在现实中得到反复检验。

无论最后谁更逼近AGI,过程中沉淀下来的工程能力、人才密度和原创技术,都将成为中国AI的集体财富。

叫板也罢,对垒也好,这种富有张力的竞合,恰恰是创新最需要的氛围。

中国AI需要这样的多元探索,也需要这样敢于为各自信仰全力下注的勇气。

07

张一鸣这番讲话流出的同时,据媒体报道,字节跳动内部正在讨论训练一个参数规模超 5 万亿的模型,它超过阿里的 Qwen 3.8-Max(2.4 万亿参数)和月之暗面的 K3(2.8 万亿参数),也是目前国内已知参数规模最大的模型。

而根据统计,7月27‑8月2日,算力聚合平台周度Token调用榜单,DeepSeek‑V4‑Flash以7.22万亿Token登顶单模型第一,环比上涨13%;

DeepSeek厂商整体也拿到厂商榜第一。

也就是今天,DeepSeek在开放平台发布预告:

计划近期整体上调API服务价格,提示预计涨幅较大,具体调价幅度、生效时间以待正式通知 。

所以小伙伴们,你们更看好在未来的一年中,谁能够做出更加厉害的国产基础模型呢?

特别声明:以上内容仅代表作者本人的观点或立场,不代表新浪财经头条的观点或立场。如因作品内容、版权或其他问题需要与新浪财经头条联系的,请于上述内容发布后的30天内进行。

加载中...