新浪财经

DeepSeek-V4技术报告公开作者名单,多位核心骨干被挖

市场资讯 04.28 11:13

(来源:电子技术应用ChinaAET)

4月28日消息,据每日经济新闻报道,DeepSeek上周发布长达58页的V4技术报告,一份近300人的“研究与工程”作者名单引发关注。

名单显示,创始人梁文锋与所有研究员、工程师并列署名。名单中10人标注“已离职” ,其中不乏王炳宣、魏浩然、郭达雅等核心骨干成员。据报道,2025年下半年至今,DeepSeek至少5名核心研发成员确认离职。

报道提到,DeepSeek第一代大语言模型核心作者王炳宣去了腾讯,V2核心贡献者罗福莉被挖至小米,R1核心研究员郭达雅入职字节跳动Seed团队,多模态技术核心研究员阮翀也离职加入自动驾驶科技公司元戎启行,OCR系列核心作者魏浩然也离职去向暂未披露,这些核心研发成员覆盖了基座模型、推理、OCR、多模态四条核心技术主线。

作为由量化私募巨头幻方量化于2023年孵化的人工智能公司,DeepSeek凭借DeepSeek-V3和DeepSeek-R1等模型的开源与卓越性能,在2025年一度成为全球AI领域的技术标杆。

据此前日报道,DeepSeek-V4模型预览版正式上线并同步开源。DeepSeek-V4拥有百万字超长上下文,在Agent能力、世界知识和推理性能上均实现国内与开源领域的领先。

01

DeepSeek V4中文能力测评结果

SuperCLUE团队发布DeepSeek V4系列中文大模型测评结果,DeepSeek-V4-Pro凭借综合表现拿下国内第一 ,Flash版本紧随其后位居第二,国产开源模型再迎突破。

本次测评覆盖数学推理、科学推理、代码生成、智能体任务规划、指令遵循、幻觉控制六大维度,Pro版本得分70.98分,Flash版本68.82分,两项成绩均大幅领先国内其他模型。

02

DeepSeek V4技术与性能升级

DeepSeek V4系列采用全新注意力机制,全版本支持百万级长上下文,同时降低算力与显存占用,搭配国产芯片使用,整体效率更高。

相比上一代 V3.2,两个版本均实现全面提升。Pro版本智能体能力提升超20分,数学推理提升近10分,指令遵循提升近12分,幻觉控制也有明显优化。

Flash版本在保持高效推理的同时,智能体与数学推理同样大幅提升,性价比突出。

03

版本定位与测评总结

Pro版本(15元/百万Tokens)侧重高性能,幻觉控制更稳,适合复杂任务与专业场景。Flash 版本速度更快、成本更低,API价格仅1.25元每百万Tokens,日常使用更划算。

测评同时指出,模型与海外顶尖模型在代码生成、复杂指令执行等方面仍有差距。整体来看,DeepSeek V4凭借均衡能力与亲民成本,站稳国内第一梯队,成为日常办公、开发创作、长文本处理的优质选择。

来  源 | IT之家

加载中...