中信建投 | GPT 5.6限量发布,国产开源模型海外认可度持续提升
(来源:中信建投证券研究)
文|杨艾莉 杨晓玮 蔡佳成 马晓婷
AI需求的增长并未按下暂停键,国产开源模型海外认可度持续提升,坚定看好AI产业趋势。近期市场对AI客户调整token账单、大模型价格战等讨论度较高,担心AI需求、大模型收入增长斜率放缓。我们认为:
1)token消耗优化是短期温和调整,并不意味着AI需求增长乏力。据Evidence Lab,仅8%的企业在生产环境中大规模部署AI Agent,Agent真正大规模消耗token的阶段才刚开始;企业在推进模型路由,简单任务转向低价甚至中国开源模型:据ZenMux,近2周智谱市场份额提升至15%+,此前仅为个位数;OpenRouter的开源模型调用量超过闭源模型。
2)大模型性价比的重要性提升,国产开源大模型竞争优势强化。OpenAI限量发布的GPT 5.6成为行业新SOTA,其旗舰版定价与GPT 5.5持平;国产主流大模型的价格约为海外的1/5-1/3。
3)伴随模型能力不断突破,监管更多介入,重视国产大模型。Anthropic、OpenAI最新版大模型均因为美国政府监管而限量开放,国产大模型的重要性和战略意义进一步突显。
全球AI进展及更新
1、行业观点
AI需求的增长并未按下暂停键,国产开源模型海外认可度提升,坚定看好AI产业趋势。本周智谱-2.29%、MiniMax-14.19%,均有所回调。近期市场对AI客户调整token账单、大模型价格战等讨论度较高,担心AI需求、大模型公司收入增长斜率放缓。我们认为:
1)token消耗优化是短期温和调整,并不意味着AI需求增长乏力。据Evidence Lab对约130家企业的最新调查显示,仅8%的企业已在生产环境中大规模部署AI Agent,29%仍在试点,26%只是使用Copilot或AI Coding等产品但尚未部署Agent应用,AI Agent真正大规模消耗Token的阶段才刚开始。
伴随模型能力和Harness能力进一步提升,金融、法律、生物医药等场景的应用将进一步打开。OpenAI限量发布的GPT 5.6成为行业新SOTA,5.6引入两个新工程能力:max reasoning effort(Sol深度推理时不主动截断)+ ultra mode(子代理并行);Anthropic推出面向Enterprise / Team客户的Claude Tag for Slack(Beta),企业团队可在Slack频道@Claude委派任务,连接工具/数据/代码库,支持多人协作、长上下文记忆、主动更新和异步任务处理。
此外,豆包专业版上线,面向专业用户处理复杂工作与生产力场景,国民级的通用AI应用进行C端变现,有望加快对泛知识工作者的覆盖、及对其付费的渗透。豆包月活超过3亿,其专业版核心是"办公任务模式",基于最新的豆包2.1系列大模型,覆盖Office办公、应用开发、数据分析、专业设计、流程自动化、金融分析等场景。
2)大模型性价比的重要性提升,国产开源大模型竞争优势强化。GPT 5.6旗舰版定价与GPT 5.5持平,6月中旬发布的GLM 5.2定价同样与GLM 5.1保持一致,部分模型公司在降低提价速度;国产主流大模型的价格约为海外主流大模型的1/5-1/3。企业在推进"模型路由",简单任务转向低价,甚至中国开源模型;ZenMux(AI大模型聚合平台)的统计显示:近2周智谱市场份额显著提升至15%+,此前仅为个位数;OpenRouter的开源模型调用量已超过闭源模型。
3)伴随模型能力不断突破,监管更多介入,重视国产大模型。Anthropic、OpenAI最新版大模型均因为美国政府监管而限量开放,行业顶尖模型的发布监管审批先行,且或将限制部分用户的正常使用,国产大模型的重要性和战略意义进一步突显。
2、全球AI产业进展
大模型:GPT 5.6限量发布,SOTA;Mythos重新小范围上线;豆包2.1“上牌桌”。继续关注Q3模型发布
本周上新 模型仍重点提升Coding、Agent能力。
1)GPT 5.6成为行业新SOTA,包含3档模型:Sol、Terra、Luna。Terminal-Bench 2.1(命令行/编程长程任务),Sol版本略高于Mythos,Luna模型高于Opus 4.8-Codex负责人发布推文提醒用户Codex支持第三方模型(2025年4月起即已支持第三方模型)。其同步引入两个新工程能力:max reasoning effort( Sol 深度推理时不主动截断)+ ultra mode(子代理并行)。定价方面,Sol输入/输出价格5/30美元/TMTok,与GPT 5.5持平。目前GPT 5.6仅20家政府审批公司可用,同样由于美国政府监管。
2)Mythos 5重新小范围上线,预估Fable5上线在即。
2)字节:基模Seed 2.1 Pro/Turbo重点提升Coding、Agent能力,未SOTA,但部分评分达到头部主流模型水平,Code Arena评分超过Claude Opus 4.6;定价方面,Pro版输入/输出6、30元/百万token,较2.0 Pro提价约87.5%,是Claude Opus 4.6-4.8的1/4-1/5。多模态:Seedance 2.0升级,支持原生4K直出,2.5将于7月初上线:将支持30s单段原生视频直出、50个全模态素材联合输入、更可控的视频生成与编辑。
继续关注Q3模型更新:
1、Kimi K3模型(万亿参数)或将于Q3发布。
2、MiniMax海螺3近期有望发布,M3大参数版本有望Q3发布;。
3、据Business Insider,Gemini 3.5 Pro或将于2026年7月发布。
商业化:GPT 5.6定价与GPT 5.5持平,大模型性价比重要性提升;C端,豆包专业版上线
本周主流大模型价格变化:GPT 5.6旗舰版定价5/30美元/Mtok,与GPT 5.5持平。从海内外主流大模型旗舰版定价来看,海外模型显著高于国内,约为国内大模型的3-5倍,国产大模型的性价比突出。
我们认为:1)行业定价分化始终存在;性能是支撑模型高定价、提价的核心。2)以3美金/百万token(输出价格)作为分界线:3美金之上,主要是核心生产力场景,价格敏感度相对较低,用户更在意模型性能;3美金之下,在模型能力达到一定水平的基础上,用户更关注性价比。
豆包专业版上线,面向专业用户处理复杂工作与生产力场景,国民级的通用AI应用进行C端变现,有望加快对泛知识工作者的覆盖、及对其付费的渗透。豆包月活超过3亿,其专业版核心是"办公任务模式",基于最新的豆包2.1系列大模型,具备操作本地电脑、使用浏览器、调用Skills技能、定时任务等能力,内置Office办公套件,支持专业图片视频设计与生成分享应用网站,覆盖Office办公、应用开发、数据分析、专业设计、流程自动化、金融分析等场景。其包含五大核心能力:①操作本地电脑和浏览器(需下载PC版);②应用生成;③Office应用;④Skills技能调用;⑤定时任务。定价方面:标准、加强、高级套餐分别68/200/500元,定价基于使用额度,标准套餐的办公任务、专家模式等为免费版5倍以上额度,加强/高级套餐分别为标准套餐4/10倍额度。
Token调用:本周OpenRouter调用量依然保持增长态势,环比+0.6%
本周(6.22-6.28)预计 Token调用46.9万亿,环比+0.6%,前3依然为DeepSeek V4 Flash、MiMo-V2.5,MiniMax M3。本周环比增速有所放缓,预计系AI客户调整token账单,及近两周主流大模型迭代较少。
近2周智谱token市场份额有所提升。据ZenMux(大模型聚合平台)的统计,近2周智谱token调用市场份额超过15%,预计系智谱GLM 5.2编程、Agent能力领先,在全球AI客户调整账单的背景下,智谱高性价比属性进一步突显。
版权保护力度不及预期,知识产权未划分明确的风险,用户隐私数据泄露风险,与IP或明星合作中断的风险,大众审美取向发生转变的风险,竞争加剧的风险,用户付费意愿低的风险,消费习惯难以改变的风险,关联公司治理风险,内容上线表现不及预期的风险,生成式AI技术发展不及预期的风险,产品研发难度大的风险,产品上线延期的风险,营销买量成本上升风险,人才流失的风险,人力成本上升的风险,政策监管的风险,商业化能力不及预期的风险。
证券研究报告名称:《周观点:GPT 5.6限量发布,国产开源模型海外认可度持续提升》
对外发布时间:2026年6月27日
报告发布机构:中信建投证券股份有限公司
本报告分析师:
杨艾莉 SAC 编号:S1440519060002
SFC 编号:BQI330
杨晓玮 SAC 编号:S1440523110001
蔡佳成 SAC 编号:S1440524080008
马晓婷 SAC 编号:S1440525070013