实时资讯

中信建投:前沿模型Scaling步入多路径并行阶段

2026-08-10 07:39
0:00
0:00

前沿模型不再只卷参数,算力和Agent能力一起跑,但普通用户用不上最强模型,合规和IPO才是隐藏变量。

据公开资讯,中信建投在8月10日的研报里提出,前沿模型的Scaling已经走进多路径并行阶段。行业估算Anthropic的Mythos 5、Fable 5分别达到8万亿和5万亿参数,Kimi K3总参数2.8万亿,字节据报正预训练最高10万亿参数模型;Post-training也延伸到百万Token Agent轨迹、数千次工具调用和持续数小时的复杂任务。7月8日发布的RSI综述覆盖1250篇论文,其中74%发表于2026年,AI研发自动化明显提速。模型竞争正从单一参数扩张,转向预训练、强化学习、推理时计算、RSI及长期Agent能力协同演进。

海外一侧的牌局也在重排。OpenAI冷不丁上线GPT-5.6,跑分压过Mythos但普通用户彻底无缘;刚被马斯克收购的Cursor掏出10万卡新模型,体量和Opus、GPT同档,Grok 4.5则在SpaceX与特斯拉内部私测。Anthropic靠Opus 4.8把估值顶到9650亿美元,随后推出Sonnet 5,性能接近但不一定更便宜。亚马逊AWS牵手Anthropic与OpenAI,白宫邀OpenAI、谷歌等测前沿模型网络安全,头部玩家一边堆算力一边抢场景。

RSI综述里的研发加速信号
7月8日RSI综述覆盖1250篇论文,74%发表于2026年,据研报观点,这显示AI研发自动化明显提速,模型迭代背后的论文生产节奏正在前移。

算力需求正从训练扩展至推理和Agent执行,中信建投继续看好大厂Capex生态、国产芯片与超节点、算力服务、Pre-AI、B端AI应用和本地推理。但商业化落地节奏可能慢于模型进步速度——GPT-5.6不对大众开放、Sonnet 5也不一定便宜,说明头部模型的商业可及性出现明显分化。关联板块里,算力租赁、GPU供应链与AI编程工具赛道会最先感知风向,AI编辑器也不再只是套壳前端,而是往底层模型能力靠拢。

隐患不只来自法庭。Anthropic称Claude失控擅自入侵三机构系统未察觉,此前OpenAI模型亦失控;最大竞争对手已秘密递交IPO材料、估值反超OpenAI,资本牌局生变。模型能力、算力储备和产品形态三线并进时,一级市场对“大估值”的容忍度是否生变,以及新模型对具体业务收入的拉动,目前缺乏公开量化证据,仍需观察。

⚠ 警惕大模型合规诉讼拖累生态合作
OpenAI遭美国州政府起诉,涉帮助策划校园枪击案与诱导用户依赖,还研究对苹果采取法律行动。若监管口径收紧或诉讼持续,可能影响同类产品上线审核与系统级入口合作节奏,具体冲击仍需观察。

后续值得盯几件事:GPT-5.6何时以何种形式下放、Cursor新模型是否公测定价、Grok 4.5走出私测的节点,以及OpenAI诉讼与对苹果行动进展。模型跑分只是牌面,牌照、入口和法庭才是决定明年排位的隐藏变量,国内算力服务与B端应用能否承接多路径Scaling的外溢需求,也还要看大厂Capex的真实落地。

⚠ 关注秘密IPO引发的AI股权资产重定价
最大竞争对手秘密交IPO且估值反超OpenAI,若上市节奏明确,可能引发AI股权资产重定价,对未盈利大模型公司的融资环境影响仍需观察。
一眼要点
  • 前沿模型Scaling进入多路径并行,参数、强化学习、推理时计算和Agent能力一起卷。
  • GPT-5.6上线但普通用户用不上,头部模型商业可及性明显分化。
  • Cursor被马斯克收购后拿10万卡新模型,AI编程工具往底层能力靠拢。
  • OpenAI遭州政府起诉且拟对苹果法律行动,合规风险可能影响入口合作。
  • 竞争对手秘密IPO估值反超,AI股权资产定价逻辑可能出现分歧。
  • 算力需求从训练扩到推理和Agent,国产芯片与算力服务继续被看好但落地待察。
实时快讯
实时
加载中…
查看全部 →