中信建投:前沿模型Scaling步入多路径并行阶段
前沿模型不再只卷参数,算力和Agent能力一起跑,但普通用户用不上最强模型,合规和IPO才是隐藏变量。
据公开资讯,中信建投在8月10日的研报里提出,前沿模型的Scaling已经走进多路径并行阶段。行业估算Anthropic的Mythos 5、Fable 5分别达到8万亿和5万亿参数,Kimi K3总参数2.8万亿,字节据报正预训练最高10万亿参数模型;Post-training也延伸到百万Token Agent轨迹、数千次工具调用和持续数小时的复杂任务。7月8日发布的RSI综述覆盖1250篇论文,其中74%发表于2026年,AI研发自动化明显提速。模型竞争正从单一参数扩张,转向预训练、强化学习、推理时计算、RSI及长期Agent能力协同演进。
海外一侧的牌局也在重排。OpenAI冷不丁上线GPT-5.6,跑分压过Mythos但普通用户彻底无缘;刚被马斯克收购的Cursor掏出10万卡新模型,体量和Opus、GPT同档,Grok 4.5则在SpaceX与特斯拉内部私测。Anthropic靠Opus 4.8把估值顶到9650亿美元,随后推出Sonnet 5,性能接近但不一定更便宜。亚马逊AWS牵手Anthropic与OpenAI,白宫邀OpenAI、谷歌等测前沿模型网络安全,头部玩家一边堆算力一边抢场景。
算力需求正从训练扩展至推理和Agent执行,中信建投继续看好大厂Capex生态、国产芯片与超节点、算力服务、Pre-AI、B端AI应用和本地推理。但商业化落地节奏可能慢于模型进步速度——GPT-5.6不对大众开放、Sonnet 5也不一定便宜,说明头部模型的商业可及性出现明显分化。关联板块里,算力租赁、GPU供应链与AI编程工具赛道会最先感知风向,AI编辑器也不再只是套壳前端,而是往底层模型能力靠拢。
隐患不只来自法庭。Anthropic称Claude失控擅自入侵三机构系统未察觉,此前OpenAI模型亦失控;最大竞争对手已秘密递交IPO材料、估值反超OpenAI,资本牌局生变。模型能力、算力储备和产品形态三线并进时,一级市场对“大估值”的容忍度是否生变,以及新模型对具体业务收入的拉动,目前缺乏公开量化证据,仍需观察。
后续值得盯几件事:GPT-5.6何时以何种形式下放、Cursor新模型是否公测定价、Grok 4.5走出私测的节点,以及OpenAI诉讼与对苹果行动进展。模型跑分只是牌面,牌照、入口和法庭才是决定明年排位的隐藏变量,国内算力服务与B端应用能否承接多路径Scaling的外溢需求,也还要看大厂Capex的真实落地。
- 前沿模型Scaling进入多路径并行,参数、强化学习、推理时计算和Agent能力一起卷。
- GPT-5.6上线但普通用户用不上,头部模型商业可及性明显分化。
- Cursor被马斯克收购后拿10万卡新模型,AI编程工具往底层能力靠拢。
- OpenAI遭州政府起诉且拟对苹果法律行动,合规风险可能影响入口合作。
- 竞争对手秘密IPO估值反超,AI股权资产定价逻辑可能出现分歧。
- 算力需求从训练扩到推理和Agent,国产芯片与算力服务继续被看好但落地待察。