①目标到2026年底,全国服务商资源池内服务商数量突破2000家;
②对于大模型、智能体、Token等服务采购,以及应用出海和算力降本,工信部也给出了相关意见;
③中国AI产业正从技术追赶转向商业化变现,2026年有望成为重要节点。
《科创板日报》8月31日讯 今日,腾讯混元发文称,为保障使用体验,已针对Hy4 preview推理集群进行紧急扩容,并将持续动态调配资源。
关于紧急扩容的原因,腾讯混元表示,自2026年8月28日混元Hy4 preview在WorkBuddy首发接入以来,凭借其Agent能力的显著提升,受到了广大用户与开发者的积极体验和热情反馈,上线首日即在WorkBuddy任务队列中出现排队情况。
与此同时,腾讯混元为排队情况提供了过渡方案:一是切换到Hy3等其他模型继续使用:Hy3当前WorkBuddy限免将延长至2026年9月30日23:59;二是将非紧急需求错峰调至晚间时段使用。

图源:腾讯混元
不过,腾讯混元提醒道,受限于高端算力总量与高峰并发集中,仍不排除个别时段会继续出现排队情况。此外,由于Hy4 preview为大语言模型,暂不具备多模态生成能力,当发起生图、视频等任务时,系统会自动切换到其他多模态模型执行。
华创证券指出,Hy4 preivew模型,在模型尺寸(总参数770B)、上下文长度(1M)、数据规模上较Hy3提升显著;与GLM-5.3、Kimi K3等一梯队开源模型相比,在多个Benchmark上跑分接近,在Workbuddy上盲测结果略优。API价格每百万tokens输入(缓存命中)/输入/输出分别0.3/6/18元,Workbuddy上免费两周,延续高性价比优势。
▌大模型持续火热 国产算力放量在望
伴随访问量大增,AI模型陡然爆火,最终倒逼算力扩容,类似的情况已经屡见不鲜。
7月17日,月之暗面正式发布Kimi K3,其年化收入于次日从平缓波动区间陡然冲高,创下历史最大单日增幅。上线48小时后,Kimi K3用户请求量大幅超出预估,一度抵达推理集群承载极限。公司不得不暂停C端新用户订阅,并全力推进算力扩容。
就在本月,DeepSeek V4 Flash上线公测后不久,海外开源AI Coding Agent平台OpenCode发文称:DeepSeek V4 Flash因前所未有的访问量而出现容量不足问题。随后,技术团队启动紧急扩容方案,并全力修复相关问题。
今年以来,国产大模型调用量总体呈持续攀升趋势。
根据OpenRouter最新数据测算,上周(8月24日至8月30日)全球AI大模型总调用量为113万亿Token,环比增长21.11%,较年初增长1928.73%。上榜的AI大模型中,国产大模型周调用量达55.16万亿Token,环比增长36.26%;同期美国AI大模型周调用量为17.07万亿Token。国产大模型周调用量连续十八周超过美国并稳居全球首位。

图源:OpenRouter
在国产大模型百花齐放之际,华创证券建议关注国内外模型竞争格局,以及头部厂商在高效架构、国产算力适配、办公Agent入口和开发者生态的商业化进展。该机构表示,在国产模型开源为主、性能提升加速、格局相对分散的趋势下,互联网平台有望延续企业数据与入口优势,在编程、办公等高价值场景中提升渗透率,MaaS与云收入兑现提升资本开支回报。
广发证券分析称,Token调用量快速增长,且需求正由简单问答向Coding、Agent、多模态生成和复杂知识工作迁移,带动模型API、云算力及AI应用需求持续扩张。单位Token价格下降进一步降低了应用门槛,并推动调用量和使用场景增长。后续,国产大模型Tokens快速的增长有望推动国产AI芯片和服务器产品的快速放量。
该机构进一步指出,国内算力供需失衡格局下高端GPU采购价格不断上行,进一步推高了企业自建算力集群的初始资本开支,算力租赁由此成为现阶段国内获取高端算力资源的重要补充供给方式。对于算租厂商而言,还具备稳定现金流、高硬件残值等优势。看好后续token分成的商业模式。
开源证券近日研报指出,大模型C端应用规模化扩张、B端私有化部署加速及边缘推理场景渗透,将驱动推理算力需求指数级增长,推理成本持续下探进一步释放中小客户需求,国产算力推理场景增速预计高于训练场景,国产大模型与芯片的协同渗透率持续提升。
其表示,供给侧看,2026年上半年国产芯片龙头通过大幅提升存货与预付款规模,锁定上游原材料及委托加工产能以保障订单交付,寒武纪、海光信息等核心厂商存货较2025年末实现显著增长,推理算力赛道供需共振下,AI算力产业链上下游均有望迎来业绩释放机遇。