①美国当地时间周四早间,所有头部AI服务集体出现故障,ChatGPT、Claude、Grok等确认异常,Gemini和Copilot也收到大量中断报告;
②罕见的AI集体下线之际,恰逢OpenAI预告“GPT-6”即将上线。
财联社9月3日讯(编辑 李莹)全球AI芯片龙头英伟达近日在企业AI推理市场再落一子。当地时间周三,其联手全球数据中心与互联服务商Equinix、开源模型推理平台Together AI面向企业用户推出分布式AI推理服务。
分布式推理,是指把推理任务拆分,调度分布在不同地域的多台服务器协同完成计算,让推理能力贴近企业本地数据。
该服务定名"Equinix Inference Exchange",于当地时间周三在Equinix首届客户与合作伙伴大会"Equinix Horizon"上发布,计划于2027年第一季度上市。
Equinix表示,该服务主要面向三类需求:让推理更贴近用户与数据以降低时延、帮助企业从封闭模型迁移到开源模型以控制成本,以及在受监管行业中把模型运行在指定地区的机房内,满足数据不出境等要求。
三方分工
具体分工上,英伟达在其中承担算力与技术底座角色,输出企业级参考架构(Enterprise Reference Architectures),并提供AI基础设施硬件。
NVIDIA Enterprise Reference Architectures 是英伟达一套标准化 AI 基础设施参考方案,为生产级AI环境提供覆盖计算、网络、存储与软件的整体设计,目标是最大化"AI工厂"吞吐量、压低单位token成本,使企业不必从零验证硬件选型与组网方案。
报道指出,三方构成互补的三层:Equinix在底层提供电力、先进制冷与日常运维,并通过其互联平台Equinix Fabric连接云、网络与AI服务商。
英伟达居中提供算力与参考架构;Together AI在最上层运行推理平台,支持超过200个开源模型,并提供多租户共享部署与单租户独享环境两种形态。
报道指出,承载上述方案的平台规模亦是合作基础——Equinix目前在77个都市区运营超过280个数据中心,拥有逾230个云接入点,超过1.05万家企业在其中立平台上实现互联。
Equinix表示,全球前十大AI模型提供商中的八家、前十大AI云服务商中的九家已将基础设施落地在其数据中心内。
推理成主力
该服务的推出与英伟达近期自身的业务重心迁移相互印证。
据媒体报道,英伟达在提交美国证券交易委员会的2026财年年度报告(财年截至2026年1月25日)中明确指出,推理已超越训练成为主导性负载,AI不再只是被构建,而是被大规模使用。
报告将其归因于智能体的普及——智能体在推理、规划与解决问题的每一步都在生成token,随着其被部署到更多工作流与行业,算力需求随之放大。
这一判断也体现在产品定位上。据报道,英伟达创始人兼首席执行官黄仁勋在2026财年第四季度财报公告中称,智能体AI的拐点已经到来,搭载NVLink的Grace Blackwell是当前推理领域的领先平台,可将单token成本降低一个数量级。
第三方研究显示同向趋势。麦肯锡2026年2月发布的测算显示,全球数据中心需求将从2025年的82.3吉瓦增至2030年的219吉瓦;其中AI推理负载由20.9吉瓦升至93.3吉瓦,年复合增速35%,同期AI训练负载由23.1吉瓦增至62.2吉瓦,增速22%。
麦肯锡由此判断,到2030年推理将占AI算力的一半以上、占数据中心总需求的三成至四成。
该机构同时强调,两类负载对基础设施的要求截然不同:训练需要高密度大型园区,配套专门的机电与散热系统;推理则更倾向布局在低时延、网络连接强、能效表现好的城域及近城域站点。
业内指出,这类城域及近城域站点,正是Equinix这类互联型数据中心运营商的“主场”。