新型云能否抢占AI算力市场?

作者: CBISMB

责任编辑: 邹大斌

来源: CBISMB

时间: 2026-08-27 10:44

关键字: 英伟达 OpenAI AI安全 AI智能体 谷歌

浏览: 0

点赞: 0

收藏: 0

AI算力之争已经打响。尽管新型云(neocloud)提供更廉价的GPU和针对AI处理优化过的基础设施,但超大规模云服务商在满足企业需求方面仍处于更有利的位置。

新型云凭借低成本GPU替代方案以及面向AI训练和推理的定制化特性,已经在AI算力基础设施领域占据了一席之地。但这一新兴的"替代云"类别,真能从超大规模云服务商手中抢走业务吗?

一些人认为,新型云确实有望在AI原生工作负载中占据越来越大的份额。Synergy Research Group报告称,2025年新型云营收已超过250亿美元。Gartner则预测,到2030年,新型云可能拿下2670亿美元AI云市场20%的份额。

"新型云提供针对AI优化、英伟达原生(NVIDIA-native)的基础设施,配备InfiniBand网络、裸金属访问和更低的成本,"Gartner高级首席分析师哈尔迪普·辛格(Hardeep Singh)说,"它们专注于高性能GPU集群和灵活合同,不同于超大规模云服务商那种通用、背负大量历史包袱的平台。"

全球咨询公司麦肯锡(McKinsey & Company)报告称,目前市场上共有100多家新型云服务商,但其中只有10至15家在美国以"有意义的规模"运营。然而,尽管新型云这一类别正在增长,目前几乎没有证据表明有较大比例的企业已经在新型云上实现了标准化。

什么是新型云?

新型云是新兴的一类公有云,作为超大规模云服务商亚马逊云科技(AWS)、谷歌云平台和微软Azure的替代选择而出现。新型云包括CoreWeave、Lambda、Nebius、RunPod和Vultr等按使用量计费的GPU计算平台。由于专注于AI计算,新型云在现代AI项目中展现出日益增长的实用性。

"新型云已成为AI基础设施生态系统中的关键组成部分,"AI服务公司Mindbeam AI创始人兼CEO尼伊·奥赛(Nii Osae)说,"它们向AI研究实验室和企业提供垂直整合的GPU以及高带宽存储、网络等其他配套硬件,以实现AI模型的可靠训练和推理。"

新型云是为更现代的算力范式而设计的。正如数字产品工程与技术服务公司R Systems云、安全与DevOps副总裁罗汉·古普塔(Rohan Gupta)所指出的:"超大规模云是为2010年的互联网设计的:数百万个多租户小型虚拟机(VM)跑在超售的以太网上。而新型云是为当时尚不存在的工作负载设计的:单个租户、数千块GPU、同时相互通信。"

新型云还能支撑当今蓬勃发展的智能体系统(agentic systems)的特殊需求。正如Vultr首席营销官凯文·科克伦(Kevin Cochrane)所说,新型云可以"用嵌入现有应用组合所需的全部专用AI服务和基础设施,扩展传统的云原生计算"。

新型云有何不同

新型云的一大卖点是成本更低。"在同等GPU容量下,新型云的运营成本通常约为超大规模云服务商的1/3,"AI应用开发公司Different Day的CEO兼联合创始人劳里·基恩·科彻(Lauri Kien Kotcher)说,"而且它们几天内就能完成资源供给,而超大规模云服务商对高密度AI基础设施的交付往往要按月计算。"

据ComputerWeekly报道,与传统超大规模云服务商的GPU实例相比,新型云的GPU实例可以节省60%至70%的成本。这些节省得益于与芯片制造商的紧密关系,这使得新型云在GPU短缺时期格外有吸引力。

"许多新型云与英伟达建立了牢固的合作关系,在裸GPU小时定价方面它们更具经济优势,"数字服务与基础设施解决方案提供商Presidio数据中心解决方案架构副总裁迈克尔·伯恩(Michael Byrne)补充道。

除了成本优势,新型云还在通过AI优化的计算和网络进行差异化竞争。"裸金属访问消除了虚拟机管理程序的额外开销,能释放底层GPU的全部性能,"数据库DevOps软件公司Redgate Software技术合伙人兼联盟经理约翰·Q·马丁(John Q. Martin)说。他补充道,它们为分布式训练优化的基础设施和高带宽互联在规模化时很有帮助。

在存储方面,新型云还提供高带宽数据检索选项,能够更高效地为大规模GPU集群供数。正如R Systems的古普塔所解释的:"新型云很早就采用了VAST、WEKA和DDN等厂商的并行文件系统架构,因为大规模AI训练本质上是一个并行文件系统问题,而不是对象存储问题。"

结果是:改进的是"有效吞吐"(goodput),而不仅仅是吞吐量,云存储提供商Backblaze产品营销总监大卫·约翰逊(David Johnson)说。"有效吞吐是指AI基础设施容量在扣除故障、重启和I/O停滞之后,转化为有用训练或推理工作的比例,"约翰逊说。Backblaze最近宣布与CoreWeave签署了一份为期五年、价值3.35亿美元的合作协议。

尽管如此,还有大量其他层面需要考虑。提供更全面服务的新型云很可能会在长期竞争中胜出。

"它们需要高速存储、低延迟网络、安全访问,以及跨团队治理和计量使用情况的方法,"云与AI基础设施管理平台提供商Rafay Systems的CEO兼联合创始人哈西布·布哈尼(Haseeb Budhani)说,"这对于推理尤其关键,因为企业AI支出的重头将落在推理上。"

新型云的最大客户:超大规模云服务商

鉴于其更低的成本、直接的GPU访问和更快的资源供给速度,专家表示,新型云非常适合大规模AI/ML训练、生成式AI平台和高性能计算等任务。不过,即使看看运行这些工作负载的到底是哪类公司,买家的身份仍可能会让你大吃一惊。

"新型云客户名单上最引人注目的一点,不是谁在名单上——而是谁排在最前面,"古普塔说,"目前最大的新型云客户恰恰是超大规模云服务商自己。"

据报道,微软占CoreWeave 2025年营收的67%,而OpenAI也一直是CoreWeave的最大客户之一。正如CoreWeave在2025年年度SEC文件中披露的那样:"截至2024年12月31日止年度,我们从前两大客户确认的收入合计约占我们总营收的77%。"

IT咨询公司Futuriom在《推理时代中的AI、GPU云与新型云》报告中写道:"超大规模云服务商似乎已经认识到,与英伟达、OpenAI以及CoreWeave等主要新型云之间的相互关联依赖存在风险。通过向其他参与者投资并将部分GPU云外包出去,超大规模云服务商正在降低自身资产负债表的风险。"

CoreWeave挥之不去的债务和高客户集中度,引发了对其长期可持续性的质疑。对一些人来说,超大规模云服务商既是用户又是竞争对手,这一事实让新型云的长期前景变得更加复杂。

"构建一个有竞争力的AI原生软件栈需要巨额资本、工程人才和时间,"马丁说,"而且在你最大的客户恰恰是你正在与之竞争的同一批超大规模云服务商时做这件事,是一种实实在在的战略张力。"

新型云的权衡取舍

尽管成本更低的GPU基础设施颇具吸引力,但并非所有人都准备好投向新型云。"我们的AI后端选择了超大规模云服务商,"Redgate Software的马丁说,"在我们目前的发展阶段,托管服务、生态集成以及按需增量扩展的能力,比绑定专门的GPU基础设施更有意义。"

Redgate的《2026年数据库格局报告》发现,43%的受访者运营着混合数据库环境。正如马丁所解释的,一边用新型云做AI计算、一边把数据放在超大规模云(或多个云)上,由此产生的运维碎片化让人难以接受。"它会带来真正的复杂性、数据出口成本、割裂的安全与身份管理,以及分散的运维开销,"马丁说。

虽然新型云可能提供原生的裸金属GPU性能,但你也会因此牺牲一些托管服务的便利。"你获得了裸金属GPU访问,却失去了超大规模云服务商开箱即用的自动伸缩、可观测性和企业级SLA等护栏,"马丁补充道。

Different Day也选择继续使用超大规模云,理由是现有技术栈的延续性。"拥有自己的云账户,意味着你继承了大型服务商提供的安全认证、身份控制、审计日志和采购合同,"Different Day的科彻说,"而新型云在大部分这些方面还没有到位。"

其他人也表示赞同。"最大的权衡是企业成熟度,"Rafay Systems的布哈尼说,"超大规模云服务商花了多年时间构建企业所期望的治理、安全、身份、审计、计费和运营控制。"

与周边架构的延续性,往往比GPU性能更重要。"超大规模云服务商在广度和集成方面保持着显著优势,"代码质量与安全公司Sonar工程企业副总裁斯科特·桑德斯(Scott Sanders)补充道,"对于那些AI工作负载处于更大企业环境内的组织来说,超大规模云提供的是专业服务商难以替代的延续性。"

韧性(resilience)是另一个需要考虑的领域。"虽然AI的性能和成本可能会改善,但风险包括可移植性挑战、运维开销以及对小众供应商的依赖,"网络安全咨询公司NCC Group总监兼高级顾问奈杰尔·吉本斯(Nigel Gibbons)说,"这意味着企业必须在优化与韧性、支持深度、合规覆盖面以及供应商长期存活能力之间取得平衡,尤其是对关键任务或受监管的工作负载而言。"

最后,虽然新型云目前的价格很有竞争力,但它们高度依赖波动的GPU硬件市场,这让它们最大的差异化优势建立在并不稳固的基础上。"与铁路甚至光纤——那些引发巨额投资的资本密集型繁荣不同——GPU不会保值数十年,"Futuriom指出,"事实上它们贬值很快——有时快到四五年。"

有限的胜利,而非接管

总而言之,与超大规模竞争对手相比,新型云既有明显的优势,也有明显的缺点。它们还面临其他挑战。

A10《2025年AI基础设施现状报告》发现,35%的受访者主要将AI工作负载托管在公有云环境中,而42%的受访者倾向于均衡的混合方案。这意味着新型云不仅要与超大规模云服务商竞争,还要与本地部署和混合基础设施策略竞争。

更重要的是,超大规模云服务商自研芯片的崛起也可能在未来打乱新型云的进展。"AWS的Trainium、谷歌的Ironwood和微软的Maia为超大规模云服务商带来了新型云在结构上无法匹敌的成本和规模优势,因为后者本质上就是英伟达的分销商,"古普塔说。

尽管如此,围绕新型云的炒作仍在随着更广泛的AI服务市场的热度而持续。Futuriom创始人兼首席分析师斯科特·雷诺维奇(Scott Raynovich)在Forbes撰文,描述了可能缓解上述部分权衡的成熟路径:"这些公司将从单纯的GPU租赁服务演进,提供全球基础设施、应用服务以及数据隐私与安全。"

最终,新型云能否通过提供AI原生软件栈成功与超大规模云服务商实现差异化?"新型云会赢得一个真实的市场,"科彻说,"但它们赢不下更广阔的市场。诚实的答案是:这是一场有限的胜利,而不是一次接管。"

"领先的新型云并不想在整个产品组合上取代AWS或Azure——它们是在为超大规模云经济失灵的那些AI工作负载,构建一个互补层,"Backblaze的约翰逊说。

因此,最可能出现的结果是共存。"新型云将守住前沿训练和与英伟达绑定的推理,"古普塔预测,"而超大规模云服务商将守住数据平面、受监管工作负载、自研芯片推理以及企业商业关系。"

©本站发布的所有内容,包括但不限于文字、图片、音频、视频、图表、标志、标识、广告、商标、商号、域名、软件、程序等,除特别标明外,均来源于网络或用户投稿,版权归原作者或原出处所有。我们致力于保护原作者版权,若涉及版权问题,请及时联系我们进行处理。