服务商概述
CoreWeave 成立于 2017 年,最初以 Atlantic Crypto 之名运营,2021 年更名为 CoreWeave 并全面转型为专业 GPU 云服务商,总部位于美国新泽西州罗斯兰(Roseland, NJ)。它专注于为 AI 训练与推理、机器学习及高性能计算(HPC)提供大规模 NVIDIA GPU 算力,是 GPU 云服务器对比中公认的高性能选项。
截至 2026 年,CoreWeave 已在全美部署多个超大规模 GPU 数据中心,单集群可调度 10,000+ 张 H100/A100 加速卡,并通过按秒计费与托管 Kubernetes 显著降低 AI 算力的使用门槛。对需要大规模 GPU 集群做模型训练、推理部署或云渲染的团队,它是 云服务器选型中的重要评估对象。
核心优势
- 大规模 NVIDIA GPU 集群:提供 H100、A100、RTX 等旗舰加速器,单集群可扩展到 10,000+ 张 GPU,配合 400Gbps InfiniBand 高速互联,满足 大模型微调与训练的大规模并行需求。
- 按秒计费的弹性成本:GPU 实例按秒计费、随开随停,闲置算力即时释放不再扣费,比按小时计费的传统云节省明显,适合波动型训练任务。
- 托管 Kubernetes 编排:内置 GPU 调度、自动扩缩容与节点池管理,让团队像管理普通工作负载一样管理 AI 任务,参考 Kubernetes 部署入门。
- AI 专用存储:提供面向训练数据流与模型检查点的 NFS/并行文件系统,支持 10PB 级数据吞吐,降低 I/O 瓶颈。
- 裸金属 GPU 选项:提供不含虚拟化层的 GPU 裸金属服务器,单实例可配置 8 张 H100,为对性能损耗敏感的工作负载提供接近物理机的性能。
产品生态
CoreWeave Cloud(GPU 计算平台)
按需 GPU 计算实例,支持 NVIDIA H100、A100、RTX 系列,按秒计费,可用于 AI 训练、推理、渲染与通用 GPU 工作负载。
托管 Kubernetes
托管集群内置 GPU 调度、自动扩缩容与监控,支持把 AI 推理服务打包为容器镜像一键部署,简化运维。
Virtual Servers(虚拟服务器)
面向通用计算与轻量级 AI 工作负载的虚拟服务器实例,适合作为训练任务的前后端节点。
高性能存储与网络
提供高性能网络文件存储(NFS)、并行文件系统与 400Gbps 数据中心内互联,为大规模分布式训练提供高吞吐数据通路。
AI 推理与部署
支持将训练好的模型部署为托管推理服务,结合 AI 模型托管部署可实现从训练到上线的完整链路。
不足之处
- 通用云服务较少:以 GPU 计算为核心,通用 CPU 云主机、托管数据库、对象存储等传统云服务选择有限,通用业务需搭配其他云厂商。
- 区域覆盖集中在美国:数据中心主要位于美国,亚洲、欧洲等区域的访问延迟偏高,海外业务需配合 CDN 加速或本地节点优化。
- 成本需精细预算:GPU 价格随型号与用量波动大,长周期训练任务需提前规划资源与预算,避免费用失控,可参考 云成本控制。
- 面向专业用户:计费、编排与网络配置偏技术化,对缺乏 GPU 与 Kubernetes 运维经验的团队存在一定的上手门槛。
适用场景
- AI / 大模型训练(★★★★★):大规模 H100/A100 集群与高速互联,适合 大模型预训练与微调。
- AI 推理与模型部署(★★★★):托管 Kubernetes 与推理服务,适合将模型快速上线为在线服务。
- 云渲染 / 3D 可视化(★★★★):RTX GPU 实例按秒计费,适合云渲染农场与实时可视化。
- 通用业务网站(★★):通用计算服务少、美国节点为主,常规 云服务器场景建议选择更均衡的厂商。
价格参考
| 计费维度 | 说明 |
|---|---|
| GPU 实例 | 按秒计费,价格随 H100/A100/RTX 型号与配置浮动 |
| Kubernetes | 集群管理免费,仅按底层计算与存储资源计费 |
| 存储 | 按容量与吞吐计费,AI 专用文件系统按需配置 |
| 裸金属 GPU | 包月或按需,面向长时间稳定负载 |
注:CoreWeave 无免费 GPU 套餐,官网提供实例价格计算器;建议用 云服务器价格对比评估成本。
常见问题
-
CoreWeave 和传统云厂商的 GPU 实例有什么区别? CoreWeave 专为 GPU 计算优化,集群规模更大、按秒计费更灵活,且内置 Kubernetes GPU 调度;传统云 GPU 实例往往按小时计费、集群规模有限。可参考 GPU 云服务器对比。
-
CoreWeave 支持哪些 NVIDIA GPU? 主要提供 H100、A100、H200 与 RTX 系列,不同区域可用型号可能不同,建议在官网查看最新的实例规格。可参考 GPU 云服务器对比。
-
如何控制 GPU 云成本? 使用按秒计费的弹性实例、合理设置自动扩缩容、在非高峰时段释放闲置节点,并结合 云成本控制做预算规划。
-
CoreWeave 在中国大陆访问快吗? 数据中心主要位于美国,国内访问延迟偏高,建议搭配 CDN 加速或选择亚太节点云厂商用于面向国内用户的服务。
-
没有 GPU 经验能用 CoreWeave 吗? 可以,但建议先从托管 Kubernetes 与官方示例镜像入手,避免直接面对复杂的 GPU 调度与网络配置。可参考 Kubernetes 部署入门。