Token导航 LogoToken导航TokenDH.com

AI 算力服务商与 GPU 云平台名单

先看算力形态,再挑 AI算力服务商

收录国内外 AI 算力相关服务商,覆盖公有云 GPU、自助 GPU、智算平台、推理云、科研超算和算力基础设施。

先按业务形态筛,再决定是挑租卡平台、推理平台,还是企业智算与基础设施。

已收录服务商

79

有公开价格

38

国内平台

40

推理云全球

Cerebras Cloud

Cerebras Cloud 更偏专用训练云和高速推理云,不是通用 GPU 云路线。

服务类型

专用训练云 / 高速推理云

适合场景

需要专用训练云、差异化芯片架构和高速推理云的团队。

完整度

A

公开卡型

Cerebras 专用加速器 / 高速推理集群

计费与起租

按调用量 / 项目制

按调用或分钟级起

能力标签
专用训练云/推理云/专用芯片
价格与交付部分公开

API / 托管推理实例 · 在线推理 / API 服务

公开价格链接出海团队
企业科研容器API推理
推理云全球

GroqCloud

GroqCloud 更偏低延迟推理云,是专注推理效率的平台,不是通用 GPU 云。

服务类型

低延迟推理云

适合场景

需要低延迟推理云和非通用 GPU 路线推理能力的团队。

完整度

B

公开卡型

Groq LPU / 专用推理加速器

计费与起租

按调用量 / 按配额/套餐

按调用或分钟级起

能力标签
推理云/低延迟/LPU
价格与交付需咨询

API / 托管推理实例 · 在线推理 / API 服务

出海团队
个人企业容器API推理
推理云全球

Together AI

Together AI 同时强调推理服务和 GPU compute 底座,适合开放模型和工程化推理场景。

服务类型

Serverless Inference / GPU 基础设施

适合场景

需要开放模型推理、Serverless GPU 和 GPU 集群支撑的团队。

完整度

A

公开卡型

L40S / A100 / H100/H200

计费与起租

按调用量 / 按实例计费

按调用或分钟级起

能力标签
推理云/GPU 集群/开放模型
价格与交付需咨询

API / 托管推理实例 · 在线推理 / API 服务

出海团队
个人企业容器API推理多卡/集群
推理云全球

Baseten

Baseten 更偏生产级 Dedicated Inference 和模型服务平台,不是底层租卡平台。

服务类型

Dedicated Inference / 模型服务平台

适合场景

需要生产级专用推理部署和跨云自动扩缩容的团队。

完整度

A

公开卡型

L4/L40S / A100 / H100

计费与起租

按实例计费 / 合同计费

按调用或分钟级起

能力标签
推理云/专用部署/模型服务
价格与交付需咨询

API / 托管推理实例 · 在线推理 / API 服务

出海团队
企业容器API推理
推理云全球

Modal

Modal 更偏 Serverless GPU 与 AI 运行时,不是传统租卡平台,而是开发者工作负载平台。

服务类型

Serverless GPU / AI 运行时平台

适合场景

需要 Serverless GPU、Python 运行时和工程化 AI 工作负载平台的团队。

完整度

A

公开卡型

T4/L4 / A10/A100 / H100

计费与起租

按秒/分钟计费 / 按调用量

分钟级起

能力标签
Serverless GPU/Python runtime/按秒计费
价格与交付需咨询

API / 托管推理实例 · 在线推理 / API 服务

出海团队
个人企业容器API推理
推理云全球

Replicate

Replicate 更偏模型运行与托管推理平台,不是底层 GPU 云,但与 AI 算力消费高度相关。

服务类型

模型运行平台 / GPU 托管推理

适合场景

需要快速调用模型、按次运行和托管推理能力的团队。

完整度

A

公开卡型

T4/L40S / A100 / H100

计费与起租

按调用量 / 按运行时长

按调用起

能力标签
模型运行/GPU 托管/推理
价格与交付部分公开

API / 托管推理实例 · 在线推理 / API 服务

公开价格链接出海团队
个人企业容器API推理
推理云国内 / 海外

PPIO

PPIO 更适合归到分布式算力和推理云分类,而不是传统 GPU 云。

服务类型

分布式 GPU / 推理云

适合场景

需要分布式算力和推理云能力的团队。

完整度

C

公开卡型

RTX 4090 / A100/H100 / 分布式 GPU 池

计费与起租

按调用量 / 按实例计费

按调用或分钟级起

能力标签
分布式算力/推理云/全球部署
价格与交付部分公开

API / 分布式 GPU 池 · 在线推理 / 边缘推理

出海团队
个人企业容器API推理
推理云全球

GMI Cloud

GMI Cloud 更偏推理云与 Dedicated GPU,兼顾训练与推理但以 AI 原生交付为主。

服务类型

AI 原生推理云 / GPU 基础设施

适合场景

需要专注推理云、Dedicated GPU 和 AI 原生交付的团队。

完整度

A

公开卡型

L40S / A100 / H100/H200

计费与起租

按调用量 / 按实例计费

按调用或分钟级起

能力标签
推理云/Dedicated GPU/NVIDIA
价格与交付需咨询

API / 托管推理实例 · 在线推理 / API 服务

出海团队
企业容器API推理
推理云全球

Exabits Cloud

Exabits Cloud 的 API 型算力平台特征明显,适合放在 GPU API 与推理型算力服务商分类里。

服务类型

GPU Cloud / GPU API

适合场景

需要 GPU API、Bare Metal 和 API 型算力平台的团队。

完整度

B

公开卡型

L40S / A100 / H100/H200

计费与起租

按 API 调用 / 按实例计费

按调用或分钟级起

能力标签
GPU API/VM/Bare Metal
价格与交付需咨询

API / 托管推理实例 · 在线推理 / API 服务

出海团队
企业科研裸金属容器API推理
推理云全球

SambaNova Cloud

SambaNova Cloud 同时支持云端服务和本地 / 自建交付,更偏推理云与企业平台。

服务类型

AI API / 推理云 / 自建 AI 云底座

适合场景

需要推理云和企业自建 AI 云底座路线的团队。

完整度

B

公开卡型

SambaNova 专用加速器 / 推理节点 / 企业集群

计费与起租

按调用量 / 套餐/项目制

按调用或分钟级起

能力标签
AI API/推理云/自建云
价格与交付部分公开

API / 托管推理实例 · 在线推理 / API 服务

公开价格链接出海团队
企业容器API推理
已展示全部 10 个服务商