进入登录入口
GPU 实例规格对照

算力套餐与规格:kaiyun网页登录 的 GPU 资源与计费对照

把显存、核数、内存和计费口径摊在一张表里,按推理、微调或训练任务直接对口选择,登录后即可在控制台创建实例。

五类实例族覆盖推理与训练 按小时与包周期两种口径 释放前二次确认提示
kaiyun网页登录 算力套餐与规格对照界面示意
5 类
实例族可选
15 分钟
按小时实例最小计费粒度

按任务类型对照 GPU 算力与显存配置

表中的显存、核数与内存为规格区间,实际可售配置以登录后控制台显示的余量为准。选型时先看模型规模,再看并发量。

实例类型 显存 vCPU / 内存 适用任务 计费口径
入门推理型 16 GB 级 8 核 / 32 GB 轻量接口服务、图像分类、演示环境 按小时
通用计算型 24 GB 级 16 核 / 64 GB 模型微调、批量推理、数据处理 按小时 / 按天
高显存推理型 48 GB 级 24 核 / 128 GB 长上下文推理、语音合成、多路并发 按小时 / 按天
大模型训练型 2 × 80 GB 级 48 核 / 256 GB 预训练微调、多模态训练 按天 / 包周期
多卡并行型 4 × 80 GB 级 96 核 / 512 GB 分布式训练、渲染批处理、长周期任务 包周期 / 按需咨询

入门推理型

轻量接口服务与演示环境

显存
16 GB 级
vCPU / 内存
8 核 / 32 GB
计费口径
按小时

适合图像分类、单路接口调用与功能验证,配置简单,用完即释放。

通用计算型

模型微调与批量推理

显存
24 GB 级
vCPU / 内存
16 核 / 64 GB
计费口径
按小时 / 按天

兼顾显存与核数,适合中小规模微调任务和夜间批量推理作业。

高显存推理型

长上下文与多路并发

显存
48 GB 级
vCPU / 内存
24 核 / 128 GB
计费口径
按小时 / 按天

单卡容纳更大模型或更长上下文,语音合成与多路并发场景更稳妥。

大模型训练型

预训练微调与多模态训练

显存
2 × 80 GB 级
vCPU / 内存
48 核 / 256 GB
计费口径
按天 / 包周期

双卡并行配高内存,适合多模态训练与需要较长训练窗口的任务。

多卡并行型

分布式训练与长周期作业

显存
4 × 80 GB 级
vCPU / 内存
96 核 / 512 GB
计费口径
包周期 / 按需咨询

面向高吞吐分布式训练与渲染批处理,可按排期锁定资源周期。

把关键参数摊开看,规格选择不再靠猜

下面几个数字来自控制台与运维记录,用于说明资源交付与计费的基本口径,具体数值会随实例类型和区域变化。

15分钟
按小时实例的最小计费粒度,不足一个粒度按一个粒度结算。
5
实例族覆盖单卡推理到四卡并行,按任务规模逐级选配。
1个面板
实例、镜像、数据盘与账单明细集中在同一控制台查看。
7×24小时
工单与在线客服通道常开,提交任务描述可获选型参考。

计费口径与资源释放规则一次说清

先把结算方式确定下来,再决定实例开多久,账单就不会超出预期。

01

按小时结算,适合调试与波动负载

实例创建后按运行时长累计,不足最小计费粒度按一个粒度结算。临时跑一次推理压测或者调试环境,用这种方式最省。

按小时
02

按天结算,适合连续多日的作业

训练任务通常跨夜运行,按天结算比按小时更划算。过程中可以停机保留数据盘,需要时再开机继续。

按天
03

包周期锁定资源,适合长期稳定服务

线上推理服务需要稳定算力时,可以按周期锁定实例,避免高峰期资源被占用。周期与规格组合可在控制台按需调整。

包周期
04

释放前先做快照,数据不跟着实例走丢

释放实例时系统盘与随实例创建的数据盘会一并清除,控制台会在操作前给出二次确认。重要数据建议先写入独立数据盘或做一次快照。

释放提示

关于算力套餐的常见问题

下面几条是选型阶段问得最多的内容,如果还有别的疑问,可以在底部提交联系方式。

先按模型权重的参数规模估算基础占用,再为单次推理的中间激活值预留三成左右的余量。批量并发调高时,余量要同步上调。拿不准就把模型大小和并发量发给在线客服,由值班工程师给出匹配的显存档位。

按小时实例适合调试、短周期任务和波动明显的推理服务,不足最小计费粒度时按最小粒度结算。包周期适合持续运行超过一周的稳定负载,单价更低,但中途退订按未使用时长折算。两类实例都可以在控制台随时查看用量明细。

系统盘跟随实例规格,数据盘支持在线扩容,扩容后文件系统需要在实例内执行一次扩展操作。数据集较大时建议单独挂载数据盘,便于实例释放后保留数据。实例快照也可以把当前磁盘状态留存下来,用于后续克隆或恢复。

随实例一起释放的系统盘和数据盘会在确认释放后清除,控制台会在操作前给出二次确认提示。已经把数据写入独立数据盘的,不受实例释放影响。建议在释放前先做一次快照,需要时按快照恢复。

拿不准选哪档,把任务描述发给我们

写清模型规模、并发量和计划运行时长,值班工程师会给出显存档位与计费口径的匹配建议,你也可以直接登录控制台查看实时可售规格。

提交后仅用于本次选型沟通,不会用于其他用途。