入门推理型
轻量接口服务与演示环境
- 显存
- 16 GB 级
- vCPU / 内存
- 8 核 / 32 GB
- 计费口径
- 按小时
适合图像分类、单路接口调用与功能验证,配置简单,用完即释放。
表中的显存、核数与内存为规格区间,实际可售配置以登录后控制台显示的余量为准。选型时先看模型规模,再看并发量。
| 实例类型 | 显存 | vCPU / 内存 | 适用任务 | 计费口径 |
|---|---|---|---|---|
| 入门推理型 | 16 GB 级 | 8 核 / 32 GB | 轻量接口服务、图像分类、演示环境 | 按小时 |
| 通用计算型 | 24 GB 级 | 16 核 / 64 GB | 模型微调、批量推理、数据处理 | 按小时 / 按天 |
| 高显存推理型 | 48 GB 级 | 24 核 / 128 GB | 长上下文推理、语音合成、多路并发 | 按小时 / 按天 |
| 大模型训练型 | 2 × 80 GB 级 | 48 核 / 256 GB | 预训练微调、多模态训练 | 按天 / 包周期 |
| 多卡并行型 | 4 × 80 GB 级 | 96 核 / 512 GB | 分布式训练、渲染批处理、长周期任务 | 包周期 / 按需咨询 |
轻量接口服务与演示环境
适合图像分类、单路接口调用与功能验证,配置简单,用完即释放。
模型微调与批量推理
兼顾显存与核数,适合中小规模微调任务和夜间批量推理作业。
长上下文与多路并发
单卡容纳更大模型或更长上下文,语音合成与多路并发场景更稳妥。
预训练微调与多模态训练
双卡并行配高内存,适合多模态训练与需要较长训练窗口的任务。
分布式训练与长周期作业
面向高吞吐分布式训练与渲染批处理,可按排期锁定资源周期。
下面几个数字来自控制台与运维记录,用于说明资源交付与计费的基本口径,具体数值会随实例类型和区域变化。
先把结算方式确定下来,再决定实例开多久,账单就不会超出预期。
实例创建后按运行时长累计,不足最小计费粒度按一个粒度结算。临时跑一次推理压测或者调试环境,用这种方式最省。
训练任务通常跨夜运行,按天结算比按小时更划算。过程中可以停机保留数据盘,需要时再开机继续。
线上推理服务需要稳定算力时,可以按周期锁定实例,避免高峰期资源被占用。周期与规格组合可在控制台按需调整。
释放实例时系统盘与随实例创建的数据盘会一并清除,控制台会在操作前给出二次确认。重要数据建议先写入独立数据盘或做一次快照。
从登录流程到场景选型,几篇说明覆盖了最常见的几类疑问,读完再下单心里更有底。
下面几条是选型阶段问得最多的内容,如果还有别的疑问,可以在底部提交联系方式。
写清模型规模、并发量和计划运行时长,值班工程师会给出显存档位与计费口径的匹配建议,你也可以直接登录控制台查看实时可售规格。
提交后仅用于本次选型沟通,不会用于其他用途。