4ROUTER / 资源与服务

计算、训练与基础设施。

从一张 GPU 到整个集群,按工作负载选择资源。先了解计算成本,再确定配置、交付与服务范围。

沟通资源需求

按工作负载规划

GPU 计算

从显存需求与任务时长开始,规划适合推理、训练和批处理的配置。

4Router 资源价格美元 / GPU·小时
GPU 计算
GPU 型号显存单价选择
24 GB$0.74 / h
32 GB$0.99 / h
48 GB$1.09 / h
80 GB$1.59 / h
80 GB$3.49 / h
141 GB$4.59 / h
180 GB$6.79 / h

GPU 单价按卡时列示。CPU、系统内存、网络与工程服务另行报价;资源配置与可用性在开通前确认。

计费单位与费用范围

GPU 以美元 / GPU·小时标价,费用估算为单价 × GPU 数量 × 运行小时。存储以美元 / GB·月标价,按容量与使用期间计算。

GPU 与存储分别计价。CPU、系统内存、网络、集群互联及工程服务按具体配置和交付范围报价。开通前确认可用资源、计费周期与结算安排。

把实例配齐

CPU 与内存, 随任务一起配置。

数据加载、预处理与模型运行对主机资源的要求不同。CPU、系统内存和网络根据 GPU 配置及工作负载单独报价。

CPU

为预处理、数据供给与调度确定核心数。

按所需配置报价

系统内存

结合模型加载、数据集和缓存需求配置。

按所需配置报价

网络与互联

根据数据吞吐与多节点通信确定方案。

按所需配置报价

4ROUTER / 系统研究

容量规划:先算 KV,再选资源

理解算子、KV 状态与调度怎样共同决定一条推理路径。

在 Resources 中阅读系统笔记
STATE / CAPACITY

KV cache:从张量形状到容量预算

上下文长度是一个随并发增长的状态预算。

TIERS / TRANSFER

LMCache:把 KV 状态放进存储层级

少算一次 prefill,要先付一次状态访问的成本。

SCHEDULING / SLO

从 Prefill 到 Decode:调度的实验设计

提升吞吐时,仍要知道谁在等待。

保留数据与状态

存储

把数据集、检查点与运行环境的存储成本单独规划。

网络存储

低于 1 TB 的网络存储容量

$0.07 / GB·mo

容器磁盘

用于运行环境的容器磁盘空间

$0.10 / GB·mo

以上为存储容量单价,与 GPU 费用分别计算。网络传输另行报价;具体存储类型、容量与区域在开通前确认。

从资源到交付

基础设施之外, 还有把它用好的工程。

按交付范围规划服务,让模型、系统与运行环境一起工作。

模型 / 数据 / 评测

训练与调优

从微调与对齐,到算子和推理性能优化。围绕目标模型、数据与评测口径约定工作范围。

按项目范围报价了解服务范围

计算 / 互联 / 调度

GPU 集群与 HPC

硬件选型、组网、部署、调度与监控。结合集群规模、互联和运维边界确认方案。

按项目范围报价了解服务范围

环境 / 权限 / 交付

私有化部署

在你的环境中部署模型与服务。从裸机到可调用端点,明确数据、权限与交付边界。

按项目范围报价了解服务范围

模型网关

使用托管模型接口?

网关接入按请求结算,与 GPU 资源规划采用不同口径。

查看网关接入
查看网关计费口径

上游实际成本 × 账户约定倍率 → 单次计费额

账户倍率在开通时约定,每条记录保留当时生效的值。使用十进制运算并按 HALF_UP 舍入至小数点后 8 位;非零上游成本的计费额最低保留 0.00000001 美元。

按 request_id 关联用量、路由决策与账本,余额和额度在执行前检查。

从工作负载开始

告诉我们, 你想运行什么。

模型与数据规模、预期时长、部署环境和交付目标,是确定方案的起点。我们与你确认资源配置及服务范围。

ops@4router.cn发送资源需求