Pricing / GPU / Inference
六条可独立交付的能力,也可按项目组合。
On-demand
按 token 计费。
Dedicated
延迟与吞吐可控。
GPU
H100 / H200。
Fine-tune
SFT 与偏好优化。
Eval
回归与安全套件。
Support
SLA 与驻场。