GPU算力租赁·AI模型训练·推理部署一站式服务。弹性扩容·按需付费·专业技术支持
按需选择·弹性扩容·即开即用
适合轻量AI推理、模型测试、API服务部署
适合模型微调、中等规模训练——性价比首选
适合大规模训练、分布式计算、多模态模型
一目了然选对算力
| 规格项 | 基础推理型 | 专业训练型 | 旗舰集群型 |
|---|---|---|---|
| GPU类型 | T4 / A10 | A100-80G | 8×A100-80G |
| 单卡显存 | 16GB | 80GB | 80GB×8 |
| 适用场景 | 推理·测试·API | 微调·中等训练 | 大模型训练·分布式 |
| 单次最大token | 4K | 32K | 128K |
| 数据集上限 | 10GB | 500GB | 5TB |
| 交付时间 | 分钟级 | 5分钟 | 30分钟 |
| 技术支持 | 工单 | 在线+工单 | 专属技术顾问 |
| 合同周期 | 按量 | 按量/月付 | 月付/年付 |
什么场景用什么配置——实测数据支撑
轻量推理负载,7B-13B参数模型推理,建议基础推理型即可满足
LoRA/QLoRA微调7B-70B模型,单卡A100即可覆盖大多数企业微调需求
从零训练百亿参数模型,需要分布式多卡集群+高速互联+海量存储
Stable Diffusion·Sora类模型推理,建议基础型+弹性扩容应对峰值
Embedding+向量检索+大模型生成,建议专业型满足向量库+推理双重负载
海量数据批量推理·评测·标注,按需短期租用旗舰集群跑完即释放
不只是卖算力,而是完整的AI基础设施服务
按需随时增减GPU资源,不浪费、不等待,分钟级交付
主流深度学习框架预装就绪——PyTorch·TensorFlow·JAX,开箱即用
训练数据独享存储,任务完成后数据彻底清除,满足企业合规要求
AI工程化团队7×24小时技术支持,模型调优·分布式训练指导
训练完成的模型可直接接入汇智工厂智能体,从训练到部署全链路
按量计费·无预付费·随时暂停,对比自建集群节省40%以上IT成本
三个维度确定算力方案
推理→基础型足够;微调→专业型;预训练→旗舰型
7B以下→基础型;7B-70B→专业型;70B+→旗舰型
实时→基础型+独享;批处理→旗舰型短期租用最经济
不确定该选哪种?联系技术顾问,根据您的具体模型和场景免费做算力评估。
算力即服务·标准化 API·三步接入
在算力控制台生成专属 API Token,用于鉴权和用量追踪。支持多Token·多项目隔离。
通过 API 提交训练脚本+数据集,系统自动分配GPU资源、启动训练容器,完成后通知回调。
部署模型为在线推理API,标准OpenAI兼容接口格式,零代码切换,毫秒级响应。
# 提交训练任务
curl -X POST https://os.zgscrh.com/api/compute/train \
-H "Authorization: Bearer YOUR_API_TOKEN" \
-H "Content-Type: application/json" \
-d '{"model":"llama-7b","dataset":"s3://my-bucket/data","gpu":"A100-80G","epochs":3}'
# 调用推理API(OpenAI兼容)
curl https://os.zgscrh.com/api/compute/infer/v1/chat/completions \
-H "Authorization: Bearer YOUR_API_TOKEN" \
-H "Content-Type: application/json" \
-d '{"model":"my-finetuned-model","messages":[{"role":"user","content":"你好"}]}'
实时GPU利用率·费用明细·任务日志
| 监控指标 | 基础型 | 专业型 | 旗舰型 |
|---|---|---|---|
| GPU利用率看板 | ✅ 实时 | ✅ 实时+历史 | ✅ 实时+历史+预测 |
| 费用明细 | ✅ 按小时 | ✅ 按任务 | ✅ 按任务+部门分摊 |
| 任务日志 | ✅ 最近7天 | ✅ 最近30天 | ✅ 永久保存 |
| 用量预警 | ✅ 余额预警 | ✅ 预算预警 | ✅ 多级预警+自动暂停 |
| 导出报表 | CSV | CSV+PDF | CSV+PDF+API |
| 专属控制台 | Web | Web+CLI | Web+CLI+API全量 |
选择合适的算力方案,我们将安排技术顾问对接