GPU 裸金属
整机独享,不做虚拟化,不和其他用户拼卡。系统镜像、CUDA 版本、驱动按你的要求预装好,从下单到能 SSH 进去,一般不超过 2 小时。
- 整机 8 卡,显存不切片
- root 权限,可自行装内核模块
- 支持自定义镜像与批量部署
欧博官网是欧博算力对外唯一的官方站点。我们从 2019 年开始做 GPU 服务器托管,现在在乌兰察布、张北、廊坊、中卫四个自营节点运营 2,640 台机器。 不做虚机、不超卖,一台机器插几张卡就是几张卡。大模型训练、推理部署、三维渲染、CPU 批处理,用多少小时付多少小时的钱, 账单明细按天出,随时能对。
不是把所有机器混在一起卖。训练、推理、渲染、批处理对网络、显存、电源的要求完全不同,我们从一开始就按用途分机型、分机柜、分网络区域。
整机独享,不做虚拟化,不和其他用户拼卡。系统镜像、CUDA 版本、驱动按你的要求预装好,从下单到能 SSH 进去,一般不超过 2 小时。
千卡规模 RDMA 组网,节点间 200G 或 400G InfiniBand,后端配并行文件系统。适合从零预训练、全量微调这类要连续跑几周的任务。
按并发和 QPS 弹性配卡,白天高峰多开、夜里缩容。vLLM、TensorRT-LLM、TGI 这些主流框架我们运维都跑过,能直接帮你把环境搭起来。
L40S 和 RTX 系列整机,面向三维渲染、影视后期、云游戏和设计类云桌面。渲染高峰期按小时加卡,任务结束立刻释放。
双路 EPYC 9654,单机 192 核,配 1.5TB 内存。用在数据清洗、特征工程、生信比对、批量转码这些不需要显卡的环节上,比拿 GPU 跑划算得多。
分布式对象存储 100TB 起步,内网流量不计费。需要和自有 IDC 打通的话,可以拉专线做混合组网,数据不出内网。
下表是当前四个节点都在跑的六种主力机型。价格随节点、租期和采购批次浮动,以最终合同为准。需要其他型号可以单独提,我们能帮着找货。
| 机型代码 | 加速卡 | 单机显存 | 整机功率 | 卡间互联 | 节点网络 | 计费单位 |
|---|---|---|---|---|---|---|
| OB-H800-8 | H800 80G × 8 | 640 GB | 8.0 kW | NVLink | 400G IB | 按卡 · 小时 |
| OB-A100-8 | A100 80G × 8 | 640 GB | 6.5 kW | NVLink | 200G IB | 按卡 · 小时 |
| OB-A800-8 | A800 80G × 8 | 640 GB | 6.5 kW | NVLink | 200G IB | 按卡 · 小时 |
| OB-L40S-8 | L40S 48G × 8 | 384 GB | 5.2 kW | PCIe 4.0 | 100G 以太 | 按卡 · 小时 |
| OB-4090-8 | RTX 4090 24G × 8 | 192 GB | 4.5 kW | PCIe 4.0 | 100G 以太 | 按卡 · 小时 |
| OB-CPU-9654 | 无(纯 CPU) | — | 1.2 kW | — | 25G 以太 | 按台 · 小时 |
说明:整机功率为满载实测值,含 CPU、内存、硬盘与风扇功耗,不含机柜级制冷分摊。四节点均提供整机独享与多机集群两种交付方式, 最小起租时长 1 小时,长期租赁可锁定价格。存储、公网带宽、专线按实际用量单独结算。
算力成本里电费占大头,所以选址基本决定了单价。我们把四个节点的电价、PUE 和机柜数量都列出来,你可以自己算哪边更合适。
四个节点之间通过专线互联,可以把训练数据和推理服务分开放,训练跑在电价低的中卫或乌兰察布,推理部署放在离用户更近的廊坊。 需要跨节点组网的话,我们在方案阶段会一起算清楚带宽成本。
常规配置走完这套流程大概一到三个工作日。如果你已经有现成的镜像和脚本,当天开通当天能跑起来也很常见。
说清模型规模、数据量、预算范围和期望上线时间。不用写正式文档,电话里讲明白就行。
48 小时内给出配置清单、节点建议和报价单,把电费、带宽、存储拆开列清楚,不含糊。
2 小时到 3 个工作日,取决于规模和是否要定制镜像。开通后给 root 权限和 IP 清单。
帮你把训练脚本跑通,测一下实际吞吐和卡间通信效率,达不到预期就调整拓扑或换机型。
按小时出账单,随时可查明细。7×24 值班,硬件故障 15 分钟响应,4 小时内给出处理方案。
欧博算力2019 年在北京朝阳注册,最早只有一台二手服务器,放在朋友公司的机柜里, 转租给几个做深度学习的学生跑实验。那时候国内做 GPU 算力租赁的还没几家, 我们连报价单都是手写的。
2021 年在乌兰察布租下第一个自建机房,从 40 架机柜做起;2023 年张北和中卫节点陆续上线; 2024 年廊坊节点投运,主要是给需要低延时的推理业务用。到 2026 年, 四个节点合计 940 架机柜,在运营 GPU 服务器 2,640 台。
团队现在 68 人,其中运维 31 人、网络工程 9 人、售前与方案 12 人,剩下的是财务、法务和行政。 我们不做销售提成制,售前工程师的收入和客户续费率挂钩,不是和签约金额挂钩。 这样他们在给你配机器的时候,会考虑你三个月后是不是还觉得划算。
欧博官网(就是这个站点)是欧博算力唯一的官方信息出口。我们没有二级代理, 所有报价单都有统一编号,可以在官网上核对。凡是打着"欧博"名义在外面单独收钱的,都不是我们的渠道。
出于合同约定,我们不公开客户名称。下面按需求类型分了四类,是过去两年里占比最高的几种情况。
典型的用法是几十卡到一百多卡的集群,连续跑两到六周做模型预训练或者大规模实验。这类用户对卡间通信效率最敏感,我们一般建议直接上 H800 加 400G IB 的整柜方案,而不是把机器分散在不同机柜里。数据量大的时候,并行文件系统比本地盘更省事。
常见的是训练和推理混着用:白天跑推理服务,夜里把卡切回来做微调。我们会在同一批次里预留可切换的机型,让一套机器在两种用途之间调整,不用来回搬数据。这类客户通常对账单明细要求比较细,按小时出账正好对得上他们的成本核算。
渲染需求有明显的波峰波谷,平时用不了几张卡,赶项目的时候恨不得一夜之间多出几十张。这类用户一般走 L40S 整机,按小时计费,项目结束当天就释放。素材盘可以挂在共享存储上,多个渲染节点同时读同一份工程文件。
这两类业务其实很多环节不需要显卡,但特别吃 CPU 核数和内存带宽。用双路 EPYC 的高密度机型跑批处理,成本比拿 GPU 服务器硬扛低不少。基因组比对、回测计算这类任务,一跑就是一整夜,按台按小时结算反而更灵活。
下面这些是售前被问得最多的。没找到答案的,打 010-8888 6666,或者用页面底部的表单留言。
把你的需求简单说一下就行:大概要多少卡、准备跑什么任务、什么时候要上线。售前工程师会在工作日两小时内回复。
北京市朝阳区酒仙桥路 6 号院 欧博算力大厦 B 座 9 层(地铁 14 号线将台站 A 出口,步行约 8 分钟)
售前咨询:010-8888 6666(工作日 9:00–18:30)
运维值班:400-888-6666(7×24 小时)
售前与方案:sales@oubo-compute.com
技术支持:support@oubo-compute.com
售前咨询:工作日 2 小时内回复
硬件故障:7×24 值班,15 分钟内响应
填写后售前工程师会在工作时间与你联系。表单不会存入任何第三方系统,也不会把你的联系方式转给其他人。