算力支持
华明平台通过多种算力来源为用户提供模型服务。我们根据模型规模、服务地域、合规要求和业务稳定性,组合使用自建集群、合作机房、海外机房、云厂商资源和自营部署资源。

平台会根据模型和服务的实际情况进行资源调度。下文介绍的是算力来源和部署方向,具体可调用的模型、地域、配额和服务状态以平台当前页面及服务协议为准。
一、国内自建与合作机房算力
华明在国内建设自有算力,并与业内头部 IDC 机房合作部署开源算力。这部分资源主要用于运行开源模型,配备 H20、H200、B300 等 GPU 服务器:
- H20、H200 主要承担常规推理、并发服务和模型适配任务;
- B300 用于部署参数规模更大的模型,为高负载推理提供更充足的显存和吞吐能力;
- 自建和合作机房资源统一纳入平台的服务调度、监控和容量管理。
二、海外机房算力
受资源供给和相关政策影响,国内部分机器资源可能阶段性紧张。为保障部分服务的连续性,华明租用海外机房算力提供服务,主要用于 Kimi3 类大参数模型及其他适合海外部署的模型。
海外资源的可用地域、模型范围和服务方式会结合实际业务、网络条件及适用要求进行配置。涉及跨境使用时,用户应确认其业务和数据处理安排符合适用的法律法规、合同和内部合规要求。
三、海外云厂商算力
目前,部分非公开模型由华明海外控股公司和合作单位采购,并通过合规途径向海外用户提供。对于未在中国境内备案的模型,平台不提供面向中国境内的服务。
这类资源通常按模型授权范围、用户所在地域和供应方要求进行隔离与路由。具体服务范围以模型页面、订单或双方书面约定为准。
四、国内大型云厂商机房算力
华明与国内大型云厂商签约,租用其机房和 GPU 资源,用于扩充平台的弹性容量、提升服务可用性,并支持部分模型的稳定运行。
云厂商资源与平台自有资源统一进行服务编排。平台会结合模型类型、负载情况和可用容量安排部署,减少单一资源来源对服务连续性的影响。
五、自营算力
针对小型集群、特殊模型或有专门部署要求的用户,华明也提供自营算力方案。相关资源可以是小规模 GPU 集群,也可以是为特定模型单独部署的算力节点,用于适配以下场景:
- 特殊模型或定制推理环境;
- 对部署位置、网络隔离或访问策略有明确要求的业务;
- 需要独立容量、专属调度或专项技术支持的用户。
自营算力的资源规模、部署方式和服务边界会根据用户需求单独评估。
服务说明
不同算力来源在模型可用性、网络路径、容量和服务地域上可能存在差异。华明会持续进行资源监控和调度,并在资源变更或模型供应方调整时更新服务安排。用户在选择模型和发送数据前,应结合业务敏感程度、数据所在地域和适用的合规要求进行评估。