Meiju Gateway 1.0.0

美聚企业级 AI 网关

将已有模型推理服务变成可销售、可管控、可计量、可结算的标准 AI 服务。AIDC 使用自己的品牌和域名经营客户,美聚在本地完成网关与运营闭环。

本地部署请求、用量和账务数据不经美聚中心
OpenAI 兼容降低现有应用和 Agent 的接入成本
经营闭环客户、权限、用量、价格、账务与对账
两种交付标准单机版与 Kubernetes 集成版
产品价值

有推理服务,还不等于有一项能经营的 AI 服务

AIDC 通常已经具备 GPU、模型和推理端点,但要真正服务外部客户,还需要统一入口、客户身份、访问权限、稳定模型标识、计量计费和财务核对。美聚补齐的是这段产品与运营能力。

01

把异构上游变成稳定的对外模型

分别管理上游服务、上游模型和对外模型,隐藏不同厂商的 URL、凭证和模型命名差异。

02

把一次调用变成可追溯的经营记录

从 API Key 鉴权、模型权限、限流配额,到 token 用量、价格匹配、余额扣减和对账结果形成完整链路。

03

让客户自己完成日常使用

客户在白标门户中激活账户、自助创建和轮换 API Key、查看用量、余额与账单,管理员不代管客户密钥。

04

保留 AIDC 的品牌、客户与定价权

下游客户与 AIDC 建立交易关系;美聚提供软件产品,不转发模型流量,也不经手客户资金。

完整能力

覆盖从上游接入到客户结算的核心链路

这些能力运行在同一套产品中,数据语义一致,避免分别采购 API 网关、计量、账户和客户门户后再进行长期集成。

01 / 上游

上游服务与模型

以服务为核心管理端点和凭证引用,在服务下维护实际可用模型。

  • 上游凭证只保存 Secret Manager 引用
  • 上游服务与子模型独立启停
  • 保留上游原始模型标识
02 / 路由

对外模型与路由

对客户提供稳定模型 ID,并路由到一个或多个上游模型。

  • 故障切换、轮询和权重策略
  • 路由配置版本化发布
  • 配置发布前可查看完整快照
03 / API

统一模型 API

提供 OpenAI 兼容调用入口,便于应用和 Agent 复用现有 SDK。

  • Chat Completions 调用方式
  • SSE 流式响应
  • 一致的鉴权和错误边界
04 / 访问

客户与访问控制

按客户控制模型可见性、有效期及请求和 token 配额。

  • RPM、TPM、并发与总量限制
  • 客户自主管理 API Key
  • 账户冻结与关闭状态
05 / 定价

价格版本

将模型输入、输出 token 单价固化为可审计的生效版本。

  • 草稿、发布和历史版本
  • 按请求时间匹配有效价格
  • 避免事后改价污染历史账务
06 / 计量

用量与计费

采集请求结果、延迟和 token 数量,生成可追溯费用记录。

  • 输入与输出 token 分项计量
  • 用量事件可靠投递
  • 费用精度使用微单位
07 / 财务

账户与对账

围绕余额、充值和扣费形成账本,并持续检查账务一致性。

  • 资金操作可审计
  • 余额与账本核对
  • 差异定位和对账结论
08 / 门户

客户自助门户

客户完成账户激活、密钥管理、调用查看和账单查询。

  • AIDC 自有域名和品牌
  • API Key 创建、轮换与停用
  • 用量、配额、余额和账单
09 / 运营

管理控制台

管理员统一配置产品资源并查看经营和运行数据。

  • 角色化菜单和操作权限
  • 配置变更与审计记录
  • 调用量、成功率和收入视图
真实产品界面

管理员在一个控制台完成配置与运营

下面均为 Meiju Gateway 1.0.0 的实际界面,而非概念图。

管理控制台运营总览
运营总览关键客户、调用和收入指标集中呈现
适用场景

适合已经拥有推理能力、准备对外经营的组织

区域与政务 AIDC

面向本地政企客户提供模型 API,要求私有化、本地数据边界、自有品牌和清晰账务。

运营商与云服务团队

已有算力和客户渠道,需要快速补齐统一接入、客户权限、套餐配额与运营后台。

行业模型服务平台

聚合自营和合作方模型,为内部业务或行业生态提供稳定模型 ID、用量和成本核算。

选型判断

先确认产品边界,再决定是否使用

美聚交付的是 AI 网关与运营软件,不代替客户的数据中心平台和运维团队。

适合使用美聚

  • 已经有可访问的模型推理服务
  • 希望用自己的品牌和域名服务客户
  • 需要客户、权限、API Key、用量和账务闭环
  • 需要本地部署并保持模型请求不出域
  • 具备主机或 Kubernetes 基础运维能力

需要其他产品或配套能力

  • 需要美聚采购 GPU 或部署、训练、运维模型
  • 需要跨多个 AIDC 做统一算力调度
  • 希望由软件厂商承诺机房、网络或 Kubernetes SLA
  • 缺少数据库、备份、安全和故障值守能力
  • 需要 v1 之外的动态批发定价或自动退款
交付方式

同一套完整产品,两种部署入口

两种形式的功能边界一致,区别主要在底层平台、可用性责任和运维方式。

最快验证与小规模使用

标准单机版

在一台 AMD64 Linux 主机上通过 Docker Compose 运行完整产品栈,附带安装、检查、备份、恢复和升级工具。

  • 建议至少 4 核 CPU、8 GiB 内存
  • 客户负责 Docker、TLS、监控和异地备份
  • 单机故障会造成整体服务中断,不承诺高可用
接入现有企业平台

Kubernetes 集成版

通过 Helm Chart 部署应用组件,接入客户已有的数据库、Secret Manager、入口、监控与备份体系。

  • 适合已有成熟 Kubernetes 平台的客户
  • 客户负责平台组件的容量、可用性和 SLA
  • 可结合客户平台能力设计扩缩容与容灾
责任边界

软件交付与平台运维,各自有明确责任

美聚负责

版本化软件镜像、Compose 与 Helm 交付物、配置模板、数据库 migration、产品安装与升级说明、数据语义、产品验收方法和应用故障分析支持。

客户负责

主机与 Kubernetes、网络和 TLS、数据库与 Secret Manager、监控告警、备份介质、容量规划、安全策略、故障值守,以及最终的高可用和 SLA。

从交付包到第一次模型调用

按网页文档完成安装、首轮配置、配置发布和账务验证。

打开部署与使用文档