Yunkai API Gateway

统一入口,
连接每一次 智能调用

一个 OpenAI 兼容端点管理全部大模型流量。路由、鉴权、限流、计量与审计在网关层一次完成,业务侧只管调用,不用关心模型在哪里。

40+纳管模型端点
99.99%网关可用性目标
ms 级秒级限流精度
0 行切换模型改动量
yunkai-gateway · v1/chat/completions
# 同一个端点,按需路由到任意模型 curl https://gw.yunkai.tech/v1/chat/completions \ -H "Authorization: Bearer $YUNKAI_KEY" \ -d '{ "model": "route:auto", "messages": [{"role":"user","content":"总结一下本周经营数据"}], "fallback": ["qwen-max","deepseek-v3"] }'
200 OK · 168ms 路由 → qwen-max tokens: 1,284 限流配额: 剩余 82%
Core Capabilities

把模型调用的复杂性,收进网关一层

每一次请求都会经过完整的治理链路,稳定、可控、可核算。

多模型统一路由

按成本、质量、时延策略智能路由,主模型异常自动切换备用模型,调用方无感知。

密钥与凭证管理

API Key 分团队签发,支持过期、轮换与最小权限范围,上游模型密钥集中托管不外泄。

限流 · 熔断 · 降级

秒级配额控制,异常率超阈值自动熔断并降级到缓存或轻量模型,保护下游也保护预算。

用量计量与账单

Token 级计量精确到应用与部门,自动生成成本账单与配额消耗预警。

内容安全护栏

请求与响应双向内容检测,敏感信息自动脱敏,审计日志留存每一次调用。

灰度与 A/B 实验

按流量比例在新旧模型之间灰度切换,质量指标对比看板辅助决策。

Request Pipeline

一次请求的完整治理旅程

从调用方到模型集群,请求在网关内完成五道治理工序,全程可观测。

CALLER 调用方应用 Web / App / 服务端 API GATEWAY · 治理层 ① 鉴权认证 Key 校验 · 权限范围 ② 限流配额 QPS · Token 预算 ③ 智能路由 策略 · 灰度 · 降级 ④ 内容安全 双向检测 · 脱敏 · 拦截 ⑤ 计量审计 Token 计费 · 全量日志 MODEL · 公有云 通义 / DeepSeek / Kimi / GLM MODEL · 私有化 企业自部署推理集群 FALLBACK · 兜底 缓存应答 / 轻量模型
Scenarios

三类典型客户,同一个入口

SCENE 01

SaaS 产品内嵌 AI

软件厂商在自己的产品中嵌入 AI 能力,通过网关按租户隔离配额与计费,终端用户规模增长也不担心模型账单失控。

SCENE 02

企业多模型治理

集团内部多个部门各自调用不同模型,网关统一收口后,密钥、预算、安全策略集中管理,成本一目了然。

SCENE 03

存量系统 AI 化改造

老系统不改代码,只需把请求指向网关端点,即可获得模型能力与全套治理,改造项目从月级缩短到周级。

99.99%网关可用性目标
5请求治理工序
0模型切换代码改动
100%调用日志可审计

十分钟内,接入你的第一个模型端点

试用环境默认包含完整的治理链路与监控看板,技术团队可即刻开始联调。

获取试用 API Key 了解综合平台