Yunkai API Gateway
统一入口,
统一入口,
连接每一次 智能调用
一个 OpenAI 兼容端点管理全部大模型流量。路由、鉴权、限流、计量与审计在网关层一次完成,业务侧只管调用,不用关心模型在哪里。
40+纳管模型端点
99.99%网关可用性目标
ms 级秒级限流精度
0 行切换模型改动量
# 同一个端点,按需路由到任意模型
curl https://gw.yunkai.tech/v1/chat/completions \
-H "Authorization: Bearer $YUNKAI_KEY" \
-d '{
"model": "route:auto",
"messages": [{"role":"user","content":"总结一下本周经营数据"}],
"fallback": ["qwen-max","deepseek-v3"]
}'
200 OK · 168ms
路由 → qwen-max
tokens: 1,284
限流配额: 剩余 82%
Core Capabilities
把模型调用的复杂性,收进网关一层
每一次请求都会经过完整的治理链路,稳定、可控、可核算。
多模型统一路由
按成本、质量、时延策略智能路由,主模型异常自动切换备用模型,调用方无感知。
密钥与凭证管理
API Key 分团队签发,支持过期、轮换与最小权限范围,上游模型密钥集中托管不外泄。
限流 · 熔断 · 降级
秒级配额控制,异常率超阈值自动熔断并降级到缓存或轻量模型,保护下游也保护预算。
用量计量与账单
Token 级计量精确到应用与部门,自动生成成本账单与配额消耗预警。
内容安全护栏
请求与响应双向内容检测,敏感信息自动脱敏,审计日志留存每一次调用。
灰度与 A/B 实验
按流量比例在新旧模型之间灰度切换,质量指标对比看板辅助决策。
Request Pipeline
一次请求的完整治理旅程
从调用方到模型集群,请求在网关内完成五道治理工序,全程可观测。
Scenarios
三类典型客户,同一个入口
SCENE 01
SaaS 产品内嵌 AI
软件厂商在自己的产品中嵌入 AI 能力,通过网关按租户隔离配额与计费,终端用户规模增长也不担心模型账单失控。
SCENE 02
企业多模型治理
集团内部多个部门各自调用不同模型,网关统一收口后,密钥、预算、安全策略集中管理,成本一目了然。
SCENE 03
存量系统 AI 化改造
老系统不改代码,只需把请求指向网关端点,即可获得模型能力与全套治理,改造项目从月级缩短到周级。
99.99%网关可用性目标
5道请求治理工序
0行模型切换代码改动
100%调用日志可审计