速览:六大 AI 网关横向对比
资料核对截至 2026-07-23。「—」表示截至该日期未在官方公开资料中确认,不等同于“不支持”。
| 能力 | AISIX | Higress | One API | New API | LiteLLM | Portkey |
|---|---|---|---|---|---|---|
| 基础 | ||||||
| 开源协议 | Apache-2.0 | Apache-2.0 | MIT | AGPLv3(含第 7 节附加条款) | MIT | MIT(网关) |
| 实现语言 | Rust | Go(Envoy/C++ 内核) | Go | Go | Python | TypeScript |
| 部署形态 | 自托管(数据面在你的 VPC) | 自托管 + 阿里云托管 | 自托管 | 自托管 | 自托管 | 自托管 + 托管平台 |
| 推理内容留在自有网络 | 仅使用私有模型与护栏端点时 | 仅使用私有模型与护栏端点时 | 仅使用私有模型端点时 | 仅使用私有模型端点时 | 仅使用私有模型端点时 | 自托管数据面且仅使用私有端点时 |
| 路由与流量 | ||||||
| 统一接口 | OpenAI + Anthropic 双向 | OpenAI + Claude 自动识别 | OpenAI 兼容 | OpenAI / Claude / Gemini 互转 | OpenAI 兼容 | OpenAI 兼容 |
| 模型与提供商接入方式 | 主流提供商集成 + OpenAI 兼容上游 | 多家提供商集成 + OpenAI / Claude 协议兼容 | 多渠道 + OpenAI 兼容 | 多渠道 + OpenAI / Claude / Gemini 等接口 | 广泛提供商集成 | 广泛模型目录与提供商集成 |
| 多模型负载均衡 / 重试 | ✓ | ✓ | ✓ | ✓ | ✓ | ✓ |
| 语义路由 | ✓ | ✓(意图识别) | — | — | — | —(规则) |
| 成本 / 延迟感知路由 | ✓ | 部分(自建推理负载感知) | — | — | ✓ | — |
| 模型合议(ensemble) | ✓ | — | — | — | — | — |
| 缓存 | 精确(语义缓存:企业版) | 语义 + 精确 | — | 缓存计费 | 语义 + 精确 | 语义(企业版) |
| 治理与成本 | ||||||
| 令牌限流 / 额度 / 预算 | ✓ | ✓ | ✓ | ✓ | ✓ | ✓ |
| 计费 / 在线充值 | AISIX Cloud 预算 | —(Redis 额度) | 兑换码 | 按量 / 按次 + 在线支付 | 预算(开源) | 预算 |
| 提示词 / 响应护栏 | ✓(本地规则 + 多家审核后端) | ✓(对接阿里云内容安全) | — | — | 部分(PII) | ✓(20+) |
| MCP 网关 | ✓ | ✓ | — | — | ✓ | ✓ |
| 多租户(团队 / 角色 / 审计) | ✓(组织 / 团队 / 角色) | —(公开资料未确认多用户 / 多角色治理) | 用户 / 分组 | 用户 / 分组 | ✓(团队 / 虚拟密钥) | ✓(工作区) |
| SSO / SCIM | SSO:企业版;SCIM:未在公开资料中确认 | 未在公开资料中确认 | 未在公开资料中确认 | OIDC 登录;SSO / SCIM 未在公开资料中确认 | SSO / SCIM:企业版 | SSO / SCIM:企业版 |
| 管理界面 | AISIX Cloud 控制台 | Higress Console | Web 控制台 | 现代 UI + 数据看板 | Admin UI | 托管控制台 |
官方来源:AISIX 定价与能力 · Higress AI Proxy · One API 官方仓库 · New API 官方仓库与许可 · LiteLLM 官方定价 · Portkey Model Catalog
各网关简介
AISIX
由 Apache APISIX 原班团队打造的开源 AI 网关,Rust 单二进制、数据面完全 Apache-2.0,可部署在你自有的 VPC 内(仅出站连接)。实时推理流量由数据面直连所配置的模型与护栏上游,不经过 API7 控制面;内容是否离开 VPC 取决于所配置的上游,只有使用私有或自托管端点时才能留在自有网络。在统一网关上提供多模型路由与负载均衡(含加权 / 粘性灰度、成本 / 延迟 / 负载感知策略)、语义路由、模型合议(ensemble)、令牌预算与成本控制、提示词 / 响应护栏,以及用同一套密钥 / 团队 / 护栏治理的 MCP 网关。官方已发布性能基准:4 vCPU 下饱和吞吐约 28,300 req/s,低中负载下网关自身转发开销保持亚毫秒级。SSO 与语义缓存在企业版提供;SCIM 未在公开资料中确认。
适合:需要把网关数据面部署在自有基础设施内,并通过私有的模型与护栏端点控制数据驻留,同时需要企业级治理(语义路由、模型合议、护栏、MCP)的团队。
Higress
阿里巴巴开源的云原生 API 网关(Apache-2.0),内核基于 Istio 与 Envoy,AI 能力以 Wasm 插件形式提供:ai-proxy 统一多家模型提供商并自动识别 OpenAI / Claude 双协议,内置基于向量数据库的语义缓存、意图识别路由、token 级限流与 Redis 额度管理、REST-to-MCP 转换与 MCP 托管;提示词 / 响应内容安全护栏通过对接阿里云内容安全服务实现。面向自建推理(如 vLLM)提供全局最小请求 / 前缀感知 / GPU 感知负载均衡。同时覆盖 K8s Ingress、微服务网关与安全网关场景,阿里云提供托管版。
适合:已在阿里云 / K8s 体系内,想用同一个网关同时承担 Ingress、微服务与 AI 流量的团队。
One API
Go 编写、MIT 协议的「LLM API 管理 & 分发系统」(即自建 Token 中转站),把多家大模型统一到 OpenAI 兼容接口之后,提供令牌 / 额度 / 兑换码、多渠道负载均衡与失败重试、模型映射、用户与渠道分组倍率,自带 Web 控制台。轻量、协议宽松,适合做 Token 中转站。
适合:想要轻量、MIT 宽松协议,只需 OpenAI 兼容中转 + 基本计费与负载均衡的团队。
New API
在 One API 基础上二次开发的新一代分发网关,采用 AGPLv3,并包含第 7 节附加署名与原项目链接条款;不接受开源义务时,可联系项目方获取商业许可。相比 One API,它支持更多格式(Claude / Gemini 互转)与接口(Rerank、Midjourney、Suno、Embeddings),支持按量 / 按次 / 缓存计费与易支付 / Stripe 在线充值、令牌分组,UI 更现代并带数据看板,社区维护活跃。
适合:想要更全的格式 / 接口、在线支付充值与更现代 UI 的分发层,并能接受 AGPLv3 及附加条款的团队。
LiteLLM
Python 编写、MIT 协议,既是 SDK 也是代理,将广泛的提供商统一为 OpenAI 兼容接口。开源版即含语义缓存、虚拟密钥与预算、MCP 网关;SSO / SCIM 为企业版。以覆盖广度见长。
适合:想要广泛的提供商覆盖 + 轻量自托管,并需要开源预算 / 虚拟密钥的团队。
Portkey
TypeScript 开源网关(MIT)+ 托管控制面(商业、分层)。提供广泛的模型目录、20+ 原生护栏、MCP 网关与成熟的可观测 / 治理平台;语义缓存、SSO / SCIM、VPC 部署在企业版。
适合:想要托管的可观测与治理平台,并接受高级能力按档收费的团队。
小结
选型可以先看你需要「Token 中转」还是「治理」:One API、New API 是优秀的开源 Token 中转站(轻量、宽松协议选 One API;功能更全、在线支付与活跃维护选 New API);LiteLLM 覆盖广泛,Portkey 提供托管治理平台;Higress 适合已在阿里云 / K8s 体系内、想用同一个网关 覆盖 Ingress、微服务与 AI 流量的团队。
如果你更看重把网关数据面部署在自有网络,并希望通过私有的模型与护栏端点控制 数据驻留,同时需要语义路由、模型合议(ensemble)、提示词 / 响应护栏、MCP 网关等企业级治理,可以了解 AISIX AI 网关——由 Apache APISIX 原班团队打造,数据面完全 Apache-2.0,可在自有 VPC 内自托管。
深入对比
想看两个「API 网关团队做的 AI 网关」在架构、治理与控制台上的详细差异,请阅读 AISIX vs Higress 深入对比。
想看中文市场里最常被比较的两个 Token 中转站的详细差异,请阅读 One API vs New API 深入对比。

