AI 网关对比 2026:该选哪个 LLM 网关?

从「Token 中转 + 计费」的 One API、New API,到带企业级治理的 AISIX、Higress、LiteLLM、Portkey,AI 网关的定位差别很大。本文按开源协议、模型与提供商接入方式、路由、缓存、护栏、MCP 与治理能力横向对比,帮你按需求选出更合适的一个。

最后更新:2026 年 7 月

速览:六大 AI 网关横向对比

资料核对截至 2026-07-23。「—」表示截至该日期未在官方公开资料中确认,不等同于“不支持”。

能力AISIXHigressOne APINew APILiteLLMPortkey
基础
开源协议

Apache-2.0

Apache-2.0

MIT

AGPLv3(含第 7 节附加条款)

MIT

MIT(网关)

实现语言

Rust

Go(Envoy/C++ 内核)

Go

Go

Python

TypeScript

部署形态

自托管(数据面在你的 VPC)

自托管 + 阿里云托管

自托管

自托管

自托管

自托管 + 托管平台

推理内容留在自有网络

仅使用私有模型与护栏端点时

仅使用私有模型与护栏端点时

仅使用私有模型端点时

仅使用私有模型端点时

仅使用私有模型端点时

自托管数据面且仅使用私有端点时

路由与流量
统一接口

OpenAI + Anthropic 双向

OpenAI + Claude 自动识别

OpenAI 兼容

OpenAI / Claude / Gemini 互转

OpenAI 兼容

OpenAI 兼容

模型与提供商接入方式

主流提供商集成 + OpenAI 兼容上游

多家提供商集成 + OpenAI / Claude 协议兼容

多渠道 + OpenAI 兼容

多渠道 + OpenAI / Claude / Gemini 等接口

广泛提供商集成

广泛模型目录与提供商集成

多模型负载均衡 / 重试

语义路由

✓(意图识别)

—(规则)

成本 / 延迟感知路由

部分(自建推理负载感知)

模型合议(ensemble)

缓存

精确(语义缓存:企业版)

语义 + 精确

缓存计费

语义 + 精确

语义(企业版)

治理与成本
令牌限流 / 额度 / 预算

计费 / 在线充值

AISIX Cloud 预算

—(Redis 额度)

兑换码

按量 / 按次 + 在线支付

预算(开源)

预算

提示词 / 响应护栏

✓(本地规则 + 多家审核后端)

✓(对接阿里云内容安全)

部分(PII)

✓(20+)

MCP 网关

多租户(团队 / 角色 / 审计)

✓(组织 / 团队 / 角色)

—(公开资料未确认多用户 / 多角色治理)

用户 / 分组

用户 / 分组

✓(团队 / 虚拟密钥)

✓(工作区)

SSO / SCIM

SSO:企业版;SCIM:未在公开资料中确认

未在公开资料中确认

未在公开资料中确认

OIDC 登录;SSO / SCIM 未在公开资料中确认

SSO / SCIM:企业版

SSO / SCIM:企业版

管理界面

AISIX Cloud 控制台

Higress Console

Web 控制台

现代 UI + 数据看板

Admin UI

托管控制台

官方来源:AISIX 定价与能力 · Higress AI Proxy · One API 官方仓库 · New API 官方仓库与许可 · LiteLLM 官方定价 · Portkey Model Catalog

各网关简介

AISIX

由 Apache APISIX 原班团队打造的开源 AI 网关,Rust 单二进制、数据面完全 Apache-2.0,可部署在你自有的 VPC 内(仅出站连接)。实时推理流量由数据面直连所配置的模型与护栏上游,不经过 API7 控制面;内容是否离开 VPC 取决于所配置的上游,只有使用私有或自托管端点时才能留在自有网络。在统一网关上提供多模型路由与负载均衡(含加权 / 粘性灰度、成本 / 延迟 / 负载感知策略)、语义路由、模型合议(ensemble)、令牌预算与成本控制、提示词 / 响应护栏,以及用同一套密钥 / 团队 / 护栏治理的 MCP 网关。官方已发布性能基准:4 vCPU 下饱和吞吐约 28,300 req/s,低中负载下网关自身转发开销保持亚毫秒级。SSO 与语义缓存在企业版提供;SCIM 未在公开资料中确认。

适合:需要把网关数据面部署在自有基础设施内,并通过私有的模型与护栏端点控制数据驻留,同时需要企业级治理(语义路由、模型合议、护栏、MCP)的团队。

Higress

阿里巴巴开源的云原生 API 网关(Apache-2.0),内核基于 Istio 与 Envoy,AI 能力以 Wasm 插件形式提供:ai-proxy 统一多家模型提供商并自动识别 OpenAI / Claude 双协议,内置基于向量数据库的语义缓存、意图识别路由、token 级限流与 Redis 额度管理、REST-to-MCP 转换与 MCP 托管;提示词 / 响应内容安全护栏通过对接阿里云内容安全服务实现。面向自建推理(如 vLLM)提供全局最小请求 / 前缀感知 / GPU 感知负载均衡。同时覆盖 K8s Ingress、微服务网关与安全网关场景,阿里云提供托管版。

适合:已在阿里云 / K8s 体系内,想用同一个网关同时承担 Ingress、微服务与 AI 流量的团队。

One API

Go 编写、MIT 协议的「LLM API 管理 & 分发系统」(即自建 Token 中转站),把多家大模型统一到 OpenAI 兼容接口之后,提供令牌 / 额度 / 兑换码、多渠道负载均衡与失败重试、模型映射、用户与渠道分组倍率,自带 Web 控制台。轻量、协议宽松,适合做 Token 中转站。

适合:想要轻量、MIT 宽松协议,只需 OpenAI 兼容中转 + 基本计费与负载均衡的团队。

New API

在 One API 基础上二次开发的新一代分发网关,采用 AGPLv3,并包含第 7 节附加署名与原项目链接条款;不接受开源义务时,可联系项目方获取商业许可。相比 One API,它支持更多格式(Claude / Gemini 互转)与接口(Rerank、Midjourney、Suno、Embeddings),支持按量 / 按次 / 缓存计费与易支付 / Stripe 在线充值、令牌分组,UI 更现代并带数据看板,社区维护活跃。

适合:想要更全的格式 / 接口、在线支付充值与更现代 UI 的分发层,并能接受 AGPLv3 及附加条款的团队。

LiteLLM

Python 编写、MIT 协议,既是 SDK 也是代理,将广泛的提供商统一为 OpenAI 兼容接口。开源版即含语义缓存、虚拟密钥与预算、MCP 网关;SSO / SCIM 为企业版。以覆盖广度见长。

适合:想要广泛的提供商覆盖 + 轻量自托管,并需要开源预算 / 虚拟密钥的团队。

Portkey

TypeScript 开源网关(MIT)+ 托管控制面(商业、分层)。提供广泛的模型目录、20+ 原生护栏、MCP 网关与成熟的可观测 / 治理平台;语义缓存、SSO / SCIM、VPC 部署在企业版。

适合:想要托管的可观测与治理平台,并接受高级能力按档收费的团队。

小结

选型可以先看你需要「Token 中转」还是「治理」:One API、New API 是优秀的开源 Token 中转站(轻量、宽松协议选 One API;功能更全、在线支付与活跃维护选 New API);LiteLLM 覆盖广泛,Portkey 提供托管治理平台;Higress 适合已在阿里云 / K8s 体系内、想用同一个网关 覆盖 Ingress、微服务与 AI 流量的团队。

如果你更看重把网关数据面部署在自有网络,并希望通过私有的模型与护栏端点控制 数据驻留,同时需要语义路由、模型合议(ensemble)、提示词 / 响应护栏、MCP 网关等企业级治理,可以了解 AISIX AI 网关——由 Apache APISIX 原班团队打造,数据面完全 Apache-2.0,可在自有 VPC 内自托管。

深入对比

想看两个「API 网关团队做的 AI 网关」在架构、治理与控制台上的详细差异,请阅读 AISIX vs Higress 深入对比

想看中文市场里最常被比较的两个 Token 中转站的详细差异,请阅读 One API vs New API 深入对比

常见问题

开启您的 API 探索之旅

免费试用

获取方案