为什么需要AI Gateway

当一个项目同时调用OpenAI、Gemini、Claude、DeepSeek等多个模型时,你需要维护多套API Key、多个端点、不同的错误处理逻辑。Vercel AI Gateway在中间加了一层统一接口,让你只改一个model字段就能切换模型,还能统一看成本、做故障转移。

第一步:创建AI Gateway

登录Vercel Dashboard,进入AI Gateway页面。点击创建Gateway,起一个名字。创建后会得到一个统一的API端点,格式类似:

https://ai-gateway.vercel.sh/v1/chat/completions

第二步:配置Provider和Key

在Gateway设置里添加你要用的模型提供商:

  • OpenAI:填入OpenAI API Key
  • Anthropic:填入Anthropic API Key
  • Google:填入Google AI Studio Key
  • DeepSeek:填入DeepSeek API Key

所有Key由Gateway托管,你的应用代码里不再需要保存多套Key。

第三步:统一调用代码

接入后调用方式几乎和OpenAI兼容:

import requests

response = requests.post(
“https://ai-gateway.vercel.sh/v1/chat/completions”,
headers={“Authorization”: “Bearer 你的Gateway_Key”},
json={
“model”: “google/gemini-3.7-flash”,
“messages”: [{“role”: “user”, “content”: “Hello”}]
}
)

切换模型只需要改model字段,比如改成openai/gpt-4o或anthropic/claude-sonnet-5。

第四步:成本追踪

Gateway控制台会显示每个模型的调用次数、token用量、预估成本。你可以按项目、按模型、按时间段查看,方便做预算控制。

第五步:故障转移配置

设置fallback规则:当主模型失败或超时时,自动切换到备用模型。比如:

  • 主模型:google/gemini-3.7-flash
  • 备用模型:openai/gpt-4o-mini
  • 触发条件:HTTP 500或超时3秒

这样即使某个模型服务不稳定,应用也能继续运行。

第六步:零数据保留

对隐私敏感的场景,可以开启Zero Data Retention。开启后Gateway不会缓存请求内容,满足企业合规要求。

常见问题

  • 模型ID格式错误:必须是 provider/model-name 格式
  • Key失效:在Gateway后台更新Provider Key
  • 调用延迟:Gateway本身会增加少量延迟,通常可忽略
  • 价格:Vercel AI Gateway不收取平台费,按各模型实际用量计费

效率数据

接入Gateway后,维护多模型代码从维护5套端点和Key变成只维护1个。切换模型只需改1行代码。成本追踪让团队能直观看到每个模型花了多少钱,便于优化选型。