为什么需要AI Gateway
当一个项目同时调用OpenAI、Gemini、Claude、DeepSeek等多个模型时,你需要维护多套API Key、多个端点、不同的错误处理逻辑。Vercel AI Gateway在中间加了一层统一接口,让你只改一个model字段就能切换模型,还能统一看成本、做故障转移。
第一步:创建AI Gateway
登录Vercel Dashboard,进入AI Gateway页面。点击创建Gateway,起一个名字。创建后会得到一个统一的API端点,格式类似:
https://ai-gateway.vercel.sh/v1/chat/completions
第二步:配置Provider和Key
在Gateway设置里添加你要用的模型提供商:
- OpenAI:填入OpenAI API Key
- Anthropic:填入Anthropic API Key
- Google:填入Google AI Studio Key
- DeepSeek:填入DeepSeek API Key
所有Key由Gateway托管,你的应用代码里不再需要保存多套Key。
第三步:统一调用代码
接入后调用方式几乎和OpenAI兼容:
import requests
response = requests.post(
“https://ai-gateway.vercel.sh/v1/chat/completions”,
headers={“Authorization”: “Bearer 你的Gateway_Key”},
json={
“model”: “google/gemini-3.7-flash”,
“messages”: [{“role”: “user”, “content”: “Hello”}]
}
)
切换模型只需要改model字段,比如改成openai/gpt-4o或anthropic/claude-sonnet-5。
第四步:成本追踪
Gateway控制台会显示每个模型的调用次数、token用量、预估成本。你可以按项目、按模型、按时间段查看,方便做预算控制。
第五步:故障转移配置
设置fallback规则:当主模型失败或超时时,自动切换到备用模型。比如:
- 主模型:google/gemini-3.7-flash
- 备用模型:openai/gpt-4o-mini
- 触发条件:HTTP 500或超时3秒
这样即使某个模型服务不稳定,应用也能继续运行。
第六步:零数据保留
对隐私敏感的场景,可以开启Zero Data Retention。开启后Gateway不会缓存请求内容,满足企业合规要求。
常见问题
- 模型ID格式错误:必须是 provider/model-name 格式
- Key失效:在Gateway后台更新Provider Key
- 调用延迟:Gateway本身会增加少量延迟,通常可忽略
- 价格:Vercel AI Gateway不收取平台费,按各模型实际用量计费
效率数据
接入Gateway后,维护多模型代码从维护5套端点和Key变成只维护1个。切换模型只需改1行代码。成本追踪让团队能直观看到每个模型花了多少钱,便于优化选型。