一套生产用的 API,接住前沿模型。路由可以预期,费用写得明白,压力上来时基础设施保持安静。
获取 API 密钥实时 / 30 天
100.00%
01 / 网关
对着稳定的端点写一次。Aerogate 吸收供应商差异、模型更换和区域切换。
02 / 模型
| 模型 | 上下文 | P50 延迟 | / 100 万 TOKEN |
|---|---|---|---|
| 在线 gpt-6-astra | 128k | 0.8s | $4.20 |
| 在线 Opus 5.5 | 200k | 1.1s | $5.80 |
| 在线 Gemini 4 Pro | 1m | 0.9s | $3.60 |
| 在线 Qwen Ultra | 256k | 0.7s | $1.90 |
03 / 快速开始
保留现有的 OpenAI SDK。只改一个 base URL,请求就经过 aerogate。
import OpenAI from "openai";
const client = new OpenAI({
apiKey: process.env.AEROGATE_KEY,
baseURL: "https://api.aerogate.dev/v1"
});
const response = await client.chat.completions.create({ model: "gpt-6-astra", messages });04 / 负载
突发容量、队列隔离和多供应商切换,让发布变成压测时流量仍然往前走。
05 / 定价
调用模型不需要订阅。没有藏起来的倍率。用量按请求出现,细到 token。
06 / 标准
多区域路由,并对每个上游做自动健康检查。
账单读得懂,状态公开,不发明计量单位。
带上你自己的密钥、策略、预算和观测。
懂请求路径的基础设施工程师。