LLM Gateway
所有系统运行正常

一个 API 访问 所有 AI 模型

通过统一的 API 接入 130+ 主流 AI 模型,支持 OpenAI、Anthropic、Google、DeepSeek 等。 按量付费,价格透明,无需订阅。

无需信用卡 · 兑换码激活 · 兼容 OpenAI / Anthropic SDK

quickstart.py
from openai import OpenAI

client = OpenAI(
  api_key="your_api_key",
  base_url="https://api.llm-gateway.com/v1"
)

response = client.chat.completions.create(
  model="claude-opus-4-6",
  messages=[{"role": "user", "content": "你好!"}]
)

print(response.choices[0].message.content)
企业级合规网关

云服务商与 AI 平台直采

依托顶级云厂商与 AI 平台,提供合规、稳定、可追溯认证的 AI 算力分发服务

顶级云厂商直采

与 AWS、Azure、GCP 等全球顶级云服务商建立直接合作,确保算力资源的稳定供给与优惠价格。

企业级合规认证

具备完整的企业资质与合规认证,满足金融、医疗、政务等行业的数据安全与审计要求。

全链路可追溯

每一次 API 调用都有完整的审计日志,支持请求溯源、用量归因与费用拆分,满足企业治理需求。

AI 平台官方授权

与 OpenAI、Anthropic、Google 等 AI 平台建立官方合作渠道,提供正版授权的模型接入服务。

合作云厂商
AWSAzureGCP阿里云
合规认证
ISO 27001SOC 2等保三级GDPR

构建 AI 应用所需的一切

专注于打造优秀产品,基础设施交给我们。

统一 API

一个 API Key,一个接入点。只需更改一个参数即可切换 130+ 模型。同时兼容 OpenAI 与 Anthropic SDK。

极具竞争力的价格

透明的按 Token 计费,无隐藏加价。只为使用量付费,大用量享受阶梯折扣。

隐私与安全

自动 PII 脱敏,防止敏感数据泄露给模型提供商。传输和存储均采用企业级加密。

实时数据分析

通过强大的仪表盘实时监控所有模型的 Token 用量、延迟、费用和错误率。

智能路由

自动故障转移和负载均衡。当某个模型不可用时,请求会无缝切换到备选模型。

超低延迟

全球边缘网络优化路由,确保最快响应速度。平均额外延迟低于 50ms。

来自顶级供应商的 16+ 模型

一个 API Key 即可调用 12 家厂商的全量模型, 覆盖文本、图像、视频、语音与向量检索。

登录 后查看实时报价;最终计费以控制台为准。

Anthropic

13
claude-sonnet-4-6
claude-sonnet-4-6
文本生成
claude-opus-4-6
claude-opus-4-6
文本生成
claude-opus-4-7
claude-opus-4-7
文本生成
claude-opus-4-8
claude-opus-4-8
文本生成
claude fable 5
claude-fable-5
文本生成
查看全部 13 个 →

OpenAI

35
gpt-5.4
gpt-5.4
文本生成
gpt 5.5
gpt-5.5
文本生成
gpt 5.6 sol
gpt-5.6-sol
文本生成
gpt 5.6 terra
gpt-5.6-terra
文本生成
gpt 5.6 luna
gpt-5.6-luna
文本生成
查看全部 35 个 →

Google

16
gemini-3-pro-preview即将上线
gemini-3-pro-preview
文本生成
gemini-3.1-pro-preview即将上线
gemini-3.1-pro-preview
文本生成
gemini-2.5-pro即将上线
gemini-2.5-pro
文本生成
gemini-3-flash-preview即将上线
gemini-3-flash-preview
文本生成
gemini-2.5-flash即将上线
gemini-2.5-flash
文本生成
查看全部 16 个 →

xAI

4
Grok 4.1 Fast即将上线
grok-4-1-fast-non-reasoning
文本生成
Grok 4.1 Fast (Reasoning)即将上线
grok-4-1-fast-reasoning
文本生成
Grok 4 Fast即将上线
grok-4-fast-non-reasoning
文本生成
Grok 4 Fast (Reasoning)即将上线
grok-4-fast-reasoning
文本生成

DeepSeek

10
deepseek v4 pro
deepseek-v4-pro
文本生成
deepseek-r1即将上线
deepseek-r1
文本生成
deepseek-v3即将上线
deepseek-v3
文本生成
DeepSeek-V3.1即将上线
deepseek-v3.1-250821
文本生成
DeepSeek-V3.1-Think即将上线
deepseek-v3.1-think-250821
文本生成
查看全部 10 个 →

阿里通义 Qwen

31
qwen3.7 max
qwen3.7-max
文本生成
qwen3-max即将上线
qwen3-max
文本生成
qwen-max即将上线
qwen-max
文本生成
qwen-plus即将上线
qwen-plus
文本生成
qwen-flash即将上线
qwen-flash
文本生成
查看全部 31 个 →

字节豆包 Doubao

16
doubao seed 2 0 code preview
doubao-seed-2-0-code-preview
文本生成
doubao seed 2 0 pro
doubao-seed-2-0-pro
文本生成
doubao-1.5-pro-32k即将上线
doubao-1-5-pro-32k-250115
文本生成
doubao-seed-1.6-thinking即将上线
doubao-seed-1-6-thinking-250715
文本生成
doubao-seed-1.6-flash即将上线
doubao-seed-1-6-flash-250715
文本生成
查看全部 16 个 →

百度文心 ERNIE

11
ERNIE 4.5 Turbo即将上线
ernie-4.5-turbo-128k
文本生成
ERNIE 4.0 Turbo即将上线
ernie-4.0-turbo-128k
文本生成
ERNIE 4.0即将上线
ernie-4.0-8k
文本生成
ERNIE X1 Turbo即将上线
ernie-x1-turbo-32k
文本生成
ERNIE 4.5 Turbo VL即将上线
ernie-4.5-turbo-vl-32k
文本生成
查看全部 11 个 →

智谱 GLM

4
glm 5.2
glm-5.2
文本生成
GLM-4.7即将上线
glm-4.7
文本生成
GLM-5即将上线
glm-5
文本生成
GLM-5.1即将上线
glm-5.1
文本生成

月之暗面 Kimi

1
kimi-k2.5即将上线
kimi-k2.5
文本生成

MiniMax

4
MiniMax-M2.7
MiniMax-M2.7
文本生成
MiniMax-M2.5即将上线
MiniMax-M2.5
文本生成
MiniMax-Hailuo-2.3即将上线
MiniMax-Hailuo-2.3
视频生成
MiniMax-Hailuo-02即将上线
MiniMax-Hailuo-02
视频生成

Vidu 生数

5
Vidu Q2即将上线
viduq2
视频生成
Vidu Q2-pro即将上线
viduq2-pro
视频生成
Vidu Q2-turbo即将上线
viduq2-turbo
视频生成
Vidu Q3-pro即将上线
viduq3-pro
视频生成
Vidu Q3-turbo即将上线
viduq3-turbo
视频生成

3 分钟快速上手

无需复杂配置,无需学习新 SDK,兼容你现有的代码。

01

创建账户

手机号一键登录,无需信用卡。使用兑换码激活账户额度,立即开始调用。

02

生成 API Key

在控制台创建 API Key。直接使用 OpenAI SDK,无需学习新的库。

03

开始调用

将现有代码的请求地址指向我们的接入点,只需更改一个参数即可切换 130+ 模型。

支持任何编程语言

兼容 OpenAI SDK 与 Anthropic SDK,使用现有客户端库即可,无需专属 SDK。

from openai import OpenAI

client = OpenAI(
    api_key="your_api_key",
    base_url="https://api.llm-gateway.com/v1"
)

response = client.chat.completions.create(
    model="claude-opus-4-6",
    messages=[{"role": "user", "content": "解释量子计算"}],
    temperature=0.7,
    stream=True
)

for chunk in response:
    print(chunk.choices[0].delta.content, end="")

常见问题

LLM Gateway 是如何工作的?

LLM Gateway 提供一个统一的 API 接入点,同时兼容 OpenAI(/v1/chat/completions)与 Anthropic(/v1/messages)协议。你向我们的接入点发送请求,指定要使用的模型,我们将请求路由到相应的供应商,并返回对应协议的标准化响应。

我需要为每个供应商单独申请 API Key 吗?

不需要。你只需要一个 LLM Gateway 的 API Key。我们在后端处理所有供应商的认证。这意味着你不需要管理多个 API Key、计费账户或供应商关系。

我的数据安全吗?

安全。我们提供自动 PII 脱敏功能,在数据到达模型供应商之前剥离敏感信息。所有数据在传输(TLS 1.3)和存储时都经过加密。我们不会存储你的提示词或模型输出。企业版还提供额外的合规认证。

如果某个模型供应商宕机了怎么办?

我们的智能路由系统会自动检测供应商故障,并将请求转移到其他供应商的等效模型。你可以在控制台配置故障转移偏好,确保即使在供应商事故期间,你的应用也能持续运行。

我可以直接使用现有的 OpenAI 或 Anthropic SDK 代码吗?

完全可以。LLM Gateway 同时兼容 OpenAI SDK 与 Anthropic SDK:把 OpenAI 客户端的 base_url 指向网关的 /v1,或把 Anthropic 客户端的 base_url 直接设为 https://api.llm-gateway.cn/v1/messages,更新模型名即可。流式输出、函数调用 / 工具使用、Claude Code CLI(ANTHROPIC_BASE_URL)等都开箱即用,原代码无需修改。

价格是怎么计算的?

价格按你使用的模型的 Token 数计费。每个模型都有透明的输入和输出 Token 费率,列在我们的定价页面上。无隐藏费用、无最低消费、无意外扣费。专业版每月包含 $50 额度,超出部分按标准费率计费。

支持流式输出吗?

支持。我们为所有模型完整支持 Server-Sent Events (SSE) 流式输出。在请求中设置 stream: true,即可逐个 Token 接收生成内容,遵循标准的 OpenAI chat.completion.chunk 格式。

延迟开销是多少?

我们的全球边缘网络平均仅增加不到 50ms 的延迟。我们使用优化的路由选择最快路径到达每个供应商,基础设施专为最小化延迟影响而设计。