OpenAI 兼容 API · 多租户 · 按量计费

统一的 AI 网关 面向企业的 大语言模型

统一的访问地址。统一的认证模型。统一的模型目录。
通过单一的 OpenAI 兼容接口访问 DeepSeek、Qwen、GLM、Claude 及所有主流大语言模型。

统一访问地址 · 统一认证 · 统一模型目录

兼容主流模型供应商

  • OpenAI
  • Claude
  • Gemini
  • Meta Llama
  • DeepSeek
  • Qwen
  • Kimi
  • ChatGLM
  • Mistral

专为生产级 AI 团队打造

一个网关,接入所有模型。

多租户隔离、预算管控和用量可视化——全部通过单一接口实现。

  • 主流大语言模型,统一 API

    通过单一 OpenAI 兼容 API 访问 DeepSeek、Qwen、GLM、Kimi 等顶级模型——专为可靠路由、合规管理和统一计费而构建。

  • 多租户与项目隔离

    按组织和项目管理,每个项目拥有独立 API 密钥、隔离配额和清晰归属——非常适合服务多个内部团队的平台团队。

  • 预算、配额与告警

    为每个租户或项目设置预算和用量限制。在超支前获得主动告警,并通过限流或硬性截断来控制成本。

  • 用量分析与仪表板

    可视化 Token 用量、成本趋势及模型分布。财务团队与工程团队共享同一个 AI 支出数据源。

真实模型,真实服务。

不只是一个空壳网关。

可调用的模型、按量计费、可追踪的路由——每一次请求都是真实的。

  1. 01

    真实的模型目录

    模型来自实时供应商集成。GET /v1/models 返回的是可以真正调用的模型 ID,而非静态展示。

  2. 02

    按用量计费

    每次对话补全都会记录 Token 用量,并进行配额和余额预检。控制台与账单始终保持一致。

  3. 03

    实时上游路由

    请求通过优先级路由和熔断机制代理到真实推理端点。X-SupaNexus-* 响应头帮助您追踪和诊断问题。

// 通过 OpenAI 兼容 API 调用任何模型const client = new OpenAI({  baseURL: "https://api.supanexus.ai/v1",  apiKey: process.env.SUPANEXUS_KEY}); const res = await client.chat.completions.create({  model: "deepseek-v3",  messages: [{ role: "user", content: "Hello" }]});

零数据留存

不留存任何对话内容。

我们仅记录账单和用量报告所需的数据,并将对话实时转发至您选择的模型供应商。

  • 不保存对话文本

    您的问题和模型的回复不会存储在我们的系统中。SupaNexus 不会将您的对话用于训练、画像或二次分析。

  • 仅保留账单信息

    我们仅保留账单和用量报告所需的信息——使用了哪个模型、消耗了多少、何时使用——而非您对话中的文字内容。

  • 原样转发,不做篡改

    对话实时直接转发至您选择的模型供应商。SupaNexus 不缓存、不改写、不注入额外内容。

  • 凭证安全存储

    供应商 API 密钥静态加密存储,仅用于路由您的请求。它们永远不会以明文形式出现在控制台或日志中。

按量付费

市场定价,
透明无隐患。

无固定套餐或隐藏渠道费用。每个模型的输入/输出 Token 费率在模型市场实时显示——只为您使用的内容付费。

  • 市场实时费率

    登录后打开「模型」,在调用前浏览各模型的输入/输出定价。

  • 输入与输出分开计费

    按 Token 用量计费;输入和输出费率通常不同,与 GET /v1/models 返回的元数据保持一致。

  • 用量与账单来自同一链路

    用量分析、账户余额和结算共享同一计量链路——可在控制台中审计。

按量付费

基于 Token 的定价

按 Token 计费,无需订阅。

deepseek-v3 输入:$0.27输出:$1.10
qwen-max 输入:$0.40输出:$1.20
glm-4-plus 输入:$0.28输出:$0.98
kimi-k1.5 输入:$0.50输出:$1.50

快速开始

三步快速上手。

从注册到第一次 API 调用,只需几分钟。

  1. 1

    创建账户

    在开发者控制台注册并设置您的组织。

  2. 2

    获取 API 密钥

    创建具有所需权限的项目级 API 密钥。

  3. 3

    调用模型

    将您的客户端指向 SupaNexus OpenAI 兼容接口,开始发起 API 调用。

常见问题

常见问题解答。

关于 SupaNexus、账单和 API 的一切问题。

SupaNexus 与直接调用模型供应商有什么不同?

SupaNexus 在单一 OpenAI 兼容 API 后面增加了多租户隔离、统一账单、预算管控以及跨多个供应商的路由能力。

组织、项目和 API 密钥如何隔离?

每个组织都是独立的租户。组织内的项目拥有独立的 API 密钥和配额池,余额从不共享。

如何创建和管理 API 密钥?

在开发者控制台中,打开您的项目并进入 API 密钥页面。可以为每个密钥设置限速和到期日期。

组织、项目和密钥的支出上限如何运作?

上限逐级生效:如果密钥、项目或组织的任一预算耗尽,请求将被阻止。最严格的上限优先生效。

预算告警与硬性上限有何区别?

告警会在支出超过阈值时通知您(邮件/Webhook),但允许流量继续。硬性上限则会在达到限额后阻止新的请求。

如何配置用量视图和预算告警?

打开控制台仪表板,选择时间范围和模型过滤器,然后进入「预算」设置阈值和通知渠道。

周末即可搭建完成,
轻松扩展至百万级别。

一个 API 密钥,接入所有主流大语言模型,几分钟内完成首次调用。