主流大模型,统一出口
聚合 DeepSeek、通义千问、智谱 GLM、Kimi 等主流模型,通过统一 OpenAI 兼容 API 对外服务,统一接入、路由与计费。
专为生产级 AI 团队打造
主流大模型、多租户隔离、预算管控和用量可视化——全部通过单一 OpenAI 兼容接口实现。
聚合 DeepSeek、通义千问、智谱 GLM、Kimi 等主流模型,通过统一 OpenAI 兼容 API 对外服务,统一接入、路由与计费。
按组织与项目划分资源,API Key、配额与权限彼此隔离,职责清晰,适合平台团队服务多个内部业务方。
为租户或项目设置预算与用量上限,超支前主动预警,并支持限流或熔断,把 AI 成本控制在预期之内。
以图表展示 Token 用量、费用趋势与模型分布,财务与研发团队共用一套可信的 AI 消耗数据。
真实模型,真实服务。
可调用的模型、按量计费、可追踪的路由——每一次请求都是真实的。
模型来自实时供应商集成。GET /v1/models 返回的是可以真正调用的模型 ID,而非静态展示。
每次对话补全都会记录 Token 用量,并进行配额和余额预检。控制台与账单始终保持一致。
按模型 ID 路由至可用服务。X-SNX-* 响应头帮助您诊断问题。
// Call any model via OpenAI-compatible API
const client = new OpenAI({
baseURL: "https://api.supanexus.ai/v1",
apiKey: process.env.SUPANEXUS_KEY
});
const res = await client.chat.completions.create({
model: "deepseek-v3",
messages: [{ role: "user", content: "Hello" }]
});
隐私
您发送的提问与模型返回的回答不会保存在 SupaNexus 侧。我们仅记录账单和用量报告所需的数据,并将对话实时转发至您选择的模型供应商。
你的提问与模型回复不会写入我们的系统,平台不会拿你的对话做训练、画像或二次分析。
仅记录用了哪个模型、用了多少量、何时调用等计费与统计所需信息,不含对话原文。
对话实时转发至你选择的模型厂商,SupaNexus 不缓存、不改写、不往内容里夹带额外信息。
连接模型厂商所需的密钥经加密保存,仅用于转发请求,不会在界面或日志中以明文形式出现。
按量付费
无固定套餐或隐藏渠道费用。每个模型的输入/输出 Token 费率在模型市场实时显示——只为您使用的内容付费。
登录控制台打开模型广场,浏览上架模型与 Input / Output 单价,调用前即可核价。
按 Token 用量计费,输入与输出单价通常不同,与 GET /v1/models 元数据一致。
用量分析、账户信息与结算扣款共用同一套计量链路,控制台可查可对账。
按量付费
按 Token 用量付费,无需订阅。
以上为示意价格,实际单价以模型广场实时定价为准。
快速开始
从注册到第一次 API 调用,只需几分钟。
在开发者控制台注册并配置组织。
创建项目级 API Key,按需配置权限。
将客户端指向 SupaNexus 的 OpenAI 兼容端点,开始推理。
常见问题
关于 SupaNexus、账单和 API 的一切问题。
SupaNexus 在单一 OpenAI 兼容 API 后面增加了多租户隔离、统一账单、预算管控以及跨多个供应商的路由能力。
每个组织都是独立的租户。组织内的项目拥有独立的 API 密钥和配额池,余额从不共享。
在开发者控制台中,打开您的项目并进入 API 密钥页面。可以为每个密钥设置限速和到期日期。
上限逐级生效:如果密钥、项目或组织的任一预算耗尽,请求将被阻止。最严格的上限优先生效。
告警会在支出超过阈值时通知您(邮件/Webhook),但允许流量继续。硬性上限则会在达到限额后阻止新的请求。
打开控制台仪表板,选择时间范围和模型过滤器,然后进入「预算」设置阈值和通知渠道。