苏姆卡皮是兼容 OpenAI / Anthropic 接口的 AI API 网关。保留现有 SDK 与调用方式,只替换 Base URL 和 API Key,即可获得多厂商模型覆盖、自动故障切换与统一用量账单。通常 5 分钟完成迁移。
一个兼容 OpenAI 接口的 AI API Gateway:用统一 API 接入 GPT、Claude、Gemini、DeepSeek 以及多种图像与视频模型,并在网关层完成路由、重试、配额与计费。适合需要多模型覆盖、故障切换与更低迁移成本的团队。
原厂直连与多渠道冗余并行,同一模型可配置多个上游;实际可用模型清单、倍率与限速以控制台「模型广场」为准。
Chat Completions、Responses、Messages、Embeddings、图像与视频任务共用一套密钥与调用习惯。
上游限流、5xx、过载时自动切换候选账号与渠道,支持 429/529 冷却窗口与优先级调度。
按密钥、模型、分组统计 token 与费用,支持日/周/月配额、RPM 限速与用量导出。
分组授权、模型白名单、IP 黑白名单、并发上限,密钥可随时停用与轮换。
SSE 全链路不缓冲,长上下文与图像任务超时策略可调,适合批量生产场景。
模型倍率、缓存读写价、分组折扣统一在网关侧核算,账单口径对账友好。
邀请码、优惠码、返佣与余额转移,支持把网关能力开放给同事或客户。
渠道监控、错误请求透视、审计日志与告警,异常请求可回溯定位。
保留现有 SDK 与调用方式,只替换 Base URL 和 API Key。
把 endpoint 指向 https://sub.sumcapi.top/v1。
在控制台「API 密钥」创建并绑定分组与权限。
继续使用 OpenAI / Anthropic SDK 或任意 HTTP 客户端。
from openai import OpenAI
client = OpenAI(
base_url="https://sub.sumcapi.top/v1",
api_key="your-api-key",
)
resp = client.chat.completions.create(
model="gpt-5-mini",
messages=[{"role": "user", "content": "你好,苏姆卡皮"}],
)
print(resp.choices[0].message.content)
curl https://sub.sumcapi.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"gpt-5-mini",
"messages":[{"role":"user","content":"hi"}],
"stream":true}'
从创意生产到企业自动化,同一套密钥与账单口径覆盖多类任务。
用文本、图片和视频模型生成短视频脚本、封面图、广告素材与社媒内容,按任务分优先级路由。
生成商品场景图、模特试穿图与营销海报,降低拍摄与外包成本,批量任务可排队与重试。
按问题复杂度自动分配模型,在体验、成本与稳定性之间取得平衡,支持兜底模型。
统一接入 Claude、GPT、DeepSeek 等代码模型,为不同技术栈匹配助手并统计消耗。
调用长上下文模型分析财报与公告,生成结构化摘要;缓存读写价让重复上下文更省。
根据学生水平动态选择模型,从基础答疑到竞赛辅导全覆盖,配额按班级/账号拆分。
先确认每个模型的计费口径,再按业务优先级做路由分层:低优先任务优先成本,高优先任务优先质量与稳定性。
批量离线任务走低价模型与低优先级分组,配合缓存读写价与批量折扣,把单位成本压到可接受区间。
线上核心链路绑定旗舰模型与专属上游,设置兜底模型,只在主上游不可用时降级。
同一模型挂多个上游做冗余,命中限流自动切换;429/529 冷却窗口避免反复撞墙。
统一按 token 计费,价格 = 官方单价 × 模型倍率 × 分组折扣;缓存读写、图像与视频任务各有独立计费口径。
| 项目 | 计费方式 | 说明 |
|---|---|---|
| 文本对话 / 补全 | 输入 + 输出 token | 思考链与工具调用按上游实际消耗计入 |
| 缓存读写 | 独立倍率 | 命中缓存的输入 token 单价更低,长上下文重复前缀更省 |
| 图像生成 / 编辑 | 按张或按任务 | 分辨率与步数影响单价,异步任务失败不计费 |
| 视频生成 | 按秒 / 按任务 | 时长、分辨率与帧率共同决定价格 |
| 嵌入与重排 | 按输入 token | 批量索引建议错峰执行 |
| 失败请求 | 不计费 | 网关侧错误与上游拒绝不计入账单,可在用量页核对 |
当前站点由管理员发放余额与优惠码;接入在线支付后可在控制台自助充值或订阅套餐。每个模型的实时倍率与限速以控制台「模型广场」和密钥页展示为准。
绝大多数场景只需要替换 base_url 与 api_key。Claude 原生 Messages 接口、图像与视频任务接口也在同一网关下提供。
登录后进入「模型广场」,可按能力(文本/图像/视频)、厂商和倍率筛选;密钥页会显示该密钥可用的模型与限速。
网关会按优先级切换到同模型的其它上游;命中 429/529 后进入冷却窗口,避免反复调度到同一上游。核心链路建议配置兜底模型。
支持密钥级并发、日/周/月配额、RPM 限速与分组配额,超限请求会被拒绝并计入用量报表便于排查。
请求仅用于路由与计费统计所需的元数据记录;内容审计与错误请求透视可由管理员按需开启。敏感业务建议自行脱敏。
注册账号 → 创建 API 密钥 → 复制 Base URL 到项目 → 用一个小流量任务验证 → 再逐步迁移业务链路。
聚合 API 网关提供一个稳定的接口层,根据模型能力、可用性与策略把请求路由到多个模型供应商。对应用来说只有一套协议,底层换厂商不需要改代码。
苏姆卡皮在此基础上补齐了运营侧需要的能力:分组与配额、密钥级权限、倍率与折扣、用量报表、渠道监控与审计日志,让“接入多家模型”变成一件可运维、可对账的事情。
适用对象:需要多模型覆盖、路由弹性与稳定集成的产品团队、增长团队与工程团队。