首页 / 文本与推理 API
文本与推理 API
苏姆卡皮 · OpenAI 兼容 AI API 网关 · Base URL https://sub.sumcapi.top/v1
一个 Base URL 同时提供 OpenAI Chat Completions、OpenAI Responses 与 Anthropic Messages 三种契约,覆盖问答、写作、抽取、代码与 Agent 工具链。
文本与推理 API
三种契约怎么选
| 契约 | 端点 | 适合 | 说明 |
|---|---|---|---|
| OpenAI Chat Completions | /v1/chat/completions | 绝大多数存量代码 | 兼容性最好,SDK 与生态最丰富 |
| OpenAI Responses | /v1/responses | 需要工具调用与状态化的 Agent | Codex CLI 等新版工具链使用 |
| Anthropic Messages | /v1/messages | Claude 生态、Claude Code | 保留 system、content blocks 等原生语义 |
同一个密钥可以同时使用以上端点,配额与用量合并计算。
快速开始
curl https://sub.sumcapi.top/v1/chat/completions \
-H "Authorization: Bearer sk-你的密钥" \
-H "Content-Type: application/json" \
-d '{
"model": "模型名",
"messages": [{"role": "user", "content": "把下面这段改成技术评审口吻:……"}],
"temperature": 0.3,
"stream": false
}'
openai chat \
--base-url https://sub.sumcapi.top/v1 \
--model 模型名 \
-m "用一段话解释幂等性"
流式与工具调用
- 流式:
"stream": true返回text/event-stream,data: [DONE]结束,行为与官方一致。 - 工具调用:
tools/tool_choice字段透传,模型返回tool_calls后由你的运行时执行。 - 结构化输出:支持
response_format,需要 JSON 时优先使用,减少后处理成本。
上下文与并发建议
- 把长文档拆成检索片段而不是整篇塞进上下文,成本与延迟都更可控。
- 批量任务用队列控制并发,网关按密钥维度限流,超额会返回
429。 - 对时延敏感的场景给请求设置整体超时(建议 30–60 秒),失败任务交给兜底模型重试。
常见错误与处理
| 现象 | 原因 | 处理 |
|---|---|---|
401 Unauthorized | 密钥缺失或错误 | 检查 Authorization: Bearer 前缀与控制台密钥状态 |
403 分组不可用 | 密钥未绑定该能力的分组 | 在控制台为密钥选择正确分组 |
404 model not found | 模型名不在当前分组 | 从模型广场复制准确模型名 |
429 | 触发密钥或上游限流 | 指数退避重试,或降低并发 |
| 响应中断 | 网络或上游超时 | 开启流式可尽早发现中断并重试 |
苏姆卡皮