CA云上创造 直接透传各厂商模型的原生协议:将官方 SDK 的 Base URL 指向 CA云上创造 即可,无需修改业务代码。Base URL 为 https://caapi.top;用量与账单接口也在这个域名下可访问。
请求格式
按模型选择协议,端点与请求体格式与对应的官方 API 一致:
| 协议 | 端点 | 适用模型 |
|---|---|---|
| Anthropic 原生 | POST /v1/messages | Claude 全系列(唯一推荐入口) |
| OpenAI 兼容 | POST /v1/chat/completions | GPT、Gemini(Claude 不建议) |
| OpenAI Responses | POST /v1/responses | 仅 GPT 系列 |
| Gemini 原生 | POST /v1beta/models/{model}:generateContent | 仅 Gemini |
| 图像 | POST /v1/images/generations、POST /v1/images/edits | gpt-image-2 |
以 OpenAI 兼容格式调用 Claude 会丢失 prompt cache、thinking 等能力;以 Responses API 调用 Claude 或 Gemini 会返回 400。请求体为 JSON,
content-type: application/json。请求头
鉴权请求头有三种(Authorization: Bearer、x-api-key、x-goog-api-key),适用范围见 鉴权。Anthropic 格式的 anthropic-version 可省略。
完成原因
各协议以各自的字段表示生成停止的原因:
| 协议 | 字段 | 常见取值 |
|---|---|---|
| Anthropic | stop_reason | end_turn、tool_use |
| OpenAI | choices[].finish_reason | stop、tool_calls |
| Gemini | candidates[].finishReason | STOP |
查询消耗与用量
每个响应都包含 token 用量:Anthropic 在 usage,OpenAI 在 usage,Gemini 在 usageMetadata,字段名随协议而异。每次调用的响应头还包含 x-request-id,可用于在 查询单次请求用量 里查到这次请求的最终费用;按时间范围汇总见 查询 Token 用量 与 查询账单汇总。