快速开始

API 概览

各厂商原生协议的端点对照、鉴权请求头、停止原因字段与 token 用量位置。

CA云上创造 直接透传各厂商模型的原生协议:将官方 SDK 的 Base URL 指向 CA云上创造 即可,无需修改业务代码。Base URL 为 https://caapi.top;用量与账单接口也在这个域名下可访问。

请求格式

按模型选择协议,端点与请求体格式与对应的官方 API 一致:

协议端点适用模型
Anthropic 原生POST /v1/messagesClaude 全系列(唯一推荐入口)
OpenAI 兼容POST /v1/chat/completionsGPT、Gemini(Claude 不建议)
OpenAI ResponsesPOST /v1/responses仅 GPT 系列
Gemini 原生POST /v1beta/models/{model}:generateContent仅 Gemini
图像POST /v1/images/generationsPOST /v1/images/editsgpt-image-2
以 OpenAI 兼容格式调用 Claude 会丢失 prompt cache、thinking 等能力;以 Responses API 调用 Claude 或 Gemini 会返回 400。请求体为 JSON,content-type: application/json

请求头

鉴权请求头有三种(Authorization: Bearerx-api-keyx-goog-api-key),适用范围见 鉴权。Anthropic 格式的 anthropic-version 可省略。

完成原因

各协议以各自的字段表示生成停止的原因:

协议字段常见取值
Anthropicstop_reasonend_turntool_use
OpenAIchoices[].finish_reasonstoptool_calls
Geminicandidates[].finishReasonSTOP

查询消耗与用量

每个响应都包含 token 用量:Anthropic 在 usage,OpenAI 在 usage,Gemini 在 usageMetadata,字段名随协议而异。每次调用的响应头还包含 x-request-id,可用于在 查询单次请求用量 里查到这次请求的最终费用;按时间范围汇总见 查询 Token 用量 与 查询账单汇总。

50 篇文档。文中出现的模型名与价格以模型广场的实时数据为准。