模型广场
OpenAI: GPT-5.6 Luna
不用于训练
GPT-5.6 Luna 是 GPT-5.6 系列中快速、低成本的一档,适合聊天、分类和轻量 Agent 工作流这类高并发、对延迟敏感的场景,在同价位中推理能力可靠。
多模态能力
文本图片文件
灰色表示当前数据源未覆盖,不代表不支持。
输入 / 输出价格
$0.118 / $0.7085.9 折
$0.2 / $1.2
per 1M tokens
上下文
1M发布时间
2026年7月9日供应商
同一个模型可由多条线路承载,各线路在时延、可用率与上下文上可能不同。 下方只列出本站实际接入的线路;未接入的线路不会出现,「—」表示该线路尚未产出该项实测数据。
| 供应商 | 上下文 | 输入价格 | 输出价格 | 缓存价格 | 首字时延(TTFT) | 输出速度(TPS) | 可用率(SLA) | 数据安全 |
|---|---|---|---|---|---|---|---|---|
| OpenAI | 1M | $0.118 $0.2 | $0.708 $1.2 | $0.0118 $0.02 | — | — | — | 不用于训练 |
| Azure OpenAI | 1M | $0.118 $0.2 | $0.708 $1.2 | $0.0118 $0.02 | — | — | — | 不用于训练 |
| 第三方供应商 | 1M | $0.118 $0.2 | $0.708 $1.2 | $0.0118 $0.02 | — | — | — | 不用于训练 |
本模型在售状态与折后单价见 模型广场(当前输入 $0.12 / 输出 $0.72)。
实时折扣
当前折扣5.9 折折后即结算价,让利 40%
OpenAI 系列近 31 天折扣走势
2026-08-16 · 1.09折2026-09-15 · 0.8折
性能
首字时延(TTFT)
2569ms
从发出请求到收到第一个 token 的耗时
输出速度(TPS)
156 tok/s
生成阶段的平均输出速度
「—」表示该模型在当前统计窗口内还没有实测样本,不代表性能为 0。
可用率
近 24 小时聚合可用率
98.50%
98.5%
每一格代表一小时,鼠标停在格子上可看到该小时的数值;空格表示该小时尚未产出数据。 未产生调用记录的模型显示「—」,不代表可用率为 0。
数据安全
该模型供应商不使用用户数据用于模型训练(来源标记:不用于训练)。
数据处理与留存细则见 文档。
快速接入
接口与 OpenAI 完全兼容:把 base_url 指向 https://caapi.top/v1、把 api_key 换成你在控制台创建的密钥, 其余业务代码不用改。把 model 填成 gpt-5.6-luna 即可调用 GPT-5.6 Luna。
from openai import OpenAI
client = OpenAI(
base_url="https://caapi.top/v1",
api_key="<CA_API_KEY>",
)
resp = client.chat.completions.create(
model="gpt-5.6-luna",
messages=[{"role": "user", "content": "你好"}],
)
print(resp.choices[0].message.content)密钥在控制台创建,可随时吊销重建。完整参数与错误码见 API 文档。