功能指南

图像输入

三种协议各自的图片内容块写法——URL、Base64 与 Gemini 的 inlineData,以及向纯文本模型发图时会拿到的 400。

图像输入按各协议的原生格式透传,只有多模态模型支持;向纯文本模型发送图片会返回 400。实测可用的组合:Anthropic 格式的 claude-opus-4-8、OpenAI 格式的 gpt-5.6-sol、Gemini 格式的 gemini-3.5-flash

使用图片 URL

OpenAI 格式使用 image_url 内容块,url 填写公网地址即可:

json
{ "type": "image_url", "image_url": { "url": "https://example.com/photo.png" } }
Anthropic 格式也支持 source.typeurl 的图片块,但图片由上游抓取,部分公网地址无法获取,模型会回复未看到图片。Anthropic 格式建议使用下文的 Base64 方式。

使用 Base64 图片

Anthropic 格式:

json
{
  "type": "image",
  "source": { "type": "base64", "media_type": "image/png", "data": "<Base64>" }
}

OpenAI 格式:

json
{ "type": "image_url", "image_url": { "url": "data:image/png;base64,<Base64>" } }

Gemini 格式在 parts 里放 inlineData

json
{ "inlineData": { "mimeType": "image/png", "data": "<Base64>" } }
向不支持图片的模型发送图片时返回 400 invalid_request_errormessage 会说明该模型不支持图片输入;请移除图片或改用多模态模型。

50 篇文档。文中出现的模型名与价格以模型广场的实时数据为准。