messages 的 content 中混合文本与 image_url,即可让模型理解图片(图像输入,非图像生成)。
curl https://tokendog.io/v1/chat/completions \
-H "Authorization: Bearer $TOKENDOG_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model":"gpt-5",
"messages":[{"role":"user","content":[
{"type":"text","text":"描述这张图片"},
{"type":"image_url","image_url":{"url":"https://example.com/cat.png"}}
]}]
}'
from openai import OpenAI
client = OpenAI(base_url="https://tokendog.io/v1", api_key="YOUR_TOKENDOG_API_KEY")
resp = client.chat.completions.create(model="gpt-5", messages=[{"role":"user","content":[
{"type":"text","text":"描述这张图片"},
{"type":"image_url","image_url":{"url":"https://example.com/cat.png"}},
]}])
print(resp.choices[0].message.content)
import OpenAI from "openai";
const client = new OpenAI({ baseURL:"https://tokendog.io/v1", apiKey:"YOUR_TOKENDOG_API_KEY" });
const resp = await client.chat.completions.create({ model:"gpt-5", messages:[{role:"user",content:[
{type:"text",text:"描述这张图片"},
{type:"image_url",image_url:{url:"https://example.com/cat.png"}},
]}]});
console.log(resp.choices[0].message.content);
具备视觉能力的模型(如
gpt-5、gemini-2.5-flash、claude-sonnet-4-6)均可接收图片输入。