> ## Documentation Index
> Fetch the complete documentation index at: https://doc.tokendog.io/llms.txt
> Use this file to discover all available pages before exploring further.

# 多模态输入

> 在对话中传入图片（图像理解）

在 `messages` 的 `content` 中混合文本与 `image_url`，即可让模型理解图片（图像输入，非图像生成）。

<CodeGroup>
  ```bash curl theme={null}
  curl https://tokendog.io/v1/chat/completions \
    -H "Authorization: Bearer $TOKENDOG_API_KEY" \
    -H "Content-Type: application/json" \
    -d '{
      "model":"gpt-5",
      "messages":[{"role":"user","content":[
        {"type":"text","text":"描述这张图片"},
        {"type":"image_url","image_url":{"url":"https://example.com/cat.png"}}
      ]}]
    }'
  ```

  ```python Python theme={null}
  from openai import OpenAI
  client = OpenAI(base_url="https://tokendog.io/v1", api_key="YOUR_TOKENDOG_API_KEY")
  resp = client.chat.completions.create(model="gpt-5", messages=[{"role":"user","content":[
    {"type":"text","text":"描述这张图片"},
    {"type":"image_url","image_url":{"url":"https://example.com/cat.png"}},
  ]}])
  print(resp.choices[0].message.content)
  ```

  ```javascript Node theme={null}
  import OpenAI from "openai";
  const client = new OpenAI({ baseURL:"https://tokendog.io/v1", apiKey:"YOUR_TOKENDOG_API_KEY" });
  const resp = await client.chat.completions.create({ model:"gpt-5", messages:[{role:"user",content:[
    {type:"text",text:"描述这张图片"},
    {type:"image_url",image_url:{url:"https://example.com/cat.png"}},
  ]}]});
  console.log(resp.choices[0].message.content);
  ```
</CodeGroup>

<Tip>具备视觉能力的模型（如 `gpt-5`、`gemini-2.5-flash`、`claude-sonnet-4-6`）均可接收图片输入。</Tip>
