图片分析(网络)
本页介绍如何使用 OpenAI Responses API 通过网络图片 URL 进行图片分析。适合图片内容描述、截图理解、商品识别、图文问答等场景。
请求地址
https://api.maomaotoken.com/v1/responses功能说明
Responses API 支持文本和图像的多模态输入。你可以在同一次请求中传入文字提示和图片 URL,让模型根据图片内容生成描述或回答问题。
Python 调用示例
下面示例使用 requests 发送请求,并通过 input_image 传入网络图片地址。
"""
MaomaoToken 多模态图片识别示例
功能:
使用 Responses API 进行图片内容识别。
支持通过 URL 方式传入图片,让模型分析并描述图片内容。
"""
import json
import requests
# ==================== API 配置 ====================
API_KEY = "sk-***************************"
url = "https://api.maomaotoken.com/v1/responses"
# ==================== 请求头 ====================
headers = {
"Content-Type": "application/json",
"Authorization": f"Bearer {API_KEY}"
}
# ==================== 请求体 ====================
payload = {
"model": "gpt-5-mini",
"input": [
{
"role": "user",
"content": [
{
"type": "input_text",
"text": "描述这张图片中的内容"
},
{
"type": "input_image",
"image_url": "https://example.com/example.jpg"
},
],
}
],
}
# ==================== 发送请求 ====================
try:
response = requests.post(url, headers=headers, data=json.dumps(payload))
response.raise_for_status()
print("请求成功")
print("=" * 60)
print("API 返回结果:")
print("=" * 60)
print(json.dumps(response.json(), indent=4, ensure_ascii=False))
except requests.exceptions.RequestException as e:
print(f"请求失败: {e}")
except ValueError as e:
print(f"数据解析错误: {e}")说明
示例中的 https://example.com/example.jpg 请替换为你自己的图片 URL。图片地址需要能被服务器正常访问,否则模型无法读取图片内容
响应示例
成功响应会返回 JSON 数据,模型生成的图片描述通常位于 output 数组中的 output_text 内容里。
{
"id": "resp_example",
"object": "response",
"model": "gpt-5-mini",
"usage": {
"total_tokens": 1473,
"input_tokens": 935,
"output_tokens": 538
},
"created_at": 1762513567,
"status": "completed",
"output": [
{
"id": "rs_example",
"type": "reasoning",
"summary": []
},
{
"id": "msg_example",
"type": "message",
"status": "completed",
"content": [
{
"type": "output_text",
"text": "这是一张台式计算器的近拍照片。画面中可以看到计算器的显示屏、数字按键、运算按键和周围桌面物品。整体为俯视拍摄,光线均匀,主体清晰。"
}
],
"role": "assistant"
}
],
"reasoning": {
"effort": "medium",
"summary": null
},
"store": true,
"temperature": 1.0,
"text": {
"format": {
"type": "text"
},
"verbosity": "medium"
}
}读取图片分析结果
如果你只想取出模型生成的文本,可以从返回数据中读取:
data = response.json()
text = data["output"][1]["content"][0]["text"]
print(text)实际项目中建议先判断 output、content 和 type 是否存在,避免异常响应导致程序报错。
注意事项
- 请将示例中的
sk-***************************替换为你的真实 API Key。 - API Key 请妥善保管,不要泄露或提交到公开仓库。
- 图片 URL 必须可公开访问,或至少能被 MaomaoToken 服务端正常访问。
- 图片体积过大、访问速度过慢或链接失效,可能导致请求失败或超时。
- 图片内容识别结果由模型生成,仅供参考;涉及商品参数、合同、票据等重要信息时,建议人工复核。