MaoMaoToken 文档

图片分析(网络)

本页介绍如何使用 OpenAI Responses API 通过网络图片 URL 进行图片分析。适合图片内容描述、截图理解、商品识别、图文问答等场景。

请求地址

https://api.maomaotoken.com/v1/responses

功能说明

Responses API 支持文本和图像的多模态输入。你可以在同一次请求中传入文字提示和图片 URL,让模型根据图片内容生成描述或回答问题。

Python 调用示例

下面示例使用 requests 发送请求,并通过 input_image 传入网络图片地址。

"""
MaomaoToken 多模态图片识别示例

功能:
使用 Responses API 进行图片内容识别。
支持通过 URL 方式传入图片,让模型分析并描述图片内容。
"""

import json
import requests


# ==================== API 配置 ====================

API_KEY = "sk-***************************"
url = "https://api.maomaotoken.com/v1/responses"


# ==================== 请求头 ====================

headers = {
    "Content-Type": "application/json",
    "Authorization": f"Bearer {API_KEY}"
}


# ==================== 请求体 ====================

payload = {
    "model": "gpt-5-mini",
    "input": [
        {
            "role": "user",
            "content": [
                {
                    "type": "input_text",
                    "text": "描述这张图片中的内容"
                },
                {
                    "type": "input_image",
                    "image_url": "https://example.com/example.jpg"
                },
            ],
        }
    ],
}


# ==================== 发送请求 ====================

try:
    response = requests.post(url, headers=headers, data=json.dumps(payload))
    response.raise_for_status()

    print("请求成功")
    print("=" * 60)
    print("API 返回结果:")
    print("=" * 60)
    print(json.dumps(response.json(), indent=4, ensure_ascii=False))

except requests.exceptions.RequestException as e:
    print(f"请求失败: {e}")
except ValueError as e:
    print(f"数据解析错误: {e}")

说明

示例中的 https://example.com/example.jpg 请替换为你自己的图片 URL。图片地址需要能被服务器正常访问,否则模型无法读取图片内容

响应示例

成功响应会返回 JSON 数据,模型生成的图片描述通常位于 output 数组中的 output_text 内容里。

{
    "id": "resp_example",
    "object": "response",
    "model": "gpt-5-mini",
    "usage": {
        "total_tokens": 1473,
        "input_tokens": 935,
        "output_tokens": 538
    },
    "created_at": 1762513567,
    "status": "completed",
    "output": [
        {
            "id": "rs_example",
            "type": "reasoning",
            "summary": []
        },
        {
            "id": "msg_example",
            "type": "message",
            "status": "completed",
            "content": [
                {
                    "type": "output_text",
                    "text": "这是一张台式计算器的近拍照片。画面中可以看到计算器的显示屏、数字按键、运算按键和周围桌面物品。整体为俯视拍摄,光线均匀,主体清晰。"
                }
            ],
            "role": "assistant"
        }
    ],
    "reasoning": {
        "effort": "medium",
        "summary": null
    },
    "store": true,
    "temperature": 1.0,
    "text": {
        "format": {
            "type": "text"
        },
        "verbosity": "medium"
    }
}

读取图片分析结果

如果你只想取出模型生成的文本,可以从返回数据中读取:

data = response.json()
text = data["output"][1]["content"][0]["text"]
print(text)

实际项目中建议先判断 outputcontenttype 是否存在,避免异常响应导致程序报错。

注意事项

  • 请将示例中的 sk-*************************** 替换为你的真实 API Key。
  • API Key 请妥善保管,不要泄露或提交到公开仓库。
  • 图片 URL 必须可公开访问,或至少能被 MaomaoToken 服务端正常访问。
  • 图片体积过大、访问速度过慢或链接失效,可能导致请求失败或超时。
  • 图片内容识别结果由模型生成,仅供参考;涉及商品参数、合同、票据等重要信息时,建议人工复核。

On this page