name: 图片工具集 description: 包括通用文本识别、手写识别、车牌识别、身份证识别、日常物体检测、昆虫识别、植物识别、护照识别、港澳台通行证识别、银行卡识别、营业执照识别、驾驶证识别、行驶证识别、动物识别、电动自行车检测、手机检测、手势检测、火焰检测、香烟检测、人头人体检测、野生动物检测、鸟类识别、宠物情绪识别和万物识别。 version: 1.0.2 slug: pic displayName: 图片工具集 summary: 包括通用文本识别、手写识别、车牌识别、身份证识别、日常物体检测、昆虫识别、植物识别、护照识别、港澳台通行证识别、银行卡识别、营业执照识别、驾驶证识别、行驶证识别、动物识别、电动自行车检测、手机检测、手势检测、火焰检测、香烟检测、人头人体检测、野生动物检测、鸟类识别、宠物情绪识别和万物识别。 license: MIT
包括通用文本识别、手写识别、车牌识别、身份证识别、日常物体检测、昆虫识别、植物识别、护照识别、港澳台通行证识别、银行卡识别、营业执照识别、驾驶证识别、行驶证识别、动物识别、电动自行车检测、手机检测、手势检测、火焰检测、香烟检测、人头人体检测、野生动物检测、鸟类识别、宠物情绪识别和万物识别。
此 Skill 必须配置 API 密钥才能使用。
.env 中没有 XBY_APIKEY,必须使用 AskUserQuestion 工具向用户询问 API 密钥scripts.config.set_api_key(api_key) 保存,然后继续处理你(大模型)是路由层,负责理解用户意图、选择工具、提取参数。代码只负责调用API。
用户输入 → 你选择工具 → 提取该工具需要的参数 → 调用 scripts.tools 中的函数 → 返回结果给用户
scripts.config.settings.api_key 为空,使用 AskUserQuestion 询问用户,拿到后调用 scripts.config.set_api_key(key) 保存scripts.tools 中的函数,例如 scripts.tools.search_schools(score='520', province='北京', category='综合')raw 数据整理后展示给用户根据用户意图选择对应的工具函数:
| 用户意图 | 工具函数 |
|---|---|
| 兼顾速度与精度的文字识别。输入包含文本的图像,自动检测并识别内容。适用于各类文档、广告牌、屏幕截图等场景。 需要输入图片文件链接。 | scripts.tools.ocr |
| 兼顾速度与精度的文字识别。输入包含文本的图像,自动检测并识别内容。适用于各类文档、广告牌、屏幕截图等场景。 需要输入图片文件的BASE64编码。 | scripts.tools.ocr_for_data_base64 |
| 高精度文字识别。输入包含文本的图像,自动检测并识别内容。适用于各类文档、广告牌、屏幕截图等场景。 需要输入图片文件链接。 | scripts.tools.ocr_pro |
| 高精度文字识别。输入包含文本的图像,自动检测并识别内容。适用于各类文档、广告牌、屏幕截图等场景。 需要输入图片文件的BASE64编码。 | scripts.tools.ocr_pro_for_data_base64 |
| 输入包含手写文本的图像,自动检测文本行并识别内容。适用于手写笔记、签名、手写表单等。 需要输入图片文件链接。 | scripts.tools.ocr_handwriting |
| 输入包含手写文本的图像,自动检测文本行并识别内容。适用于手写笔记、签名、手写表单等。 需要输入图片文件的BASE64编码。 | scripts.tools.ocr_handwriting_for_data_base64 |
| 识别车牌号、车牌颜色、单/双层车牌、位置框。 需要输入图片文件链接。 | scripts.tools.plate_recognition |
| 识别车牌号、车牌颜色、单/双层车牌、位置框。 需要输入图片文件的BASE64编码。 | scripts.tools.plate_recognition_for_data_base64 |
| 识别银行卡号、发卡银行和卡类型,使用 Luhn 算法校验卡号有效性。 需要输入图片文件链接。 | scripts.tools.ocr_bank_card |
| 识别银行卡号、发卡银行和卡类型,使用 Luhn 算法校验卡号有效性。 需要输入图片文件的BASE64编码。 | scripts.tools.ocr_bank_card_for_data_base64 |
| 识别营业执照的统一社会信用代码、名称、法定代表人、注册资本、成立日期、经营范围、登记机关和住所地址。 需要输入图片文件链接。 | scripts.tools.ocr_biz_license |
| 识别营业执照的统一社会信用代码、名称、法定代表人、注册资本、成立日期、经营范围、登记机关和住所地址。 需要输入图片文件的BASE64编码。 | scripts.tools.ocr_biz_license_for_data_base64 |
| 识别驾驶证主页(证号、姓名、性别、国籍、住址、出生日期、准驾车型、初次领证日期、有效期限)和副页(档案编号)。 需要输入图片文件链接。 | scripts.tools.ocr_driver_license |
| 识别驾驶证主页(证号、姓名、性别、国籍、住址、出生日期、准驾车型、初次领证日期、有效期限)和副页(档案编号)。 需要输入图片文件的BASE64编码。 | scripts.tools.ocr_driver_license_for_data_base64 |
| 识别机动车行驶证的号牌号码、车辆类型、所有人、住址、品牌型号、发动机号码、车辆识别代号等信息,支持自动方向检测和主副页过滤。 需要输入图片文件链接。 | scripts.tools.ocr_vehicle_license |
| 识别机动车行驶证的号牌号码、车辆类型、所有人、住址、品牌型号、发动机号码、车辆识别代号等信息,支持自动方向检测和主副页过滤。 需要输入图片文件的BASE64编码。 | scripts.tools.ocr_vehicle_license_for_data_base64 |
| 识别身份证正面(姓名、性别、民族、出生日期、住址、身份证号)和背面(签发机关、有效期限),自动判断正反面并校验身份证号有效性。 需要输入图片文件链接。 | scripts.tools.ocr_id_card |
| 识别身份证正面(姓名、性别、民族、出生日期、住址、身份证号)和背面(签发机关、有效期限),自动判断正反面并校验身份证号有效性。 需要输入图片文件的BASE64编码。 | scripts.tools.ocr_id_card_for_data_base64 |
| 识别港澳通行证、台湾通行证的通行证号码、姓名、性别、出生日期、有效期、签发地点等信息,支持MRZ机读码解析。 需要输入图片文件链接。 | scripts.tools.ocr_pass |
| 识别港澳通行证、台湾通行证的通行证号码、姓名、性别、出生日期、有效期、签发地点等信息,支持MRZ机读码解析。 需要输入图片文件的BASE64编码。 | scripts.tools.ocr_pass_for_data_base64 |
| 识别护照号码、中文姓名、英文姓名、性别、国籍、出生日期、签发日期、有效期至、签发地点等信息,支持MRZ机读码解析。 需要输入图片文件链接。 | scripts.tools.ocr_passport |
| 识别护照号码、中文姓名、英文姓名、性别、国籍、出生日期、签发日期、有效期至、签发地点等信息,支持MRZ机读码解析。 需要输入图片文件的BASE64编码。 | scripts.tools.ocr_passport_for_data_base64 |
| 输入一张图像,对其中的人/宠物/车/火焰/纸箱进行检测,输出图片中所有目标的检测框、置信度和标签。 需要输入图片文件链接。 | scripts.tools.daily_object_detection |
| 输入一张图像,对其中的人/宠物/车/火焰/纸箱进行检测,输出图片中所有目标的检测框、置信度和标签。 需要输入图片文件的BASE64编码。 | scripts.tools.daily_object_detection_for_data_base64 |
| 识别昆虫或其他节肢动物名称(或所属目, 科, 属, 种)。 需要输入图片文件链接。 | scripts.tools.insect_recognition |
| 识别昆虫或其他节肢动物名称(或所属目, 科, 属, 种)。 需要输入图片文件的BASE64编码。 | scripts.tools.insect_recognition_for_data_base64 |
| 识别植物名称(或所属科, 属, 种或亚种)。 需要输入图片文件链接。 | scripts.tools.plant_recognition |
| 识别植物名称(或所属科, 属, 种或亚种)。 需要输入图片文件的BASE64编码。 | scripts.tools.plant_recognition_for_data_base64 |
| 对含有动物的图像进行标签识别,无需任何额外输入,输出动物的类别标签。 需要输入图片文件链接。 | scripts.tools.animal_recognition |
| 对含有动物的图像进行标签识别,无需任何额外输入,输出动物的类别标签。 需要输入图片文件的BASE64编码。 | scripts.tools.animal_recognition_for_data_base64 |
| 输入一张图像,对其中的手机进行检测,输出图片中所有目标的检测框、置信度和标签。 需要输入图片文件链接。 | scripts.tools.cellphone_detection |
| 输入一张图像,对其中的手机进行检测,输出图片中所有目标的检测框、置信度和标签。 需要输入图片文件的BASE64编码。 | scripts.tools.cellphone_detection_for_data_base64 |
| 输入一张图像,对其中的电动自行车进行检测,输出图片中所有目标的检测框、置信度和标签。 需要输入图片文件链接。 | scripts.tools.ebike_detection |
| 输入一张图像,对其中的电动自行车进行检测,输出图片中所有目标的检测框、置信度和标签。 需要输入图片文件的BASE64编码。 | scripts.tools.ebike_detection_for_data_base64 |
| 检测各类通用场景中出现的火焰,最佳使用场景:安防摄像头、交通摄像头视角。 需要输入图片文件链接。 | scripts.tools.fire_detection |
| 检测各类通用场景中出现的火焰,最佳使用场景:安防摄像头、交通摄像头视角。 需要输入图片文件的BASE64编码。 | scripts.tools.fire_detection_for_data_base64 |
| 对包含主体物体的图像进行标签识别,输出主体物体的类别标签,目前已经覆盖了5万多类的物体类别。 需要输入图片文件链接。 | scripts.tools.general_recognition |
| 对包含主体物体的图像进行标签识别,输出主体物体的类别标签,目前已经覆盖了5万多类的物体类别。 需要输入图片文件的BASE64编码。 | scripts.tools.general_recognition_for_data_base64 |
| 输入一张图像,对其中的手势进行检测,输出图片中所有目标的检测框、置信度和标签。 需要输入图片文件链接。 | scripts.tools.gesture_detection |
| 输入一张图像,对其中的手势进行检测,输出图片中所有目标的检测框、置信度和标签。 需要输入图片文件的BASE64编码。 | scripts.tools.gesture_detection_for_data_base64 |
| 输入一张图像,对其中的人头人体进行检测,输出图片中所有目标的检测框、置信度和标签。 需要输入图片文件链接。 | scripts.tools.head_person_detection |
| 输入一张图像,对其中的人头人体进行检测,输出图片中所有目标的检测框、置信度和标签。 需要输入图片文件的BASE64编码。 | scripts.tools.head_person_detection_for_data_base64 |
| 输入一张图像,对其中的香烟目标进行检测,输出图片中所有目标的检测框、置信度和标签。 需要输入图片文件链接。 | scripts.tools.smoking_detection |
| 输入一张图像,对其中的香烟目标进行检测,输出图片中所有目标的检测框、置信度和标签。 需要输入图片文件的BASE64编码。 | scripts.tools.smoking_detection_for_data_base64 |
| 输入一张图像,输出图像中所有识别到的野生动物的检测框、置信度及标签。 需要输入图片文件链接。 | scripts.tools.wild_animals_detection |
| 输入一张图像,输出图像中所有识别到的野生动物的检测框、置信度及标签。 需要输入图片文件的BASE64编码。 | scripts.tools.wild_animals_detection_for_data_base64 |
| 检测并识别图片中的鸟类。 需要输入图片文件链接。 | scripts.tools.bird_detection |
| 检测并识别图片中的鸟类。 需要输入图片文件的BASE64编码。 | scripts.tools.bird_detection_for_data_base64 |
| 识别宠物面部表情,输出 4 类情绪: Angry / Happy / Relaxed / Sad。 需要输入图片文件链接。 | scripts.tools.pet_emotion_recognition |
| 识别宠物面部表情,输出 4 类情绪: Angry / Happy / Relaxed / Sad。 需要输入图片文件的BASE64编码。 | scripts.tools.pet_emotion_recognition_for_data_base64 |
如果参数不完整,使用 AskUserQuestion 向用户询问缺失的参数。
工具描述:兼顾速度与精度的文字识别。输入包含文本的图像,自动检测并识别内容。适用于各类文档、广告牌、屏幕截图等场景。 需要输入图片文件链接。
| 参数名称 | 参数类型 | 是否必填 | 默认值 | 描述 |
|---|---|---|---|---|
| dataUrl | string | true | 图片文件链接地址 |
工具描述:兼顾速度与精度的文字识别。输入包含文本的图像,自动检测并识别内容。适用于各类文档、广告牌、屏幕截图等场景。 需要输入图片文件的BASE64编码。
| 参数名称 | 参数类型 | 是否必填 | 默认值 | 描述 |
|---|---|---|---|---|
| dataBase64 | string | true | base64 encoded data of image file |
工具描述:高精度文字识别。输入包含文本的图像,自动检测并识别内容。适用于各类文档、广告牌、屏幕截图等场景。 需要输入图片文件链接。
| 参数名称 | 参数类型 | 是否必填 | 默认值 | 描述 |
|---|---|---|---|---|
| dataUrl | string | true | 图片文件链接地址 |
工具描述:高精度文字识别。输入包含文本的图像,自动检测并识别内容。适用于各类文档、广告牌、屏幕截图等场景。 需要输入图片文件的BASE64编码。
| 参数名称 | 参数类型 | 是否必填 | 默认值 | 描述 |
|---|---|---|---|---|
| dataBase64 | string | true | base64 encoded data of image file |
工具描述:输入包含手写文本的图像,自动检测文本行并识别内容。适用于手写笔记、签名、手写表单等。 需要输入图片文件链接。
| 参数名称 | 参数类型 | 是否必填 | 默认值 | 描述 |
|---|---|---|---|---|
| dataUrl | string | true | 图片文件链接地址 |
工具描述:输入包含手写文本的图像,自动检测文本行并识别内容。适用于手写笔记、签名、手写表单等。 需要输入图片文件的BASE64编码。
| 参数名称 | 参数类型 | 是否必填 | 默认值 | 描述 |
|---|---|---|---|---|
| dataBase64 | string | true | base64 encoded data of image file |
工具描述:识别车牌号、车牌颜色、单/双层车牌、位置框。 需要输入图片文件链接。
| 参数名称 | 参数类型 | 是否必填 | 默认值 | 描述 |
|---|---|---|---|---|
| dataUrl | string | true | 图片文件链接地址 |
工具描述:识别车牌号、车牌颜色、单/双层车牌、位置框。 需要输入图片文件的BASE64编码。
| 参数名称 | 参数类型 | 是否必填 | 默认值 | 描述 |
|---|---|---|---|---|
| dataBase64 | string | true | base64 encoded data of image file |
工具描述:识别银行卡号、发卡银行和卡类型,使用 Luhn 算法校验卡号有效性。 需要输入图片文件链接。
| 参数名称 | 参数类型 | 是否必填 | 默认值 | 描述 |
|---|---|---|---|---|
| dataUrl | string | true | 图片文件链接地址 |
工具描述:识别银行卡号、发卡银行和卡类型,使用 Luhn 算法校验卡号有效性。 需要输入图片文件的BASE64编码。
| 参数名称 | 参数类型 | 是否必填 | 默认值 | 描述 |
|---|---|---|---|---|
| dataBase64 | string | true | base64 encoded data of image file |
工具描述:识别营业执照的统一社会信用代码、名称、法定代表人、注册资本、成立日期、经营范围、登记机关和住所地址。 需要输入图片文件链接。
| 参数名称 | 参数类型 | 是否必填 | 默认值 | 描述 |
|---|---|---|---|---|
| dataUrl | string | true | 图片文件链接地址 |
工具描述:识别营业执照的统一社会信用代码、名称、法定代表人、注册资本、成立日期、经营范围、登记机关和住所地址。 需要输入图片文件的BASE64编码。
| 参数名称 | 参数类型 | 是否必填 | 默认值 | 描述 |
|---|---|---|---|---|
| dataBase64 | string | true | base64 encoded data of image file |
工具描述:识别驾驶证主页(证号、姓名、性别、国籍、住址、出生日期、准驾车型、初次领证日期、有效期限)和副页(档案编号)。 需要输入图片文件链接。
| 参数名称 | 参数类型 | 是否必填 | 默认值 | 描述 |
|---|---|---|---|---|
| dataUrl | string | true | 图片文件链接地址 |
工具描述:识别驾驶证主页(证号、姓名、性别、国籍、住址、出生日期、准驾车型、初次领证日期、有效期限)和副页(档案编号)。 需要输入图片文件的BASE64编码。
| 参数名称 | 参数类型 | 是否必填 | 默认值 | 描述 |
|---|---|---|---|---|
| dataBase64 | string | true | base64 encoded data of image file |
工具描述:识别机动车行驶证的号牌号码、车辆类型、所有人、住址、品牌型号、发动机号码、车辆识别代号等信息,支持自动方向检测和主副页过滤。 需要输入图片文件链接。
| 参数名称 | 参数类型 | 是否必填 | 默认值 | 描述 |
|---|---|---|---|---|
| dataUrl | string | true | 图片文件链接地址 |
工具描述:识别机动车行驶证的号牌号码、车辆类型、所有人、住址、品牌型号、发动机号码、车辆识别代号等信息,支持自动方向检测和主副页过滤。 需要输入图片文件的BASE64编码。
| 参数名称 | 参数类型 | 是否必填 | 默认值 | 描述 |
|---|---|---|---|---|
| dataBase64 | string | true | base64 encoded data of image file |
工具描述:识别身份证正面(姓名、性别、民族、出生日期、住址、身份证号)和背面(签发机关、有效期限),自动判断正反面并校验身份证号有效性。 需要输入图片文件链接。
| 参数名称 | 参数类型 | 是否必填 | 默认值 | 描述 |
|---|---|---|---|---|
| dataUrl | string | true | 图片文件链接地址 |
工具描述:识别身份证正面(姓名、性别、民族、出生日期、住址、身份证号)和背面(签发机关、有效期限),自动判断正反面并校验身份证号有效性。 需要输入图片文件的BASE64编码。
| 参数名称 | 参数类型 | 是否必填 | 默认值 | 描述 |
|---|---|---|---|---|
| dataBase64 | string | true | base64 encoded data of image file |
工具描述:识别港澳通行证、台湾通行证的通行证号码、姓名、性别、出生日期、有效期、签发地点等信息,支持MRZ机读码解析。 需要输入图片文件链接。
| 参数名称 | 参数类型 | 是否必填 | 默认值 | 描述 |
|---|---|---|---|---|
| dataUrl | string | true | 图片文件链接地址 |
工具描述:识别港澳通行证、台湾通行证的通行证号码、姓名、性别、出生日期、有效期、签发地点等信息,支持MRZ机读码解析。 需要输入图片文件的BASE64编码。
| 参数名称 | 参数类型 | 是否必填 | 默认值 | 描述 |
|---|---|---|---|---|
| dataBase64 | string | true | base64 encoded data of image file |
工具描述:识别护照号码、中文姓名、英文姓名、性别、国籍、出生日期、签发日期、有效期至、签发地点等信息,支持MRZ机读码解析。 需要输入图片文件链接。
| 参数名称 | 参数类型 | 是否必填 | 默认值 | 描述 |
|---|---|---|---|---|
| dataUrl | string | true | 图片文件链接地址 |
工具描述:识别护照号码、中文姓名、英文姓名、性别、国籍、出生日期、签发日期、有效期至、签发地点等信息,支持MRZ机读码解析。 需要输入图片文件的BASE64编码。
| 参数名称 | 参数类型 | 是否必填 | 默认值 | 描述 |
|---|---|---|---|---|
| dataBase64 | string | true | base64 encoded data of image file |
工具描述:输入一张图像,对其中的人/宠物/车/火焰/纸箱进行检测,输出图片中所有目标的检测框、置信度和标签。 需要输入图片文件链接。
| 参数名称 | 参数类型 | 是否必填 | 默认值 | 描述 |
|---|---|---|---|---|
| dataUrl | string | true | 图片文件链接地址 |
工具描述:输入一张图像,对其中的人/宠物/车/火焰/纸箱进行检测,输出图片中所有目标的检测框、置信度和标签。 需要输入图片文件的BASE64编码。
| 参数名称 | 参数类型 | 是否必填 | 默认值 | 描述 |
|---|---|---|---|---|
| dataBase64 | string | true | base64 encoded data of image file |
工具描述:识别昆虫或其他节肢动物名称(或所属目, 科, 属, 种)。 需要输入图片文件链接。
| 参数名称 | 参数类型 | 是否必填 | 默认值 | 描述 |
|---|---|---|---|---|
| dataUrl | string | true | 图片文件链接地址 |
工具描述:识别昆虫或其他节肢动物名称(或所属目, 科, 属, 种)。 需要输入图片文件的BASE64编码。
| 参数名称 | 参数类型 | 是否必填 | 默认值 | 描述 |
|---|---|---|---|---|
| dataBase64 | string | true | base64 encoded data of image file |
工具描述:识别植物名称(或所属科, 属, 种或亚种)。 需要输入图片文件链接。
| 参数名称 | 参数类型 | 是否必填 | 默认值 | 描述 |
|---|---|---|---|---|
| dataUrl | string | true | 图片文件链接地址 |
工具描述:识别植物名称(或所属科, 属, 种或亚种)。 需要输入图片文件的BASE64编码。
| 参数名称 | 参数类型 | 是否必填 | 默认值 | 描述 |
|---|---|---|---|---|
| dataBase64 | string | true | base64 encoded data of image file |
工具描述:对含有动物的图像进行标签识别,无需任何额外输入,输出动物的类别标签。 需要输入图片文件链接。
| 参数名称 | 参数类型 | 是否必填 | 默认值 | 描述 |
|---|---|---|---|---|
| dataUrl | string | true | 图片文件链接地址 |
工具描述:对含有动物的图像进行标签识别,无需任何额外输入,输出动物的类别标签。 需要输入图片文件的BASE64编码。
| 参数名称 | 参数类型 | 是否必填 | 默认值 | 描述 |
|---|---|---|---|---|
| dataBase64 | string | true | base64 encoded data of image file |
工具描述:输入一张图像,对其中的手机进行检测,输出图片中所有目标的检测框、置信度和标签。 需要输入图片文件链接。
| 参数名称 | 参数类型 | 是否必填 | 默认值 | 描述 |
|---|---|---|---|---|
| dataUrl | string | true | 图片文件链接地址 |
工具描述:输入一张图像,对其中的手机进行检测,输出图片中所有目标的检测框、置信度和标签。 需要输入图片文件的BASE64编码。
| 参数名称 | 参数类型 | 是否必填 | 默认值 | 描述 |
|---|---|---|---|---|
| dataBase64 | string | true | base64 encoded data of image file |
工具描述:输入一张图像,对其中的电动自行车进行检测,输出图片中所有目标的检测框、置信度和标签。 需要输入图片文件链接。
| 参数名称 | 参数类型 | 是否必填 | 默认值 | 描述 |
|---|---|---|---|---|
| dataUrl | string | true | 图片文件链接地址 |
工具描述:输入一张图像,对其中的电动自行车进行检测,输出图片中所有目标的检测框、置信度和标签。 需要输入图片文件的BASE64编码。
| 参数名称 | 参数类型 | 是否必填 | 默认值 | 描述 |
|---|---|---|---|---|
| dataBase64 | string | true | base64 encoded data of image file |
工具描述:检测各类通用场景中出现的火焰,最佳使用场景:安防摄像头、交通摄像头视角。 需要输入图片文件链接。
| 参数名称 | 参数类型 | 是否必填 | 默认值 | 描述 |
|---|---|---|---|---|
| dataUrl | string | true | 图片文件链接地址 |
工具描述:检测各类通用场景中出现的火焰,最佳使用场景:安防摄像头、交通摄像头视角。 需要输入图片文件的BASE64编码。
| 参数名称 | 参数类型 | 是否必填 | 默认值 | 描述 |
|---|---|---|---|---|
| dataBase64 | string | true | base64 encoded data of image file |
工具描述:对包含主体物体的图像进行标签识别,输出主体物体的类别标签,目前已经覆盖了5万多类的物体类别。 需要输入图片文件链接。
| 参数名称 | 参数类型 | 是否必填 | 默认值 | 描述 |
|---|---|---|---|---|
| dataUrl | string | true | 图片文件链接地址 |
工具描述:对包含主体物体的图像进行标签识别,输出主体物体的类别标签,目前已经覆盖了5万多类的物体类别。 需要输入图片文件的BASE64编码。
| 参数名称 | 参数类型 | 是否必填 | 默认值 | 描述 |
|---|---|---|---|---|
| dataBase64 | string | true | base64 encoded data of image file |
工具描述:输入一张图像,对其中的手势进行检测,输出图片中所有目标的检测框、置信度和标签。 需要输入图片文件链接。
| 参数名称 | 参数类型 | 是否必填 | 默认值 | 描述 |
|---|---|---|---|---|
| dataUrl | string | true | 图片文件链接地址 |
工具描述:输入一张图像,对其中的手势进行检测,输出图片中所有目标的检测框、置信度和标签。 需要输入图片文件的BASE64编码。
| 参数名称 | 参数类型 | 是否必填 | 默认值 | 描述 |
|---|---|---|---|---|
| dataBase64 | string | true | base64 encoded data of image file |
工具描述:输入一张图像,对其中的人头人体进行检测,输出图片中所有目标的检测框、置信度和标签。 需要输入图片文件链接。
| 参数名称 | 参数类型 | 是否必填 | 默认值 | 描述 |
|---|---|---|---|---|
| dataUrl | string | true | 图片文件链接地址 |
工具描述:输入一张图像,对其中的人头人体进行检测,输出图片中所有目标的检测框、置信度和标签。 需要输入图片文件的BASE64编码。
| 参数名称 | 参数类型 | 是否必填 | 默认值 | 描述 |
|---|---|---|---|---|
| dataBase64 | string | true | base64 encoded data of image file |
工具描述:输入一张图像,对其中的香烟目标进行检测,输出图片中所有目标的检测框、置信度和标签。 需要输入图片文件链接。
| 参数名称 | 参数类型 | 是否必填 | 默认值 | 描述 |
|---|---|---|---|---|
| dataUrl | string | true | 图片文件链接地址 |
工具描述:输入一张图像,对其中的香烟目标进行检测,输出图片中所有目标的检测框、置信度和标签。 需要输入图片文件的BASE64编码。
| 参数名称 | 参数类型 | 是否必填 | 默认值 | 描述 |
|---|---|---|---|---|
| dataBase64 | string | true | base64 encoded data of image file |
工具描述:输入一张图像,输出图像中所有识别到的野生动物的检测框、置信度及标签。 需要输入图片文件链接。
| 参数名称 | 参数类型 | 是否必填 | 默认值 | 描述 |
|---|---|---|---|---|
| dataUrl | string | true | 图片文件链接地址 |
工具描述:输入一张图像,输出图像中所有识别到的野生动物的检测框、置信度及标签。 需要输入图片文件的BASE64编码。
| 参数名称 | 参数类型 | 是否必填 | 默认值 | 描述 |
|---|---|---|---|---|
| dataBase64 | string | true | base64 encoded data of image file |
工具描述:检测并识别图片中的鸟类。 需要输入图片文件链接。
| 参数名称 | 参数类型 | 是否必填 | 默认值 | 描述 |
|---|---|---|---|---|
| dataUrl | string | true | 图片文件链接地址 |
工具描述:检测并识别图片中的鸟类。 需要输入图片文件的BASE64编码。
| 参数名称 | 参数类型 | 是否必填 | 默认值 | 描述 |
|---|---|---|---|---|
| dataBase64 | string | true | base64 encoded data of image file |
工具描述:识别宠物面部表情,输出 4 类情绪: Angry / Happy / Relaxed / Sad。 需要输入图片文件链接。
| 参数名称 | 参数类型 | 是否必填 | 默认值 | 描述 |
|---|---|---|---|---|
| dataUrl | string | true | 图片文件链接地址 |
工具描述:识别宠物面部表情,输出 4 类情绪: Angry / Happy / Relaxed / Sad。 需要输入图片文件的BASE64编码。
| 参数名称 | 参数类型 | 是否必填 | 默认值 | 描述 |
|---|---|---|---|---|
| dataBase64 | string | true | base64 encoded data of image file |
工具函数返回 dict 对象:
- result["raw"] - API 原始返回数据(JSON),直接将此数据整理后展示给用户
- result["success"] - 是否成功(True/False)
- result["message"] - 状态消息
./
├── scripts/
│ ├── __init__.py
│ ├── config.py # 配置管理 + set_api_key()
│ ├── call_api.py # API 客户端 + call_api()
│ └── tools.py # 工具函数(直接调用)
├── requirements.txt
└── SKILL.md
这是一款功能丰富的图片识别工具,涵盖文字提取、证件识别、动植物分类等日常场景,质量稳定,文档清晰,使用门槛低。优点是功能覆盖面广、接口统一、上手容易;不足是依赖外部 API 服务稳定性,且部分细分功能(如昆虫识别、野生动物检测)的准确性受限于训练数据。总体而言,适合需要快速集成图片识别能力的场景,但对精度要求极高的专业领域需谨慎评估。