图像在线识别-图像在线识别文档介绍内容-移动阿里云

RecognizeCarInvoice-机动车销售统一发票识别

多类型覆盖支持模糊、光照不均、透视畸变、任意背景等低质量图像识别。高精度识别总体识别准确率可达 98%。如何使用本接口步骤概述 1 开通票据凭证识别服务。开通服务前后，您可以通过体验馆免费体验本功能识别效果。2 购买机动车...

文字提取

通义千问OCR 是专用于文字提取的视觉理解模型，可从各类图像（如扫描文档、表格、票据等）中提取文本或解析结构化数据，支持识别多种语言，并能通过特定任务指令实现信息抽取、表格解析、公式识别等高级功能。您可以在阿里云百炼平台...

RecognizeMixedInvoices-混贴发票识别

多类型覆盖支持模糊、光照不均、透视畸变、任意背景等低质量图像识别。高精度识别总体识别准确率可达 98%。如何使用本接口步骤概述 1 开通票据凭证识别服务。开通服务前后，您可以通过体验馆免费体验本功能识别效果。2 购买混贴...

进阶指南

MPImageGrayListener（废弃）/*获取识别图像的平均灰度值*正常范围大约在 50-140 之间，*当灰度值低于或高于正常范围时，通常意味着环境亮度过低或过高，可以提示用户打开或关闭手电筒*注意：该方法在识别过程中会不断被调用*@param gray ...

多媒体分析

年龄分析 1次基础模型服务 识别图像中主体人脸（唯一）的年龄区间。如果图像中有多个人脸，则只会返回区域最大的主体人脸的结果。如果图像中没有检测到人脸，将返回错误提示。年龄区间包含：'0-2'、'3-9'、'10-19'、'20-29'、'30-39'、'40-...

图像擦除补全

AI擦除补全功能能够自动识别和移除图像中的多种图像格式和尺寸元素的对象，精确识别图像中的对象，确保擦除对象的准确性和补全对象的一致性&自然性。企业级平台服务提供在高并发、大流量下的稳定写真图片生成响应和99.9%的可靠性保障，可...

商品分类

功能描述商品分类能力可以识别图像中的商品分类，返回商品类目、置信度等信息。目前已经支持服饰鞋包、3C数码、家居用品等超过六千种类目分类。说明您可以进入在线咨询获取在线人工帮助。当前能力可在视觉智能开放平台有完整的免费产品...

RecognizeBirthCertification-出生证明识别

多类型覆盖支持模糊、光照不均、透视畸变、任意背景等低质量图像识别。高精度识别总体识别准确率可达 98%。如何使用本接口步骤概述 1 开通个人证照识别服务。开通服务前后，您可以通过体验馆免费体验本功能识别效果。2 购买出生...

头发分割

功能描述头发分割能力用于识别图像中的人物头像，然后对人物头像区域进行抠图解析，最后输出PNG格式的人物头发矩形透明图。说明您可以进入在线咨询获取在线人工帮助。当前能力可在视觉智能开放平台有完整的免费产品体验，您可以单击 ...

base64,{base64_data} def encode_file(file_path):mime_type,_=mimetypes.guess_type(file_path)if not mime_type or not mime_type.startswith("image/"):raise ValueError("不支持或无法识别的图像格式")with open(file_path,"rb")as ...

2021年

2021-07-31 华东2（上海）PDF识别图像分析处理主动脉瘤肺动脉高压检测可以对输入的胸部CT平扫DICOM影像数据中的主动脉及肺动脉进行分割，并分别提取其中心线，然后根据中心线生成最佳视角的Stretch CPR图像、Cross Section图像及环绕...

产品功能

IVPD提供以下功能。IVPD提供以下功能图像处理 ...输入图：识别出的风格标签：风格类型：视觉风格：中国风，语义风格：典雅图像元素识别识别输入图中所包含的元素，用矩形框标注出其位置，并区分其对应的基本类型（人/物、修饰、文案）。

产品简介

离线视频分割SDK（iOS）文字离线识别 证件识别SDK（Android）支持身份证、驾驶证、行驶证正反面离线识别，可识别常用多个关键字段内容，识别精准度超过95%。证件识别SDK（iOS）车辆类识别SDK（Android）支持扫描识别中国内地所有单行车牌及...

通义晓蜜CCAI-对话分析AIO计费项变更通知

调整内容新增计费类型：本次调整后，语音识别能力通过API接入方式实现离线语音转译服务将进行收费：离线语音识别：0.33元/小时新增图片识别能力，通过通义晓蜜-VLMax模型实现图片文字识别、总结、推理，该服务的API接入将进行收费。...

应用场景

图像识别：将图像检测目标剪裁后配合图像识别提升识别精度。目标定位：对海量图片进行分类、打标签。图片分类通过识别图片信息实现分类管理，得出正确结果。EAIS在推理场景中支持更灵活的配置和丰富的网络访问。自然语言处理支持对字、词...

访问域名

访问域名允许应用程序通过HTTP/HTTPS协议向特定的、与各类目能力关联的域名发送请求，从而实现对人脸人体识别、文字识别、图像识别等多种视觉AI能力的调用。其中，Region表示服务所在的地域，Endpoint表示视觉智能开放平台对外服务的访问...

证件识别SDK

应用场景离线证件识别：银行卡、身份证、驾驶证等离线证件识别场景，基于手机或安卓类硬件集成该功能，实现证件的高效识别。前提条件使用SDK前需完成激活授权，具体请参见激活并授权离线SDK。计费说明关于证件识别SDK的报价，请参见 ...

人像素描风格化

功能描述人像素描风格化能力可以对一张人物图像自动识别其头部区域，生成大头照下的素描画效果。返回结果的分辨率固定为512x512像素。关于该接口功能的示例图如下：输入原图输出效果图说明您可以进入在线咨询获取在线人工帮助。当前...

人物实例分割

人物实例分割可以识别出图像中的不同人物对象，并画出每个对象边界的像素级掩码。重要本文档仅适用于“中国大陆（北京）”地域，需使用“中国大陆（北京）”地域的 API Key。image-instance-segmentation 模型当前仅提供免费体验，免费...

智能标签

视频文字识别标签OCR 识别视频图像中的文字，提取图像文本内容。视频语音识别标签ASR 分析视频中的语音信息，提取语音文本内容。视频标签分析视频中节目、人物角色、物体、场景、地域等内容。图片标签分析图片中的人物角色、地域、动作...

RecognizeEstateCertification-不动产权证识别

图像增强默认支持图像增强，包括图像自动旋转、畸变自动矫正、模糊图片自动增强等能力。多类型覆盖支持模糊、光照不均、透视畸变、任意背景等低质量图像识别。高精度识别总体识别准确率可达 98%。如何使用本接口步骤概述 1 开通个人...

分割抠图介绍

能力介绍目前阿里云视觉智能开放平台上线的分割抠图能力包括：类别能力说明人像分割人体分割识别输入图像中的人体轮廓，与背景进行分离，返回分割后的前景人像图（4通道）。适用于单人或多人、复杂背景、各类人体姿态等场景。头像...

添加及管理识别结果

重复记录处理：针对本次上传字段的识别结果与线上已有字段的识别结果重复时的处理策略，支持覆盖线上所有识别结果、覆盖线上所有未被锁定识别结果和保留线上已有识别结果，跳过不更新。覆盖线上所有识别结果：当新增字段与线上字段一致时，...

添加及管理识别结果

重复记录处理：针对本次上传字段的识别结果与线上已有字段的识别结果重复时的处理策略，支持覆盖线上所有识别结果、覆盖线上所有未被锁定识别结果和保留线上已有识别结果，跳过不更新。覆盖线上所有识别结果：当新增字段与线上字段一致时，...

RecognizeInternationalIdcard-国际身份证识别

本接口图片示例本接口核心能力分类概述多国身份证对越南、韩国、印度、孟加拉居民身份证提供识别服务图像增强默认支持图像增强，包括图像自动旋转、畸变自动矫正、模糊图片自动增强等能力。多类型覆盖支持模糊、光照不均、透视畸变...

RecognizeEduQuestionOcr-题目识别

图像增强默认支持图像增强，包括图像自动旋转、畸变自动矫正、模糊图片自动增强等能力。多类型覆盖支持模糊、光照不均、透视畸变、任意背景等低质量图像识别。返回坐标可实现对题目中的配图位置进行检测并返回坐标位置。如何使用本接口 ...

iTAG概述

支持的标注任务 iTAG预置了标注模板，可支持以下类型的标注任务：图像类：图像分类、目标检测、图像OCR、表格识别、图像语义分割。文本类：文本分类、命名实体识别、实体关系识别。视频类：视频分类、视频打点、视频OCR。音频类：音频分类...

文字识别介绍

二维码识别 识别图像中是否含有二维码信息，输出图像中二维码包含的文本信息（每个二维码对应的URL或文本），可支持图像中含有多个二维码识别。资产类证件识别营业执照识别识别营业执照关键字段内容，包括：公司地址、营业范围、注册资本...

DataWorks产品安全能力介绍

说明仅DataWorks企业版支持配置实时及离线风险识别规则，并对检测到的风险事件进行响应。DataWorks提供离线、实时风险响应的基础能力，帮助您感知、处理风险事件。离线风险响应：支持对MaxCompute数据访问/操作配置异常行为相关的离线风险...

API概览

在线调试 SegmentBody 人像分割，识别输入图像中的人体轮廓，与背景进行分离，返回分割后的前景人像图（4通道）。适用于单人/多人、复杂背景、各类人体姿态等场景。在线调试 MakeSuperResolutionImage 图像清晰化/超分辨率，将小图放大四倍...

安全与合规

调用结果实时返回风险识别通过线上实时请求、实时流量进行实时的指标计算、模型计算和策略规则计算，直接为您返回计算结果。整体响应时间根据事件和场景不超过200 ms，最短可以在20 ms 内返回。操作审计风险识别已接入操作审计，帮助您...

10.2.3 系列

移动图像识别 更新修复无存储权限模型加载异常导致的识别报错。可视化埋点更新支持 H5、小程序埋点。H5 容器和离线包修复修复离线包首次 fallback 时，无网络多次打开离线包导致的 ANR 问题。10.2.3.39（2023-12-14）Mriver 小程序 ...

人物实例分割

功能介绍本节点是对万相人物实例分割 API 的封装，可以从用户上传图片中识别出图像中的不同人物对象，并画出每个对象边界的像素级掩码。相关接口说明请参照：人物实例分割、人物实例分割前置依赖您需要已获取API Key 节点清单人像分割...

监控与日志

监控能力风险识别通过线上实时请求、实时流量进行实时的指标计算、模型计算和策略规则计算，实时返回计算结果。这种实时监控能力确保了用户能够及时发现和应对潜在的安全威胁。产品提供了全面的系统运行状态和性能指标监控，帮助用户实时...

功能特性

BlackLevel、PixelBlackThreshold 支持视频水印（明水印）在视频中添加可见的明水印（例如，企业Logo、电视台台标），突出品牌和版权，增加产品识别度。为视频添加不可见的盲水印用于版权追溯，详细说明请参见下文数字水印（暗水印）说明...

视觉智能开放平台的审计事件

说明目前操作审计支持视觉智能开放平台的功能包括：人体人脸识别、图像识别、图像分割、目标检测、OCR识别、视觉智能辅助工具。事件名称事件含义 AddBodyTrace 添加Trace。AddFaceImageTemplate 增加图像人脸融合模板。BatchAddFaces ...

API概览

图像识别（imagerecog）图像识别类目能力开通链接：立即开通分类能力接口名能力中文名说明图像打标 TaggingImage 通用图像打标 识别图像中的主体内容并打上类型标签，支持数千个内容标签，覆盖常见物体品类。TaggingAdImage 广告素材...

公众人物识别

特色优势能够准确识别出图像中的公众人物信息。接入指引 1.注册阿里云账号：打开阿里云官网，在阿里云官网右上角，单击立即注册，按照操作提示完成账号注册。2.开通能力：请确保您已开通人脸人体服务，若未开通服务请立即开通。开通...

通用分割

功能描述通用分割能力可以识别输入图像中视觉中心的物体轮廓，将物体与背景进行分离，返回分割后的前景物体图（4通道）。关于该接口功能的示例图如下：输入原图输出结果图您可以传入ReturnForm参数指定返回结果形式：指定为 crop，对...

车牌识别

功能描述车牌识别能力可以准确识别出图像中车牌位置，输出车牌位置坐标、车牌类型、车牌号码、车牌号码置信度、车牌置信度，共5个关键字段信息。说明您可以进入在线咨询获取在线人工帮助。当前能力可在视觉智能开放平台有完整的免费...