Skip to main content

这是什么

「文字识别」是技能库里的新能力:把图片里的文字「读出来」,并尽量整理成可用的字段信息。 你可以把它理解成:用户在你做的产品里上传一张证件、发票、商品图,系统自动识别上面的字,填进表单或进入后续流程——不用自己对接第三方 OCR,也不用手抄。 一句话定位: 将专业文字识别能力整合到产品中:从图片中精准提取文字与结构化信息。

适合做什么

常见场景包括:
  • 证件审核:身份证、护照、驾驶证、行驶证、营业执照等
  • 财务 / 票据:增值税发票、混贴票据、银行卡等
  • 经营场景:车牌、表格、商品图上的文字
  • 通用提字:打印字、手写字
比「随便丢给 AI 看图」更适合单据类:证件、发票会尽量返回字段级结果(姓名、号码、金额等),更准、也更省。

能识别哪些类型

产品说明里写明的品类约十二类,包括:
  • 通用文字
  • 手写文字
  • 身份证
  • 银行卡
  • 行驶证
  • 驾驶证
  • 护照
  • 营业执照
  • 增值税发票
  • 混贴票据
  • 车牌
  • 表格
覆盖电商、经营、审核类高频需求。

核心能力


入口位置

  1. 进入任意项目。
  2. 顶部切换到 「研发」 Tab。
  3. 左侧导航选择 「技能库」
  4. 在卡片列表中找到 「文字识别」

怎么接入(三步)

  1. 在对话里说「我要做证件 / 发票识别」,或在技能页点右上角 「使用」
  2. superun 自动帮项目接入 OCR 能力(官方技能,快速接入)。
  3. 在你的产品里让用户上传图片即可识别。
启用后,技能详情有 「介绍 / 使用」 页;「使用」页会显示已启用状态,并常驻隐私提醒。

计费怎么理解

  • 按次:识别成功扣一次;失败不扣。
  • 费用从项目 / 账户算力相关消耗里出,账单里可对上 「文字识别」 类消费。
  • 具体单价以实际账单为准(产品内未写死单价文案)。

隐私与合规(必看)

产品里会固定提示:
  • 证件、发票含敏感个人信息。
  • 平台不留存原图与识别结果,即用即弃。
  • 使用他人证件图片前,请确认已获得当事人授权。
做实名、开户、报销类产品时,建议在你自己的产品里也加授权说明。

和自己接云厂商 OCR 的差别

适合想快速给产品加上「拍图识字 / 识证件」的用户,尤其是不想单独接云服务的人。

常见问题

不会。按次计费且仅在识别成功时扣费;失败不扣费。
在算力账单中可按消费类型查看,对应「文字识别」类映射(以产品内账单展示为准)。
不会。平台不留存原图与识别结果,用完即弃。使用他人证件前仍须获得当事人授权。