Azure Document Intelligence(原 Form Recognizer)
Azure AI Document Intelligence 提供通用 read OCR 模型,以及面向发票、收据、证件的预置和自定义模型,并支持版面与表格提取。它面向结构化业务文档,而非零散图片。
Microsoft Azure · 原生 OCR 引擎
通过 ExactRead 使用 Azure Document Intelligence 进行 OCR。上传图片或 PDF,提取可复核文本,与其他模型对比,并导出 TXT 或 JSON。Azure Document Intelligence 是来自 Microsoft Azure 的原生 OCR 引擎。
上传一份文档,直接用该模型运行 OCR 看看效果——无需离开本页。
提供方
Microsoft Azure
类型
原生 OCR 引擎
支持格式
图片与 PDF
额度成本
2 额度 / 文档
Azure AI Document Intelligence 提供通用 read OCR 模型,以及面向发票、收据、证件的预置和自定义模型,并支持版面与表格提取。它面向结构化业务文档,而非零散图片。
按页用量计费,预置/自定义模型比纯 read 模型更贵。在 ExactRead 上以额度计费,你可以在一次运行中,用同一份文档与 Textract 和视觉模型对比。
当你需要用原生 OCR 引擎识别图片与 PDF时,Azure Document Intelligence 是不错的选择。由于文档质量参差不齐,ExactRead 允许你单独运行 Azure Document Intelligence,也可以在标准化前与其他 OCR 路由并排对比。
文档质量参差不齐,判断 Azure Document Intelligence 是否合适的唯一可靠方式就是用你自己的文件测试。上传一份样本,在这里直接运行 Azure Document Intelligence,复核提取的文本,并在同一工作区与另一个 OCR 模型对比,再决定是否采用。
每个 Azure Document Intelligence 结果都会保留模型、状态、置信度、告警和结构化 JSON,复核人员能看到接受该输出的依据。已接受结果可导出为 TXT 或 JSON,用于后续流程。
是的。Azure Form Recognizer 已更名为 Azure AI Document Intelligence——同一服务,并扩展了预置和自定义文档模型。
Azure Document Intelligence 是 ExactRead 暴露用于 OCR 的原生 OCR 引擎。判断是否合适的最佳方式,是用你自己的文档测试,并在同一次运行中与另一个模型对比输出。
在 ExactRead 上,Azure Document Intelligence 支持图片与 PDF。上传后,模型列表会根据文件实际兼容性过滤,因此不会启动无法运行的任务。
默认情况下,每次运行 Azure Document Intelligence 处理一份文档消耗 2 个额度。管理员可调整每个模型的额度成本,对比模式会按每个所选模型分别计费。