
UPDF AI
在 PDF 编辑器里直接对文档提问、总结、翻译并保持原排版,支持转思维导图与扫描件识别,适合深读论文和审合同。
Amazon Textract 是 AWS 上的一项文档理解服务,核心不是单纯把图里的字读出来,而是理解文档结构。把一张发票或者一张表传上去,Amazon Textract 能区分哪些是键值对、哪些是表格单元格,把内容连同位置关系一起返回。
我拿一批采购发票做过测试,纯 OCR 接口读文字几乎不掉字,换成表单分析后,供应商名称、金额、税号这些字段被自动归好位,省掉了原来用正则去抠的麻烦。不过表单分析比纯读字明显更贵,用量大之前最好先估清走哪条接口。手写体这块在干净打印底上尚可,潦草手写还是会漏。
Amazon Textract 的短板在语种,结构化抽取目前主要覆盖英、西、德、法、意、葡几种语言,中日韩的表单字段抽取并不在列,做跨境多语文档得另想办法。另外多页 PDF 要走异步接口轮询任务状态,工程上比同步调用多一点活儿。要是业务已经在 AWS 里,把这套文档理解接进 S3 加 Lambda 的流水线,批量处理几百万页也顺理成章。
AWS 免费套餐在前 90 天提供额度:文字检测每月 1,000 页,表单或表格分析每月 100 页,发票与证件每月各 100 页。价格可能随官方调整。
| 套餐 | 价格 | 包含内容 |
|---|---|---|
| 文字检测 DetectDocumentText | 每页 0.0015 美元(前 100 万页) 每页 0.0006 美元(超过 100 万页) |
返回原始文字块与坐标 单页图片或 PDF 页 同步接口调用 |
| 表单与表格分析 AnalyzeDocument | 表单每页 0.05 美元 表格每页 0.015 美元 签名每页 0.015 美元 |
键值对抽取 表格单元格识别 版面阅读顺序 |
| 发票与证件 AnalyzeExpense / AnalyzeID | 发票每页 0.01 美元 证件每页 0.025 美元 |
发票字段归一化 护照驾照字段抽取 行项目识别 |
| 查询功能 Queries | 每页 0.015 美元 加 每查询 0.005 美元 | 自然语言取数 应对非固定表单 |
| 对比维度 | Amazon Textract(本工具) | Azure AI Vision | Google Document AI | PaddleOCR | Mistral OCR |
|---|---|---|---|---|---|
| 定位 | 云上托管的文档理解服务,主打表单与表格结构化 | Azure 云上的视觉 OCR API | 谷歌云文档 AI 处理器 | 百度开源本地化 OCR 库 | 结构化文档 OCR API |
| 核心优势 | 表单字段和表格单元格开箱即用,无需模板,云生态内集成顺畅 | 印刷手写都稳,语种覆盖广,接入简单 | 发票、收据、证件有专用处理器,准确率高 | 免费、可离线、多语种与版面分析 | 输出带版面标签文本,上百语种,按页计费 |
| 主要短板 | 结构化单价高于纯 OCR,多语种表单仅支持少数语言,多页需异步轮询 | 只返回文字和框,表格结构需自解析 | 按处理器分别计费,表单解析单价较高 | 需自搭环境,无托管结构化抽取 | 表单字段抽取不如本服务专门 |
| 价格 | 文字检测每千页 1.5 美元,表单每千页 15 美元,前 90 天有免费额度 | 免费层每月 5,000 次事务,标准每千次 1 美元 | 通用表单每千页约 65 美元起 | 开源免费,企业支持另议 | 每千页 4 美元 |
| 适合谁 | 处理大量表单、发票、证件的云用户 | 只要读字且已在 Azure 生态的团队 | 需要高精度专用文档处理的谷歌云用户 | 预算敏感或数据不出云的团队 | 做 RAG 与文档解析管线 |







