TextIn

6小时前发布 3 0 0

将 PDF、扫描件与图片还原为带坐标和证据链的结构化数据,复杂表格与百页长文档解析稳定,适合知识库、RAG 与合同比对等场景。

所在地:
中国
语言:
中文
收录时间:
2026-08-20
价格免费周期额度按量付费
平台网页版APISDK

TextIn详细介绍

TextIn 是合合信息旗下的智能文档处理平台,核心是把 PDF、扫描件和拍照图片变成大模型能直接读的结构化数据。TextIn 最让人省心的是复杂表格还原,有线表、无线表和跨页表都能拆出来,做金融研报和年报时这项能力很关键。

我接触 TextIn 是从搭知识库开始的。把几百页产品手册丢给 TextIn 的 xParse,出来的 Markdown 保留了标题层级和表格,连公式与印章位置都带坐标,喂给 RAG 之后问答的幻觉明显比用开源解析组件时少。之前用某开源 PDF 解析搭问答产品,用户吐槽格式乱,换成 TextIn 之后负面反馈少了很多。

TextIn 在长文档上速度也够快,百页合同几分钟就能解析完,合同比对还能定位段落和表格的差异,法务审版本时省掉大量肉眼核对。不足的地方在于私有化部署的沟通和报价周期偏长,小团队想先试水还是走云端 API 更顺,免费额度足够验证一两个场景。

从使用门槛说,TextIn 更适合需要稳定、可追溯文档输入的团队,而不是只想随手转个 PDF 的个人用户。如果场景里涉及表格、跨页、印章这类复杂版面,TextIn 的解析质量值得专门测一轮。

TextIn的核心功能

  • AI文档解析TextIn xParse 把 PDF、Word、PPT、图片等近 20 种格式解析为 Markdown 或 JSON,自动识别文本、表格、公式、印章、手写体等元素,并保留每个内容在原文档中的坐标,方便结果溯源。
  • AI文字识别通用 OCR 支持 50 多种语言的印刷体与手写体,能处理抖动模糊、歪斜、反光等复杂场景,纸质文档拍照即可转成可编辑文字。
  • AI表格识别针对有线表、无线表、跨页表、合并单元格等复杂表格做精准还原,金融年报和研报表格可输出为 HTML,表格还原相似度超过 83%。
  • 智能合同比对:多格式文档一键比对,精准定位文本段落、表格、印章之间的差异,分钟级完成百页文档比对,差异结果可一键导出。
  • 文档图像增强:自动切边矫正、透视矫正、增强扫描件可读性,还能擦除手写批注、去除水印与屏幕纹。
  • 知识库与写作助手:IntFinQ 支持多种文件格式沉淀为个人知识库,结合知识检索与智能辅助创作提升写作效率。

TextIn的价格详情

免费权益:

新用户注册赠送 100 页 xParse 解析额度,添加 TextIn 福利官可加赠 1000 页;TextIn Tools 在线工具每日提供 200 页免费识别额度(价格可能随官方调整)。

收费模式:

套餐 价格 包含内容
xParse 新客体验包 9.9 元(约 0.0099 元/页) 1000 页解析额度
1 QPS
有效期 1 年
新客首购限购一次
xParse 标准套餐 50 元(约 0.05 元/页) 1000 页解析额度
1 QPS
有效期 1 年
xParse 2 万页套餐 940 元(约 0.047 元/页) 2 万页解析额度
2 QPS
有效期 1 年
xParse 10 万页套餐 4550 元(约 0.0455 元/页) 10 万页解析额度
2 QPS
有效期 1 年
xParse 50 万页套餐 21000 元(约 0.042 元/页) 50 万页解析额度
2 QPS
有效期 1 年
xParse 按量计费 约 0.35 元/页(处理失败不计费) 按 T 币/页计费
优先消耗即将到期的套餐包
未购套餐按 T 币余额扣减
支持 textin、mineru、paddle 等解析引擎按速度与精度切换
xParse 私有化部署 按年付费或买断,需商务询价 支持内网与国产化芯片、信创环境
高并发与日志审计
权限控制
当前主推产品为 xParse 智能文档解析,版本以官网为准

TextIn的应用场景

  • 知识库与 RAG 搭建:把产品手册、行业研报、内部文档交给 TextIn 解析成结构化数据,接入向量库后做带溯源的问答,减少大模型幻觉。
  • 金融财报处理:上市公司年报、季报中的有线表与无线表自动拆成 HTML,快速抽取资产负债表、利润表等结构化字段。
  • 合同审核与比对:法务把多个版本的合同丢进 TextIn,分钟级定位条款、表格和印章差异,省去逐页肉眼核对。
  • 票据与表单录入:财务用 TextIn 识别增值税发票、医疗票据等,自动抽取关键字段进入报销与审计流程。
  • 长文档翻译与摘要:百页 PDF 先由 TextIn 解析保留版面,再交给翻译或摘要模型,输出格式不乱。
  • 教育题库与论文清洗:试卷、论文中的公式和图表被识别提取,整理成可检索的题库或语料。

TextIn的适用人群

  • 开发者:通过 API 与 SDK 把文档解析能力嵌入 RAG、智能体或业务系统,几行代码即可上线生产级文档工作流。
  • 法务:用合同比对快速核对多版本条款差异,处理百页合同也不再依赖大量人工审阅。
  • 金融从业者:自动解析年报、研报中的复杂表格,抽取关键财务字段用于风控与投研。
  • 科研人员:把论文、古籍中的公式、图表和文字提取为结构化数据,便于文献整理与语料清洗。
  • 办公与知识管理团队:将分散的 PDF、扫描件转为可检索的知识库,提升内部资料复用效率。

同类工具对比

对比维度 TextIn(本工具) 百度智能云文字识别 阿里云文档智能 ABBYY 达观数据
定位 面向 LLM 与 Agent 的文档智能基础设施,把 PDF、扫描件、图片解析为带坐标和证据链的结构化数据。 百度智能云旗下的通用 OCR 与文档识别服务,覆盖卡证、票据、表格等场景。 阿里云提供的文档智能解析与抽取服务,面向企业非结构化文档处理。 老牌桌面与服务器端 OCR 厂商,主打 PDF 转换与文档数字化。 国内文档智能与 RPA 厂商,覆盖文档抽取、审核与流程自动化。
核心优势 复杂表格与跨页版面还原强,百页长文档解析速度快,解析结果可溯源,幻觉率低。 中文识别准确率高,与百度云生态和飞桨模型打通,企业集成成本低。 与阿里云大数据和通义大模型协同,文档抽取和分类能力完整。 欧美语言 OCR 精度高,FineReader 桌面体验成熟,格式保留好。 深耕中文行业文档,RPA 与文档处理结合,落地金融政企经验多。
主要短板 私有化部署沟通与报价周期偏长,个人轻度用户的使用成本高于普通 PDF 工具。 复杂表格与跨页版面还原能力弱于专业文档解析产品,长文档结构化输出不够完整。 表格还原精度与坐标溯源能力一般,私有化适配不如老牌 OCR 厂商。 对中文复杂版面与表格的适配一般,缺少面向大模型的结构化输出与 API 生态。 通用文档解析和复杂表格还原不如专业解析引擎,API 生态偏私有化。
价格 xParse 按量计费约 0.35 元/页,套餐包 9.9 元起,新用户赠免费额度,私有化需询价。 按调用量计费,提供免费额度与资源包,企业可谈年框。 按页或按调用量计费,资源包阶梯折扣。 桌面版买断,企业服务端按授权或订阅收费。 以项目制和私有化授权为主,需商务询价。
适合谁 适合搭建知识库、RAG、合同比对与金融财报处理的开发者与企业团队。 适合已有百度云体系、以卡证票据识别为主的团队。 适合使用阿里云、需要文档抽取落表的业务。 适合以欧美文档、PDF 转 Word 为主的个人与企业。 适合政企金融、要 RPA 加文档处理的重交付场景。

相关导航

暂无评论

用户投票:

none
暂无评论...