OCR

「OCR」标签聚合的各栏目已发布内容,按本站发布日期从新到旧排列。

3 条

  1. API产品

    CapSolver

    基于计算机视觉与机器学习的自动验证码识别与网络数据采集加速服务。

    #OCR#浏览器自动化

  2. 文档GitHub

    MonkeyOCR:小参数多模态文档解析模型

    MonkeyOCR 是基于轻量多模态大模型的开源文档解析工具,按结构、识别、关系三步解析 PDF,可还原公式、表格与阅读顺序,输出 Markdown,支持本地 GPU 推理。

    #OCR#结构化抽取

  3. 文档GitHub

    BabelDOC:PDF 论文双语对照翻译库

    把英文 PDF 论文解析重排后生成双语对照文档的开源翻译库,借助大模型翻译,尽量保留公式、表格等原有版式,可作 CLI 使用也能嵌入其他程序。

    #翻译#OCR