Surya:专业多语言文档OCR工具,开源本地部署综合介绍 Surya是一个开源的多语言文档OCR工具包,支持90多种语言的文本识别。它不仅能够进行逐行文本检测,还能进行布局分析、阅读顺序检测和表格识别。Surya的性能与云服务相媲美,适用于各种类型...最新AI工具# AI开源项目# OCR8个月前01.6K0
MinerU:PDF文档提取转换为多模态Markdown格式,支持电子书OCR扫描综合介绍 MinerU是由上海人工智能实验室OpenDataLab团队开发的一款开源数据提取工具,专注于从复杂的PDF文档、网页和电子书中高效提取内容。它能够将包含图片、公式、表格等元素的多模态PDF...最新AI工具# AI开源项目# OCR# 文档提取与清洗8个月前01.6K0
PixPin:长截图和动态截图,内置本地文字识别(OCR)综合介绍 PixPin是一款功能强大的截图和贴图工具,旨在提升用户的工作效率。无论是日常办公还是专业需求,PixPin都能提供便捷的截图、贴图、长截图、文字识别(OCR)和动态截图功能。其简洁的界面和...最新AI工具# OCR8个月前01.4K0
GOT-OCR2.0:基于 QWen2 0.5B 端到端的多模态OCR模型综合介绍 GOT-OCR2.0是一个阶跃星辰联合推出de 开源光学字符识别(OCR)模型,旨在通过一个统一的端到端模型推动OCR技术向OCR-2.0迈进。该模型支持多种OCR任务,包括普通文本识别、格...最新AI工具# AI开源项目# OCR9个月前01.4K0
PaddleOCR:基于飞桨的多语言OCR工具库,支持80多种语言识别综合介绍 PaddleOCR 是一个基于 PaddlePaddle 的多语言 OCR 工具包,旨在提供实用且超轻量级的 OCR 系统。它支持超过 80 种语言的识别,并提供数据标注和合成工具,支持在服...最新AI工具# AI开源项目# OCR6个月前01.3K0
Pix2Text:开源免费图片文字识别工具Pix2Text 综合介绍 Pix2Text (P2T) 是一个开源的免费工具,旨在替代 Mathpix,提供图片文字和数学公式识别功能。用户可以通过网页版免费使用该工具,每天最多识别 10000 个...最新AI工具# OCR9个月前01.5K0
Umi-OCR:开源离线OCR软件,批量图片识别和PDF识别Umi-OCR 综合介绍 Umi-OCR是一款开源、免费的离线OCR软件,支持截屏、批量导入图片、PDF文档识别、排除水印和页眉页脚、扫描和生成二维码。该软件内置多国语言库,适用于Windows和Li...最新AI工具# OCR9个月前01.7K0
TTime:图片你文字识别和文字翻译软件TTime 综合介绍 TTime 是由 InkTimeRecord 发布在 GitHub 上的项目,是一款简洁高效的翻译软件。它主要提供输入、截图、划词及悬浮球翻译等功能,支持多种翻译源和文字识别服务...最新AI工具# AI翻译# OCR9个月前01.1K0