共 27 篇文章

标签：OCR 第2页

Surya：专业多语言文档OCR工具，开源本地部署

综合介绍 Surya是一个开源的多语言文档OCR工具包，支持90多种语言的文本识别。它不仅能够进行逐行文本检测，还能进行布局分析、阅读顺序检测和表格识别。Surya的性能与云服务相媲美，适用于各种类型的文档，包括P...

综合介绍 MinerU是由上海人工智能实验室OpenDataLab团队开发的一款开源数据提取工具，专注于从复杂的PDF文档、网页和电子书中高效提取内容。它能够将包含图片、公式、表格等元素的多模态PDF文档转化为易于分析的M...

开启 Builder 智能编程模式，无限量使用 DeepSeek-R1 和 DeepSeek-V3 ，对比海外版体验更加流畅。只需输入中文指令，不懂编程的小白也可以零门槛编写自己的应用。

2025-04-21

综合介绍 PixPin是一款功能强大的截图和贴图工具，旨在提升用户的工作效率。无论是日常办公还是专业需求，PixPin都能提供便捷的截图、贴图、长截图、文字识别（OCR）和动态截图功能。其简洁的界面和丰富的功能使...

综合介绍 GOT-OCR2.0是一个阶跃星辰联合推出de 开源光学字符识别（OCR）模型，旨在通过一个统一的端到端模型推动OCR技术向OCR-2.0迈进。该模型支持多种OCR任务，包括普通文本识别、格式化文本识别、细粒度OCR、多...

综合介绍 PaddleOCR 是一个基于 PaddlePaddle 的多语言 OCR 工具包，旨在提供实用且超轻量级的 OCR 系统。它支持超过 80 种语言的识别，并提供数据标注和合成工具，支持在服务器、移动设备、嵌入式和物联网设备上...

Pix2Text 综合介绍 Pix2Text (P2T) 是一个开源的免费工具，旨在替代 Mathpix，提供图片文字和数学公式识别功能。用户可以通过网页版免费使用该工具，每天最多识别 10000 个字符。P2T 支持将图片中的文字、表格、...

Umi-OCR 综合介绍 Umi-OCR是一款开源、免费的离线OCR软件，支持截屏、批量导入图片、PDF文档识别、排除水印和页眉页脚、扫描和生成二维码。该软件内置多国语言库，适用于Windows和Linux系统。Umi-OCR无需安装，解...

TTime 综合介绍 TTime 是由 InkTimeRecord 发布在 GitHub 上的项目，是一款简洁高效的翻译软件。它主要提供输入、截图、划词及悬浮球翻译等功能，支持多种翻译源和文字识别服务，让用户能够快速进行语言转换和文...