Chunkr-开源基于视觉模型的 PDF数据提取工具

Chunkr-开源基于视觉模型的 PDF数据提取工具

工具介绍

Chunkr 是一个开源基于视觉模型的 PDF数据提取工具,专注于文档布局分析、OCR 和分块处理。它能够将 PDF、DOC、PPT 和 XLS 文件转换为适用于 RAG(检索增强生成)和 LLM(大语言模型)的结构化数据。Chunkr 使用先进的视觉模型和 OCR 技术,提取文档中的边界框和结构化文本,支持文本、表格、图像和手写内容的处理。由 Lumina AI Inc. 维护,支持 GPU 和 CPU 环境,提供免费试用和定价方案。

工具地址

官网:https://chunkr.ai/

GitHub:https://github.com/lumina-ai-inc/chunkr

版权声明 1 本网站名称:Applnn
2 本站永久网址:https://applnn.cc/
3 本站发布的文章及附件仅限用于学习和研究,不得用于商业或非法用途,否则后果请用户自负!
4 本站信息来自网络收集整理,版权争议与本站无关,仅供学习研究,如有侵权请联系客服删除!
5 如果您喜欢该程序和内容,请支持正版,购买注册,得到更好的正版服务。
6 本站资源大多存储在云盘,如发现链接失效,请联系我们我们会第一时间更新。
7 如果您喜欢我们,多多分享给你们朋友吧!
!
也想出现在这里? 联系我们
     广告位
搜索