Chunkr 是一个开源基于视觉模型的 PDF数据提取工具,专注于文档布局分析、OCR 和分块处理。它能够将 PDF、DOC、PPT 和 XLS 文件转换为适用于 RAG(检索增强生成)和 LLM(大语言模型)的结构化数据。Chunkr 使用先进的视觉模型和 OCR 技术,提取文档中的边界框和结构化文本,支持文本、表格、图像和手写内容的处理。由 Lumina AI Inc. 维护,支持 GPU 和 CPU 环境,提供免费试用和定价方案。
腾讯云: 2H2G 79元/年,新/续同享!
阿里云: 2H2G 99元/年起,云服务器
RackNerd: 便宜高配置VPS,10刀/年起
RAKsmart: 便宜高配置VPS,9.9刀/年起
Namesilo: 国际域名注册商,免费隐私保护