Documind 是一款文档处理工具,利用 AI 从 PDF 中提取结构化数据。它用于处理 PDF 转换、提取相关信息,并按可自定义的 schema 指定的格式输出结果。项目提供的功能包括从非结构化文档中提取结构化 JSON 输出、将文档转换为 Markdown 格式,以及支持自定义 schema 进行数据提取。 Documind 内置常见 schema 的预定义模板,可配合 OpenAI 以及 Llava、Llama3.2-vision 等自定义 LLM 方案使用。它还能根据文档内容自动生成 schema。项目提供全托管 API 的托管版本,用户可以加入 beta 以使用托管服务。 已发布的功能包括 PDF 提取、基础 schema 定义、结构化 JSON 输出、模板 schema、与 Llama3.2 的本地 LLM 集成、自动生成 schema、文本和 Markdown 的文档格式化器、对 DOCX、PNG、JPG、TXT 和 HTML 的多文件支持,以及 Boolean 和 Enum 等额外的 schema 字段类型。列出的即将推出功能有更多模型、图像提取、高级文档格式化器、数据分类和使用微调模型。 Documind 需要 Ghostscript 和 GraphicsMagick 进行 PDF 和图像处理,另需 Node.js v18+ 和 NPM。可通过 npm 安装,需要包含 OpenAI API 密钥的 .env 文件,采用 AGPL v3.0 许可证。该仓库基于 Zerox 构建。
团队用 Documind 从非结构化文档中提取结构化 JSON 输出。
团队用 Documind 把文档转换为 Markdown 格式。
团队用 Documind 使用自定义 schema 提取数据。
团队用 Documind 借助内置模板处理常见文档类型。
团队用 Documind 根据文档内容自动生成 schema。
团队用 Documind 配合 OpenAI 和自定义 LLM 方案使用。
团队用 Documind 处理 DOCX、PNG、JPG、TXT 和 HTML 等多种文件类型。
团队用 Documind 从 PDF 中提取数据。