veil - PDF 深色模式阅读工具
PDF 深色模式阅读工具,专门解决开启深色模式后 PDF 图片、医学切片等内容被反色的问题,可自动识别文档中的图片,仅反转文字并保持图片原样,已经是深色页面的内容则不会重复处理,还支持对 PDF 内图片进行 OCR,让图表标签、坐标轴文字、表格标题和图片说明等内容也可以选中复制,免费开源。
PDF 深色模式阅读工具,专门解决开启深色模式后 PDF 图片、医学切片等内容被反色的问题,可自动识别文档中的图片,仅反转文字并保持图片原样,已经是深色页面的内容则不会重复处理,还支持对 PDF 内图片进行 OCR,让图表标签、坐标轴文字、表格标题和图片说明等内容也可以选中复制,免费开源。
一款用 React 构建的 PDF 组件库,让你像搭积木一样生成专业文档。 可以上传“Skills File”让 AI 编辑器自动适配 PDFx 组件,比如让 AI 填写表单或生成图表。 不支持复杂交互(比如 PDF 链接跳转),更适合静态文档生成。
在线PDF 转链接工具,支持分享 PDF、嵌入 PDF、PDF转二维码、简历链接生成器、托管作品集PDF。免费版文件存储最大 30 天,单个文件大小最大 5MB。存在付费版。
OpenDataLoader PDF 是一款开源 PDF 解析工具,专为 AI 数据处理、知识库搭建和 RAG(检索增强生成)场景设计。软件可以将 PDF 文档转换为适合 AI 使用的结构化数据,方便后续进行内容分析、检索和处理。 软件支持将 PDF 转换为 Markdown、HTML 和带坐标信息的 JSON 格式,同时能够识别文档中的文字、阅读顺序、标题层级、图片、表格以及数学公式。针对扫描版 PDF,工具内置 OCR 功能,支持多语言文字识别,并可通过 AI 模式提升复杂页面的解析效果。此外,还支持自动为未标记 PDF 添加辅助标签,提高文档可访问性。 使用时可以通过安装对应的软件包,将 PDF 文件导入后进行解析转换。生成的 Markdown、JSON 或 HTML 数据可用于知识库构建、RAG 应用、文档分析等场景,也可以结合 LangChain 等工具进行进一步处理。
AI内容创作画布
一款开源的将PDF文件转换为看起来像物理扫描件的效果,包括倾斜、灰度、纸张色调、扫描颗粒、模糊、边缘阴影和JPEG压缩伪影等效果的工具。 又是需要将PDF文件伪装成扫描件,例如用于学术笔记、隐私保护或文档展示。传统扫描仪可能无法精确控制效果,而在线工具可能存在隐私风险或功能限制。该项目通过本地化处理和可定制参数,解决了这些问题,能够高效、安全地生成逼真的扫描效果。
ScanNerd可免费且快速地为PDF和图片添加扫描仪效果并生成电子扫描件,支持自定义效果,完全本地处理、注重隐私安全。 - 在线工具和网站推荐
票易合是一款基于 Python 和 PySide6 开发的跨平台桌面应用,支持 Windows 和 macOS,专门用来把多张发票 PDF 合并排版成指定格式。软件提供多种布局方式,满足不同场景下的发票合并需求。 支持拖拽导入或点击按钮添加 PDF 文件,排版布局可在 1x1 到 10x10 范围内自由选择;提供普通模式和图像模式两种处理方式,普通模式保留矢量信息和发票监制章,图像模式使用高精度图片转换。打印顺序可按列表顺序、开票日期或开票金额排序,添加文件后自动生成合并预览图,支持滚轮缩放查看。文件列表显示文件名、金额、开票日期、路径等信息,支持调整顺序、右键菜单、删除等操作,还可按发票类型、发票号码、商品类型、开票日期、买卖双方名字、金额等字段自定义规则批量重命名文件。合并前会检查重复发票,支持合并后直接打印和打印一式两份。 打开软件后拖入或添加需要合并的发票 PDF,选择排版布局和处理模式,确认排序方式后可预览效果,最后直接打印或导出 Excel 文件列表。