PDF 工具
提取 PDF 文字
按页抽取 PDF 的文字层,输出纯文本或 Markdown。文字层缺失的扫描件抽不出内容。
仅在浏览器本地运行
文档改写由 pdf-lib(MIT)完成,渲染与抽取文字由 PDF.js(Apache-2.0)完成,两者都在你开始处理时才加载。文件不会离开浏览器。图标与运行时的 cmap、标准字体从 jsDelivr 取用;中文页码与中文水印因为要嵌入字体,改用 canvas 绘制后以位图贴入,所以这类水印不可选中、极限放大也不如矢量清晰 —— 纯英文与数字仍是矢量。加密 PDF 会被忽略限制打开,能否成功取决于加密方式。