← 返回列表
未验证
拖拽或上传 PDF、Word、PPT 文件,自动提取文字填入输入框
尚未跑自动兼容性验证,可查看页面内的依赖与入口分析。 · 最近上游提交 2026/8/15 · 已提供中文文档
DeepSeek Harness(DSH)Web 插件:通过上传或拖放将 PDF / Word .docx / PPT .pptx / 纯文本及代码文件读入编辑器
综合分
27.5
GitHub 分
27.5
用户评分
—
★ Stars
1
周下载量
—
安装插件(需先安装 dsh CLI 引擎:npm install -g @deepseek-ai/dsh)
dsh plugin --profile web add Yun-tech123/dsh-document-reader该插件未发布到 npm,走 GitHub 源安装(pnpm 若拦截 prepare 脚本,按其提示在 pnpm-workspace.yaml 的 allowBuilds 中放行后重跑)
数据截至 2026/9/16(元数据每日更新 · 实装验证按队列轮转,单条结论的验证时间见上方)
用户评分
还没有人投票,来当第一个
订阅周报,不错过优质插件更新
每周一封 · 高评分插件 + 新用户活动
README
dsh-document-reader 一个 DeepSeek Harness (DSH) 网页端插件:在聊天输入框里直接读取 PDF / Word (.docx) / PPT (.pptx) / 纯文本与代码 文件,把提取出的文字填入输入框草稿。 一个 DeepSeek Harness (DSH) 网页端插件,可通过文件选择器或将文件拖拽到页面任意位置,直接将 PDF / Word (.docx) / PPT (.pptx) / 纯文本与代码 文件读取到输入框中。 功能 / Features - 上传读取:输入框工具栏出现「文档」按钮,点击可选择文件(支持多选)。 - 整页拖拽:把文档拖到页面任意位置,出现「释放以读取文档」遮罩,松手即读取。 - 格式支持:.pdf(服务端 pdfjs-dist 精确解析)、.docx、.pptx、以及 txt / md / csv / json / yaml / 代码 等纯文本。 - 输出上限:单文件 20 万字符,超出自动截断。 - 上传:输入框工具栏出现「文档」按钮;点击可选择文件(支持多选)。 - 拖拽:将文档拖到页面任意位置并释放即可读取。 - 格式:.pdf(服务端使用 pdfjs-dist 解析)、.docx、.pptx,以及 txt / md / csv / json / yaml / code 等纯文本。 - 输出上限:单文件 20 万字符,超出会截断并附注说明。 架构 / Architecture - 客户端 (lib/client.js):注册到 conversation.input.left 插槽,负责 UI、拖拽、以及 .docx/.pptx(ZIP + XML)和纯文本的前端解析。 - 服务端 (lib/index.js):注册 POST /read-document/parse 路由,用 Mozilla pdfjs-dist 解析 PDF(正确支持对象流、xref stream、CID 字体、ToUnicode CMap)。 - 客户端 (lib/client.js):注册到 conversation.input.left 插槽;负责 UI、拖拽,以及 .docx/.pptx(ZIP + XML)和纯文本的客户端解析。 - 服务端 (lib/index.js):注册 POST /read-document/parse,使用 Mozilla pdfjs-dist 解析 PDF(正确处理对象流、xref 流、CID 字体、ToUnicode CMap)。 安装 / Install 需要先安装 dsh 并可用 pnpm。 1. 安装到 web 配置(会自动注册到 dsh.profile.bundles) dsh plugin --profile web add github:Yun-tech123/dsh-document-reader 2. 重启 web 服务 dsh web 安装后刷新页面,输入框工具栏即出现「文档」按钮。 dsh plugin 需要本机可用 pnpm;若未安装,可先 corepack enable 或 npm i -g pnpm。 手动安装 / Manual install 1. 把本仓库克隆到本地,dsh plugin --profile web add 。 2. 确认 package.json 的 dsh.profile.bundles 里已包含 dsh-document-reader(dsh plugin 会自动加入)。 3. 重启 dsh web,刷新页面。 限制 / Limitations - PDF 为文本提取:纯扫描件(图片型 PDF) 无文本层,无法提取。 - 老式二进制 .doc / .xls / .ppt 暂不支持,请先另存为 .docx / .pptx。 - 需要较新浏览器(.docx/.pptx 用 DecompressionStream,Chrome/Edge/Firefox 2022+ 均可)。 - PDF 为文本提取:纯扫描件(图片型 PDF)没有文本层,无法提取。 - 不支持旧版二进制 .doc / .xls / .ppt;请先另存为 .docx / .pptx。 - 需要较新的浏览器(.docx/.pptx 使用 DecompressionStream;Chrome/Edge/Firefox 2022+ 均可)。 License MIT
扫码进群