dsh-ocr-local
纯文本路由的本地 OCR 兜底:会话模型明确声明不接受图片时,把附件的图片存入本地缓存并注入路径,模型调 ocr_image 用 PP-OCRv5 + ONNX Runtime 在纯 CPU 上离线识别,无需 API key,图片不出本机;模型能看图时静默。
Local OCR fallback for text-only routes: when the session model declares it cannot accept images, the attached image is cached locally and its path injected so the model can call ocr_image — PP-OCRv5 + ONNX Runtime on CPU, no API key, images never leave the machine. Silent when the model can see images.
怎么安装
dsh plugin add dsh-ocr-local 简介
dsh-ocr-local English · 中文 给 DeepSeek Harness(Web 端)装一个**本地 OCR 兜底**:当会话路由到的模型**不支持图片输入**时, 把图片里的文字读出来给模型;模型能看图时,插件完全静默、不插手。 识别引擎是 PP-OCRv5 + ONNX Runtime,**纯 CPU、完全离线**,图片不会离开你的电脑。 插件什么时候生效,什么时候静默 这是理解本插件最重要的一张表。判定基于当前会话实际路由到的模型**声明的输入能力** (inputModalities),而不是猜: | 会话路由到的模型 | 插件行为 | 模型实际拿到什么 | | --- | --- | --- | | **明确声明不支持图片**(如纯文本模型) | ✅ **生效**:图片存到本地缓存,并注入路径提示 → 模型调 ocr_image 识别 | 文字。Harness 对这类模型只给一句 [image omitted because this model accepts text only; …],**没有任何路径**,所以没有本插件模型就完全读不到图 | | **明确声明支持图片**(多模态模型) | 🔇 **静默**:不存缓存、不注入提示 | 图片本身。Harness 还会在图片前附一条**只读副本路径**,模型想逐字核对时可以直接对那个路径调 ocr_i…
推荐参考
信息
- 协议
- NOASSERTION
- 语言
- JavaScript
- GitHub 星标
- 5
- 月下载
- –
- 最近更新
- 2026-09-15
- 创建于
- 2026-08-17
基础安全检查
- 检查结果
- 无
- 收录来源
- curated:awesome-dsh-plugin.com, curated:awesome-dsh-plugin/awesome-dsh-plugin
- 主题标签
- deepseek-harness, dsh-plugin, ocr, onnxruntime, pp-ocrv5
同类推荐
dsh-comfyui
fandc520/dsh-comfyui
让 DeepSeek Harness 的 Agent 直接驱动本地或远程 ComfyUI:comfyui_run / comfyui_object_info / comfyui_workflow 工具生成与编辑图像、视频,附带工作流库(图工作流提取:按分量 / 主流程 / 整体)、加载区分辨率自动匹配、实时队列、SDXL 与 Wan 2.1 模板、配套 skill 与同源媒体代理。
dsh-web
zhu1090093659/dsh-web-ui/tree/main/packages/dsh-tool-describe-image
给纯文本模型补视觉:describe_image 把本地路径/URL/附件图片交给可配置的 OpenAI 兼容视觉端点,进会话的只有返回文本。
modlens
liustack/modlens
为纯文本模型架起视觉桥梁:粘贴图片,输出结构化 JSON 证据(OCR、版面、语义)。
dsh-vision-router
ysr666/dsh-vision-router
为纯文本 Agent 提供视觉能力:内置免 Key 视觉链 + 像素级视觉工具(看图问答、定位、裁剪、像素对比、取色、OCR、矢量化、抠图、截图);粘贴图片即可用。