本地 Windows 引擎(Windows.Media.Ocr)识别附加图片:只把识别出的文字发送给模型,图片字节不进入上下文;视觉直通可选开启。
- GitHub 星标
- 6
- 版本
- v0.3.0
- 许可证
- MIT
- 收录日期
- 2026-08-17
GitHub 信息
- GitHub 星标
- 6
- 许可证
- MIT
- 主要语言
- JavaScript
- 最近推送
- 2026年8月20日 05:17
- 维护者
- maxwell-feng
- 收录日期
- 2026-08-17
安装
安装命令
dsh plugin --profile web add @maxwell-feng/dsh-windows-ocr标签
README 徽章
将这段 Markdown 添加到插件 README,链接到对应的详情页。
Listed onDSH Get
[](https://dshget.com/plugins/maxwell-feng/dsh-windows-ocr)相关插件
视觉与多模态dsh-tesseract-ocr
★ 3本地 Tesseract 识别附加图片:只把识别出的文字发送给模型,图片字节不进入上下文;视觉直通可选开启。
视觉与多模态maxwell-feng
dsh-vision-router
★ 1030为纯文本 Agent 提供视觉能力:内置免 Key 视觉链 + 像素级视觉工具(看图问答、定位、裁剪、像素对比、取色、OCR、矢量化、抠图、截图);粘贴图片即可用。
视觉与多模态ysr666
dsh-vision-toolkit
★ 842让纯文本模型处理视觉任务:粘贴图片后自动切换到 Vision Toolkit 变体,支持图片问答、多图比较、长截图 OCR、截图还原前端 UI、元素定位与像素对比。默认无需 API Key——图片经作者自建的免费服务处理,每台机器每天 100 张;也可改为指向自己的服务商。
视觉与多模态Anionex