项目介绍
把粘贴图片转成 OCR、版面、实体和关系等结构化证据,让纯文本 DeepSeek 或 GLM 模型处理截图与文档图像。

核心功能
提取 OCR 与版面信息
提取 OCR 与版面信息。这一能力来自仓库 README 公开的功能说明,实际效果仍要在目标 DSH 版本和 profile 中验证。
识别图像中的实体和关系
识别图像中的实体和关系。这一能力来自仓库 README 公开的功能说明,实际效果仍要在目标 DSH 版本和 profile 中验证。
给纯文本模型增加命名的视觉路由
给纯文本模型增加命名的视觉路由。这一能力来自仓库 README 公开的功能说明,实际效果仍要在目标 DSH 版本和 profile 中验证。
把图像结果整理成可追溯的结构化证据
把图像结果整理成可追溯的结构化证据。这一能力来自仓库 README 公开的功能说明,实际效果仍要在目标 DSH 版本和 profile 中验证。
安装与使用
安装到 DeepSeek Harness,随后按仓库说明重启或重载目标环境,并用一个低风险场景验证。
让 AI Agent 帮你安装
把这段话发送给 Codex、Claude Code 或其他可以操作本地环境的 AI Agent。
请帮我安装 ModLens。项目地址为 https://github.com/liustack/modlens。先读取 README、许可证和安装文件,确认当前 DeepSeek Harness 版本、目标 profile 与依赖满足要求。使用仓库当前给出的命令 `npx -y @deepseek-ai/dsh plugin --profile web add @liustack/modlens@3.22.1`。执行前说明会修改的 profile、目录和权限。完成后按仓库的验证方式检查结果并报告命令、改动位置和可见结果。遇到凭据、额外网络访问、构建脚本、覆盖已有文件或扩大权限时,先停下向我确认。- DeepSeek Harness Web 可以正常启动
- 已有可用的文本模型路由
- 如选择远程视觉引擎,准备对应端点和凭据
npx -y @deepseek-ai/dsh plugin --profile web add @liustack/modlens@3.22.1- 1核对环境和目标 profile
DeepSeek Harness Web 可以正常启动;已有可用的文本模型路由;如选择远程视觉引擎,准备对应端点和凭据。先记录当前配置和已安装插件,避免覆盖已有设置。
- 2执行仓库当前安装命令
运行以下命令。 `npx -y @deepseek-ai/dsh plugin --profile web add @liustack/modlens@3.22.1` 命令涉及构建脚本、凭据或覆盖文件时,先停下确认。
- 3重载并验证
打开模型选择器并确认出现带有 `(modlens vision)` 的路由,粘贴一张低敏感度截图检查是否返回结构化图像证据。
打开模型选择器并确认出现带有 `(modlens vision)` 的路由,粘贴一张低敏感度截图检查是否返回结构化图像证据。
- 图片可能发送到所配置的外部视觉服务
- 视觉结果仍会受模型和端点质量影响
- 正式资料应先核对隐私和配额
使用场景
分析产品截图和报错界面
在这个场景中先从最小范围使用 ModLens,确认输出、权限和兼容性后再扩大使用。
从文档图片提取 OCR 与版面
在这个场景中先从最小范围使用 ModLens,确认输出、权限和兼容性后再扩大使用。
让纯文本模型比较多张视觉材料
在这个场景中先从最小范围使用 ModLens,确认输出、权限和兼容性后再扩大使用。
使用评价
本页评价依据仓库 README、安装说明、许可证和维护元数据。直接补齐纯文本模型的图像输入能力;输出强调 OCR、布局和关系等证据;README 提供固定版本的一条命令安装。图片可能发送到所配置的外部视觉服务;视觉结果仍会受模型和端点质量影响;正式资料应先核对隐私和配额。这次只完成公开资料核验,没有声称本机安装或长期使用。
值得一试的地方
- 直接补齐纯文本模型的图像输入能力
- 输出强调 OCR、布局和关系等证据
- README 提供固定版本的一条命令安装
使用前要知道
- 图片可能发送到所配置的外部视觉服务
- 视觉结果仍会受模型和端点质量影响
- 正式资料应先核对隐私和配额
README
ModLens
Overview
把粘贴图片转成 OCR、版面、实体和关系等结构化证据,让纯文本 DeepSeek 或 GLM 模型处理截图与文档图像。 把粘贴图片转成 OCR、版面、实体和关系等结构化证据,让纯文本 DeepSeek 或 GLM 模型处理截图与文档图像。
Getting started
- 安装到 DeepSeek Harness,随后按仓库说明重启或重载目标环境,并用一个低风险场景验证。
- 把粘贴图片转成 OCR、版面、实体和关系等结构化证据,让纯文本 DeepSeek 或 GLM 模型处理截图与文档图像。
- 仓库给出的主要能力包括 提取 OCR 与版面信息、识别图像中的实体和关系、给纯文本模型增加命名的视觉路由、把图像结果整理成可追溯的结构化证据。
- 打开模型选择器并确认出现带有 `(modlens vision)` 的路由,粘贴一张低敏感度截图检查是否返回结构化图像证据。
Configuration
npx -y @deepseek-ai/dsh plugin --profile web add @liustack/modlens@3.22.1在 GitHub 阅读完整 README →