01
项目介绍
为纯文本编码 Agent 增加图像理解、OCR、布局和语义证据。 它的核心内容集中在OCR、图像理解、布局分析,适合先从官方仓库说明和最小使用范围开始评估。
02
核心功能
OCR
在 DeepSeek Harness 工作流中补充“OCR”能力。
图像理解
在 DeepSeek Harness 工作流中补充“图像理解”能力。
布局分析
在 DeepSeek Harness 工作流中补充“布局分析”能力。
03
安装与使用
下面是根据 ModLens 当前公开资料整理的推荐使用路径,按顺序完成设置后即可在 Agent 中调用。
AI AGENT INSTALL
让 AI Agent 帮你安装
把这段话发送给 Codex、Claude Code 或其他可以操作本地环境的 AI Agent。
请帮我安装DSH 插件:ModLens
项目地址:https://github.com/liustack/modlens
请先阅读项目 README 和安装文件,确认当前环境与安装目录,再按项目提供的方式完成安装。安装完成后运行一个最小任务验证是否可用,并告诉我安装位置、执行步骤和验证结果;如果需要账号、凭据、额外权限或执行高风险操作,请先说明并等待我确认。01开始前准备
- 视觉模型或兼容 provider
02复制安装命令或配置
项目地址:https://github.com/liustack/modlens/blob/main/INSTALL.md
复制地址并按照下方步骤完成设置。03按步骤完成安装
- 1复制并执行配置
使用上方提供的命令或配置,把资源加入当前 Agent 环境。
- 2完成必要设置
根据提示准备 视觉模型或兼容 provider。
- 3运行最小任务
回到 Agent 中运行一个最小任务;资源能够被识别并返回符合项目说明的结果,就表示设置已经生效。
如何确认安装成功
回到 Agent 中运行一个最小任务;资源能够被识别并返回符合项目说明的结果,就表示设置已经生效。
04
使用场景
正在使用 DeepSeek Harness,并希望补充界面、工具或工程工作流
当前任务需要OCR或图像理解
05
使用评价
值得一试的地方
- 正在使用 DeepSeek Harness,并希望补充界面、工具或工程工作流
- 当前任务需要OCR或图像理解
使用前要知道
- 没有 DSH 环境,且项目未明确支持其他宿主
- 希望在未阅读仓库说明或未核对权限的情况下直接用于生产环境
06
README
ModLens
Overview
为纯文本编码 Agent 增加图像理解、OCR、布局和语义证据。 The first vision plugin for DeepSeek Harness, and a vision bridge for text-only coding agents.
Getting started
- 下面是根据 ModLens 当前公开资料整理的推荐使用路径,按顺序完成设置后即可在 Agent 中调用。
- 项目定位:为纯文本编码 Agent 增加图像理解、OCR、布局和语义证据。
- 公开特征:5 个视觉 provider、结构化 JSON、故障转移。
- 回到 Agent 中运行一个最小任务;资源能够被识别并返回符合项目说明的结果,就表示设置已经生效。
Configuration
项目地址:https://github.com/liustack/modlens/blob/main/INSTALL.md
复制地址并按照下方步骤完成设置。在 GitHub 阅读完整 README →