Agent 插件
ModLens
为纯文本模型补上视觉能力,粘贴图片就能识别。

把图片转成 Agent 可调用的结构化文字证据:每个字都转写出来,版面分区、语义和视觉线索一并给出。截图、图表、贴板里的图,模型直接读得懂。
它能做什么
- DeepSeek Harness 的视觉插件,装上即用
- 支持 Gemini、OpenAI 兼容端点、Claude API 和 Claude Code CLI
- 输出结构化 JSON 证据,不是一句模糊描述
- 识别截图、图表、贴板图片和批量文件
Agent 插件
为纯文本模型补上视觉能力,粘贴图片就能识别。

把图片转成 Agent 可调用的结构化文字证据:每个字都转写出来,版面分区、语义和视觉线索一并给出。截图、图表、贴板里的图,模型直接读得懂。