工具

Agent 插件

ModLens

为纯文本模型补上视觉能力,粘贴图片就能识别。

ModLens:为纯文本模型补上视觉能力

把图片转成 Agent 可调用的结构化文字证据:每个字都转写出来,版面分区、语义和视觉线索一并给出。截图、图表、贴板里的图,模型直接读得懂。

它能做什么

  • DeepSeek Harness 的视觉插件,装上即用
  • 支持 Gemini、OpenAI 兼容端点、Claude API 和 Claude Code CLI
  • 输出结构化 JSON 证据,不是一句模糊描述
  • 识别截图、图表、贴板图片和批量文件