liustack

modlens

liustack

The first vision plugin for DeepSeek Harness, and the vision bridge for every text-only coding agent. Paste an image, get structured JSON evidence (OCR, layout, semantics). | 全网最强 DeepSeek Harness 外挂视觉插件,为 DeepSeek、GLM 等纯文本模型外挂视觉能力,粘贴图片即得结构化 JSON 证据(OCR、版面、语义)。

AI 简介

ModLens 是一款为纯文本大模型(如 DeepSeek、GLM)提供视觉能力的轻量级插件,支持用户直接粘贴图像并实时返回结构化 JSON 输出,包含 OCR 文本、版面分析与语义理解三类证据。其核心采用 TypeScript 实现,深度集成 DeepSeek Harness 工具调用协议,通过 `modlens_read_image` 工具实现零文件路径交互,部署仅需一条命令。适用于需在不修改底层模型的前提下,为代码助手、AI 编程代理或聊天界面快速增强多模态理解能力的场景,尤其适合基于文本模型构建的自动化开发工作流。

TypeScript
2.3k
Stars
62
Forks
1
Watchers
1
Issues

Star 增长

今日0
近 7 天+439
近 30 天+439
综合评分84.4
默认分支main