asuojun

claude-vision-skill

asuojun

暂无描述

AI 简介

这是一个为无视觉能力的大语言模型(如Claude Code、DeepSeek)提供图像理解能力的轻量级JavaScript工具包。它通过调用支持多模态的第三方API(如Qwen-VL、GPT-4o-mini等),将用户发送的图片自动转为base64并转发至视觉模型,再将返回的文字描述注入对话上下文,实现“发图即识图”的无缝体验。项目采用OpenAI兼容接口设计,支持灵活切换不同vision服务提供商,配置简单,无需修改主模型代码。适用于需在纯文本LLM环境中快速集成图像识别功能的个人开发者、AI Agent构建者及低代码AI应用调试场景。

JavaScript
316
Stars
16
Forks
1
Watchers
2
Issues

Star 增长

今日0
近 7 天0
近 30 天0
综合评分3.69
默认分支master