DSH 插件分类

图片识别与视觉

增加图片理解、OCR、截图分析和视觉生成能力。先通过简洁卡片判断用途、配置难度和主要权限,再进入详情页查看完整证据。

62 个已收录条目目录复核于 2026-08-22
图片识别与视觉

先看能力,再核对权限

目录中的“协议已核验”不代表安全认证或当前版本运行通过。安装前仍应阅读仓库源码、锁定版本并在隔离环境测试。

选择建议

选择图片识别与视觉插件时先看什么

  1. 先用搜索或卡片摘要确认插件是否直接解决当前任务。
  2. 比较配置资料完整度、兼容状态和主要权限,不把 Star 当作安全或可用证明。
  3. 优先进入详情页确认安装、配置、验证、首次使用和清理步骤是否闭环。
插件目录

DSH 社区插件目录

可按名称、包名或自然语言需求搜索;结果会按字段权重和证据质量排序。

正在载入完整目录(共 62 个)…
图片识别与视觉源码已审阅

dsh-media-skills

为 DSH 提供中文读图审查与图片生成 Skills,并在未配置时补充智谱和商汤视觉模型路由;支持多家视觉服务故障转移。

适合:需要OCR、截图识别、图片识别能力的用户

已审阅固定提交的关键源码

执行本机命令使用服务凭据写入本地文件
配置资料
配置资料部分完整
配置难度
未知,待补配置
兼容性
声明兼容,尚未实测
图片识别与视觉源码已审阅

dsh-vision-proxy

为纯文本 DeepSeek 模型增加图片附件转译:先用本地 Ollama 或用户配置的 OpenAI 兼容视觉模型把图片转为文字,再交给原 DeepSeek Adapter 回答。

适合:需要OCR、截图识别、图片识别能力的用户

已审阅固定提交的关键源码

执行本机命令使用服务凭据写入本地文件
配置资料
配置资料部分完整
配置难度
未知,待补配置
兼容性
当前版本需要复核
图片识别与视觉Awesome 社区收录

dsh-chat-imagine

在 DSH 聊天窗口自动调用生图工具(API 渠道,或本机 CLI:已支持 mmx / codex / agy)并展示图片,也支持利用对应 CLI 识别图片。

适合:需要OCR、截图识别、图片识别能力的用户

已进入可追溯的 Awesome 社区清单

读取本地文件访问外部网络
配置资料
仅有社区安装目标
配置难度
未知,待补配置
兼容性
声明兼容,尚未实测
图片识别与视觉Awesome 社区收录

dsh-imagegen

面向 DSH Web GUI 的 AI 生图插件:通过可配置的 OpenAI 兼容端点(gpt-image-2 / gpt-image-1 / dall-e-3)实现文生图与图生图,提供 api_url/api_key 设置卡片与侧边栏分栏生图工作台。

适合:需要OCR、截图识别、图片识别能力的用户

已进入可追溯的 Awesome 社区清单

使用服务凭据读取本地文件访问外部网络
配置资料
仅有社区安装目标
配置难度
未知,待补配置
兼容性
声明兼容,尚未实测
图片识别与视觉Awesome 社区收录

dsh-deepseek-vision

视觉语言网关:注册支持图片输入的 DeepSeek provider 路由,图片先由可配置 VL 模型(默认 Qwen-VL)描述成文字再发送。

适合:需要OCR、截图识别、图片识别能力的用户

已进入可追溯的 Awesome 社区清单

读取本地文件
配置资料
仅有社区安装目标
配置难度
未知,待补配置
兼容性
声明兼容,尚未实测
图片识别与视觉Awesome 社区收录

dsh-vision

纯文本 DeepSeek 的识图插件:默认走豆包 Web(零成本、免 API key,经 Windows CDP 桥接驱动已登录 Chrome),另有反重力额度(flash/pro)与 Gemini 降级通道;档位自动升级、视觉证据记忆与会话压缩恢复、内容哈希缓存、双语客户端面板。

适合:需要长期记忆、聊天记录、上下文能力的用户

已进入可追溯的 Awesome 社区清单

控制浏览器使用服务凭据读取本地文件
配置资料
仅有社区安装目标
配置难度
未知,待补配置
兼容性
声明兼容,尚未实测
图片识别与视觉Awesome 社区收录

dsh-free-vision

免费视觉插件:纯文本模型看图 / OCR / UI / 报错分析,优先免费模型(千问 Qwen3-VL-Flash、豆包、DeepSeek-OCR),设置界面可配置。

适合:需要OCR、截图识别、图片识别能力的用户

已进入可追溯的 Awesome 社区清单

读取本地文件
配置资料
仅有社区安装目标
配置难度
未知,待补配置
兼容性
声明兼容,尚未实测
图片识别与视觉Awesome 社区收录

dsh-windows-ocr

本地 Windows 引擎(Windows.Media.Ocr)识别附加图片:只把识别出的文字发送给模型,图片字节不进入上下文;视觉直通可选开启。

适合:需要长期记忆、聊天记录、上下文能力的用户

已进入可追溯的 Awesome 社区清单

读取本地文件
配置资料
仅有社区安装目标
配置难度
未知,待补配置
兼容性
声明兼容,尚未实测
图片识别与视觉Awesome 社区收录

dsh-guide-dog

基于 MiniMax 的多模态插件:实时语音通话模式(流式对话、悬浮胶囊 UI)、语音模式与麦克风语音输入,并提供图像/视频/音乐/语音生成与视觉检查工具。

适合:需要OCR、截图识别、图片识别能力的用户

已进入可追溯的 Awesome 社区清单

读取本地文件
配置资料
仅有社区安装目标
配置难度
未知,待补配置
兼容性
声明兼容,尚未实测
图片识别与视觉Awesome 社区收录

dsh-llm-vision-bridge

DeepSeek 视觉桥接:注册原生 LLM provider,聊天内粘贴的图片自动由视觉模型(pi-ai/llama.cpp 上的 Qwen3-VL)转成文字描述后交给纯文本 DeepSeek 作答——图片准入、路由与会话压缩全部走 harness 原生机制,带 LRU 描述缓存与 503 重试。

适合:需要OCR、截图识别、图片识别能力的用户

已进入可追溯的 Awesome 社区清单

读取本地文件
配置资料
仅有社区安装目标
配置难度
未知,待补配置
兼容性
声明兼容,尚未实测
图片识别与视觉Awesome 社区收录

dsh-vision-bridge

将会话图片转交可配置视觉服务,并向符合条件的 DeepSeek Harness 模型路由返回纯文本分析。

适合:需要OCR、截图识别、图片识别能力的用户

已进入可追溯的 Awesome 社区清单

读取本地文件
配置资料
仅有社区安装目标
配置难度
未知,待补配置
兼容性
声明兼容,尚未实测
图片识别与视觉Awesome 社区收录

dsh-plugin-multimodal

在纯文本 DeepSeek 线路上开放贴图准入,用视觉 sidecar 把附件转成文字,原生视觉模型不改写。

适合:需要OCR、截图识别、图片识别能力的用户

已进入可追溯的 Awesome 社区清单

读取本地文件
配置资料
仅有社区安装目标
配置难度
未知,待补配置
兼容性
声明兼容,尚未实测
图片识别与视觉Awesome 社区收录

dsh-vision

极简的原生视觉能力增强,支持免费的智谱模型或本地千问视觉模型。

适合:需要OCR、截图识别、图片识别能力的用户

已进入可追溯的 Awesome 社区清单

读取本地文件
配置资料
仅有社区安装目标
配置难度
未知,待补配置
兼容性
声明兼容,尚未实测
图片识别与视觉Awesome 社区收录

dsh-vision-bridge

输入框贴图自动识别:由 OpenAI 兼容视觉模型转成文字描述后,再交给纯文本 DeepSeek 模型处理。

适合:需要OCR、截图识别、图片识别能力的用户

已进入可追溯的 Awesome 社区清单

读取本地文件
配置资料
仅有社区安装目标
配置难度
未知,待补配置
兼容性
声明兼容,尚未实测
图片识别与视觉Awesome 社区收录

dsh-vision-tools

DeepSeek Harness 视觉能力全家桶:vision_understand 工具(OpenAI 兼容视觉 API,默认免费智谱 GLM-4V-Flash)+ 粘贴/拖拽/按钮三入口识图。

适合:需要OCR、截图识别、图片识别能力的用户

已进入可追溯的 Awesome 社区清单

读取本地文件访问外部网络
配置资料
仅有社区安装目标
配置难度
未知,待补配置
兼容性
声明兼容,尚未实测
图片识别与视觉Awesome 社区收录

dsh-draw-router

DeepSeek Harness 统一绘图路由器:自动识别任意 OpenAI 兼容接口的绘图模型,提供 draw_image 和 draw_list_sources 工具,支持商汤、阶跃、Agnes、千问、Flux、SD、Imagen 等。

适合:需要OCR、截图识别、图片识别能力的用户

已进入可追溯的 Awesome 社区清单

读取本地文件
配置资料
仅有社区安装目标
配置难度
未知,待补配置
兼容性
声明兼容,尚未实测
图片识别与视觉Awesome 社区收录

DSH-dseyes

为纯文本 DeepSeek 提供原生图片上传体验:在 Web GUI 粘贴/拖入图片即以缩略图附件进入会话,发送前由 host 用免费智谱 GLM-4V-Flash 视觉 API(glm-4v-flash 降级链)读取并替换为文字描述,DeepSeek 据此回答,原图保留在聊天历史中。

适合:需要OCR、截图识别、图片识别能力的用户

已进入可追溯的 Awesome 社区清单

读取本地文件访问外部网络
配置资料
仅有社区安装目标
配置难度
未知,待补配置
兼容性
声明兼容,尚未实测
图片识别与视觉Awesome 社区收录

dsh-image-gen

GPT Image 2 `image_gen`:默认复用 Codex 订阅 OAuth,也可显式使用 API Key;显影卡片、最多 3 张 API 实时局部图、持久附件回放/灯箱/下载、纯文本模型输出和受限的凭据安全请求。

适合:需要OCR、截图识别、图片识别能力的用户

已进入可追溯的 Awesome 社区清单

使用服务凭据读取本地文件访问外部网络
配置资料
仅有社区安装目标
配置难度
未知,待补配置
兼容性
声明兼容,尚未实测
图片识别与视觉Awesome 社区收录

dsh-image-pathify

让纯文本模型也能处理聊天贴图,提供原生视觉体验,支持批量看图,走内置 OpenAI 兼容识图工具 analyze_image;具备视觉能力的模型不受影响。

适合:需要OCR、截图识别、图片识别能力的用户

已进入可追溯的 Awesome 社区清单

读取本地文件
配置资料
仅有社区安装目标
配置难度
未知,待补配置
兼容性
声明兼容,尚未实测
图片识别与视觉Awesome 社区收录

dsh-llm-deepseek-vision

视觉增强的 DeepSeek 适配器:由视觉模型把图片描述成文字,纯文本 DeepSeek 模型再基于描述推理。

适合:需要OCR、截图识别、图片识别能力的用户

已进入可追溯的 Awesome 社区清单

读取本地文件
配置资料
仅有社区安装目标
配置难度
未知,待补配置
兼容性
声明兼容,尚未实测
图片识别与视觉Awesome 社区收录

dsh-tesseract-ocr

本地 Tesseract 识别附加图片:只把识别出的文字发送给模型,图片字节不进入上下文;视觉直通可选开启。

适合:需要长期记忆、聊天记录、上下文能力的用户

已进入可追溯的 Awesome 社区清单

读取本地文件
配置资料
仅有社区安装目标
配置难度
未知,待补配置
兼容性
声明兼容,尚未实测
图片识别与视觉Awesome 社区收录

dsh-vision-mix

把文本、识图和生图 API 组合成一个 Mix 模型并按对话内容自动路由:纯文本走聊天模型,用户图片和 Agent 截图走识图模型,后续可继续追问同一张图;还支持图片生成与编辑及会话级调用记录。

适合:需要OCR、截图识别、图片识别能力的用户

已进入可追溯的 Awesome 社区清单

读取本地文件访问外部网络
配置资料
仅有社区安装目标
配置难度
未知,待补配置
兼容性
声明兼容,尚未实测
图片识别与视觉Awesome 社区收录

dsh-youreyes

纯文本 DeepSeek 的识图工具包:模型可主动调用的 `vision` 工具、deepseek/opencode-go 包装适配器(v4 flash/pro)、反重力额度(默认,flash/pro)/ 任意 OpenAI 兼容 VLM / Gemini / 本地 Ollama 通道、证据记忆与会话压缩恢复、内容哈希缓存、双语客户端面板。

适合:需要长期记忆、聊天记录、上下文能力的用户

已进入可追溯的 Awesome 社区清单

读取本地文件
配置资料
仅有社区安装目标
配置难度
未知,待补配置
兼容性
声明兼容,尚未实测
图片识别与视觉Awesome 社区收录

visual-review

在 DSH Web 聊天界面内联渲染粘贴/上传的图片,并让纯文本模型“看见”图片:visual_review 工具优先调用任意 OpenAI 兼容多模态 API,未配置时回退本机 Qwen3-VL。

适合:需要代码审查、代码评审、Git能力的用户

已进入可追溯的 Awesome 社区清单

读取本地文件访问外部网络
配置资料
仅有社区安装目标
配置难度
未知,待补配置
兼容性
声明兼容,尚未实测
图片识别与视觉Awesome 社区收录

dsh-auto-vision

为纯文本 DeepSeek Harness 主模型搭视觉桥:自动从已配置模型中挑选多模态模型,通过 vision 工具把图片描述以纯文本返回。

适合:需要OCR、截图识别、图片识别能力的用户

已进入可追溯的 Awesome 社区清单

读取本地文件
配置资料
仅有社区安装目标
配置难度
未知,待补配置
兼容性
声明兼容,尚未实测
图片识别与视觉Awesome 社区收录

dsh-deepseek-vision

复用 DeepSeek 网页端识图模式给纯文本模型补上看图能力:deepseek_vision 工具调用本地 deepseek-vision-cli 浏览器自动化(手动登录助手、自动开启深度思考、用后自动关窗),把图片描述以文字返回给模型。

适合:需要OCR、截图识别、图片识别能力的用户

已进入可追溯的 Awesome 社区清单

控制浏览器读取本地文件
配置资料
仅有社区安装目标
配置难度
未知,待补配置
兼容性
声明兼容,尚未实测
图片识别与视觉Awesome 社区收录

dsh-design-qa

给纯文本模型的设计稿保真判定:`deepseek_vision` 工具从任意 OpenAI 兼容视觉路由借来一只眼,让模型判断实现与设计稿是否一致——并附上支撑该判定的基准(4 组夹具、23 处注入缺陷、逐格原始输出)与其依赖的提问纪律。

适合:需要OCR、截图识别、图片识别能力的用户

已进入可追溯的 Awesome 社区清单

读取本地文件
配置资料
仅有社区安装目标
配置难度
未知,待补配置
兼容性
声明兼容,尚未实测
图片识别与视觉Awesome 社区收录

dsh-eyes

为纯文本 DeepSeek 模型提供按需视觉:上传图片后,模型通过 view_image 工具调用任意 OpenAI 兼容视觉端点(默认 Qwen/DashScope)。

适合:需要OCR、截图识别、图片识别能力的用户

已进入可追溯的 Awesome 社区清单

读取本地文件
配置资料
仅有社区安装目标
配置难度
未知,待补配置
兼容性
声明兼容,尚未实测
图片识别与视觉Awesome 社区收录

dsh-image-vision

纯文本 DeepSeek 的聊天识图插件:view_image 工具转发任意 OpenAI 兼容 VLM(本地 Ollama 或云端),对话框粘贴/拖拽的图片自动改写为 view_image 路径标记供模型查看。

适合:需要OCR、截图识别、图片识别能力的用户

已进入可追溯的 Awesome 社区清单

读取本地文件
配置资料
仅有社区安装目标
配置难度
未知,待补配置
兼容性
声明兼容,尚未实测
图片识别与视觉Awesome 社区收录

dsh-koboldcpp-hands

给在线模型装上本地双手:koboldcpp_run 与 koboldcpp_vision 工具把重复的文本与视觉(OCR、图像分析、对比)劳动交给本地 KoboldCpp(llama.cpp)服务器,并按需拉起与管理服务器生命周期。

适合:需要OCR、截图识别、图片识别能力的用户

已进入可追溯的 Awesome 社区清单

读取本地文件
配置资料
仅有社区安装目标
配置难度
未知,待补配置
兼容性
声明兼容,尚未实测
图片识别与视觉Awesome 社区收录

dsh-mindseye

为纯文本模型提供 DSH 视觉插件:原生图片理解与生成交互、分层证据记忆与缓存、意图驱动的 VLM 路由。

适合:需要长期记忆、聊天记录、上下文能力的用户

已进入可追溯的 Awesome 社区清单

读取本地文件
配置资料
仅有社区安装目标
配置难度
未知,待补配置
兼容性
声明兼容,尚未实测
图片识别与视觉Awesome 社区收录

dsh-plugin-grok2api-media-tool

让 dsh 通过 grok2api 的 API 获得生成图片与视频能力。

适合:需要OCR、截图识别、图片识别能力的用户

已进入可追溯的 Awesome 社区清单

读取本地文件访问外部网络
配置资料
仅有社区安装目标
配置难度
未知,待补配置
兼容性
声明兼容,尚未实测
图片识别与视觉Awesome 社区收录

dsh-plugin-mm-vision

通感编码器(Synesthesia Encoder):调用视觉模型把图片翻译成紧凑的结构化空间文字(画布/元素/百分比坐标),让纯文本 LLM 获得像素级看图能力(`mm_vision` 工具)。

适合:需要OCR、截图识别、图片识别能力的用户

已进入可追溯的 Awesome 社区清单

读取本地文件
配置资料
仅有社区安装目标
配置难度
未知,待补配置
兼容性
声明兼容,尚未实测
图片识别与视觉Awesome 社区收录

dsh-screenshot

DeepSeek Harness (dsh) 的独立截图工具。浏览器快捷键一键截图,并提供面向智能体的截图加读取能力,让智能体能看到并分析任意屏幕区域。

适合:需要OCR、截图识别、图片识别能力的用户

已进入可追溯的 Awesome 社区清单

控制浏览器读取本地文件
配置资料
仅有社区安装目标
配置难度
未知,待补配置
兼容性
声明兼容,尚未实测
图片识别与视觉Awesome 社区收录

dsh-tool-vision

本地优先的结构化视觉插件:图片交给本地 OpenAI 兼容 VLM,返回 JSON 证据(摘要、逐字 OCR、版面区域、实体/关系、配色、显式不确定项),带反幻觉回退与可选粘贴/上传桥;零云端成本,图片不出本机。

适合:需要OCR、截图识别、图片识别能力的用户

已进入可追溯的 Awesome 社区清单

读取本地文件
配置资料
仅有社区安装目标
配置难度
未知,待补配置
兼容性
声明兼容,尚未实测
图片识别与视觉Awesome 社区收录

dsh-tool-vision

面向模型的 image_describe(识图)工具(DashScope OpenAI 兼容接口,qwen3.7-flash)+ 粘贴桥:纯文本模型会话里粘贴的图片在发送时自动转为文件路径并在聊天记录中回显,不再触发图片准入拦截。自带 DASHSCOPE_API_KEY;端点/模型/预算可配置,重定向防护 HTTP 客户端,所有 Agent 预设均可用。

适合:需要OCR、截图识别、图片识别能力的用户

已进入可追溯的 Awesome 社区清单

使用服务凭据读取本地文件访问外部网络
配置资料
仅有社区安装目标
配置难度
未知,待补配置
兼容性
声明兼容,尚未实测
图片识别与视觉Awesome 社区收录

dsh-unsloth-hands

把重复的文本与视觉(OCR、图像分析、对比)劳动交给本地运行的 Unsloth Desktop(Unsloth Studio)服务器:unsloth_run 与 unsloth_vision 两个工具,纯 HTTP 客户端,不拉起也不持有任何进程。

适合:需要OCR、截图识别、图片识别能力的用户

已进入可追溯的 Awesome 社区清单

执行本机命令读取本地文件访问外部网络
配置资料
仅有社区安装目标
配置难度
未知,待补配置
兼容性
声明兼容,尚未实测
图片识别与视觉Awesome 社区收录

dsh-vision-fallback

将聊天图片交给固定的 OpenAI 兼容视觉模型,把事实性观察交给当前主模型,并在事件回放、上下文压缩和重启时复用会话内观察。

适合:需要长期记忆、聊天记录、上下文能力的用户

已进入可追溯的 Awesome 社区清单

读取本地文件
配置资料
仅有社区安装目标
配置难度
未知,待补配置
兼容性
声明兼容,尚未实测
图片识别与视觉Awesome 社区收录

dsh-vision-recognizer

视觉模型路由:把附加图片经可配置模型(15+ OpenAI 兼容与 Anthropic 供应商)转译为文字,对话仍由 DeepSeek 作答。

适合:需要OCR、截图识别、图片识别能力的用户

已进入可追溯的 Awesome 社区清单

读取本地文件
配置资料
仅有社区安装目标
配置难度
未知,待补配置
兼容性
声明兼容,尚未实测
图片识别与视觉Awesome 社区收录

mimo-vision

`describe_image` 视觉桥:经 opencode Zen API(凭据 `OPENCODE_GO_API_KEY`,免费线路优先、付费兜底)把图片发给 mimo-v2.5、返回文字描述给纯文本模型,原生格式直发,SVG/TIFF/HEIC 等格式经 ImageMagick 自动转码。

适合:需要OCR、截图识别、图片识别能力的用户

已进入可追溯的 Awesome 社区清单

使用服务凭据读取本地文件访问外部网络
配置资料
仅有社区安装目标
配置难度
未知,待补配置
兼容性
声明兼容,尚未实测
图片识别与视觉Awesome 社区收录

Gemini-Eyes

接入 gemini.google.com 的 MCP 桥:图片/视频视觉识别、Imagen 生图、Veo 生视频与历史对话管理,复用浏览器登录态,无需 API Key。

适合:需要OCR、截图识别、图片识别能力的用户

已进入可追溯的 Awesome 社区清单

控制浏览器使用服务凭据读取本地文件
配置资料
当前不建议安装
配置难度
未知,待补配置
兼容性
当前版本需要复核
图片识别与视觉Awesome 社区收录

dsh-plugin-deepseek-vision

面向纯文本 DeepSeek 的视觉 MCP + DSH 插件:analyze_image / analyze_clipboard / compare_images / vision_status 四个工具、可视化配置页、默认免费 GLM-4.6V-Flash、结果缓存与限流容错,Key 不入日志。

适合:需要OCR、截图识别、图片识别能力的用户

已进入可追溯的 Awesome 社区清单

读取本地文件
配置资料
当前不建议安装
配置难度
未知,待补配置
兼容性
当前版本需要复核
图片识别与视觉Awesome 社区收录

dsh-tool-describe-image

describe_image 模型工具:让纯文本模型通过视觉语言模型获得图像理解能力。

适合:需要OCR、截图识别、图片识别能力的用户

已进入可追溯的 Awesome 社区清单

读取本地文件
配置资料
当前不建议安装
配置难度
未知,待补配置
兼容性
当前版本需要复核
图片识别与视觉Awesome 社区收录

free-vision-skill

基于 macOS Vision Framework 的全本地识图插件:`ocr_image`(文字提取,表格结构+坐标)与 `view_image`(场景/人脸/二维码);web 输入框可直接粘贴多张图片,图片永不离开你的 Mac。

适合:需要OCR、截图识别、图片识别能力的用户

已进入可追溯的 Awesome 社区清单

读取本地文件
配置资料
当前不建议安装
配置难度
未知,待补配置
兼容性
当前版本需要复核
图片识别与视觉Awesome 社区收录

dsh-open-eyes

为纯文本 DeepSeek 路由提供视觉桥接:通过可配置的 OpenAI Responses、Chat Completions 或 Anthropic Messages 端点分析附件与本地图片,同时保持支持图片的路由走原生路径。

适合:需要OCR、截图识别、图片识别能力的用户

已进入可追溯的 Awesome 社区清单

读取本地文件
配置资料
当前不建议安装
配置难度
未知,待补配置
兼容性
当前版本需要复核
图片识别与视觉Awesome 社区收录

dsh-vision-tool

Agent 可调用的视觉工具:通过你配置的任意 OpenAI 兼容视觉端点描述本地图片,支持多模型交叉核对,不内置任何密钥。

适合:需要OCR、截图识别、图片识别能力的用户

已进入可追溯的 Awesome 社区清单

使用服务凭据读取本地文件
配置资料
当前不建议安装
配置难度
未知,待补配置
兼容性
当前版本需要复核
图片识别与视觉Awesome 社区收录

vision-route

注册 `deepseek-vision` 路由:Web GUI 直接粘贴图片,由免费智谱 GLM 视觉模型转译为文字后,再交给 DeepSeek 适配器作答。

适合:需要OCR、截图识别、图片识别能力的用户

已进入可追溯的 Awesome 社区清单

读取本地文件
配置资料
当前不建议安装
配置难度
未知,待补配置
兼容性
当前版本需要复核
图片识别与视觉Awesome 社区收录

vision-tool

给 DeepSeek Harness 的纯文本模型补上免费识图:`vision` 工具直连智谱 GLM 视觉 API 描述/OCR 图片文件(glm-4v-flash 降级链),无需任何外部 CLI。

适合:需要OCR、截图识别、图片识别能力的用户

已进入可追溯的 Awesome 社区清单

读取本地文件访问外部网络
配置资料
当前不建议安装
配置难度
未知,待补配置
兼容性
当前版本需要复核

如何理解状态:核验状态说明 52DSH 检查到哪一步;配置资料状态说明能否只依靠本站完成配置;兼容状态和运行实测另行判断。三者不能互相替代。包含高权限能力的插件应先阅读详情中的权限说明。

常见问题

图片识别与视觉插件常见问题

“源码已审阅”是否代表安全认证?

不是。它只说明 52DSH 检查了固定提交中的关键实现,仍需结合权限、配置资料和运行验证状态判断。

配置资料不完整时应该怎么做?

详情页会列出缺少的字段。未补齐专属配置、验证结果和清理方法前,只应把页面视为可追溯的安装入口。

继续浏览

其他插件分类