返回所有插件

dsh-visionary

@zhuiyueya

关于

为纯文本 DeepSeek 模型赋予视觉能力 - 一个 DeepSeek Harness 插件,可在聊天图像到达 LLM 之前将其透明地转换为 OCR 文本及视觉模型描述。直接在 Models 设置页面配置视觉后端(GLM-4V、Qwen-VL、Gemini、Ollama 等);支持多后端故障转移链、双层...

描述由原文机器翻译而来。

主题

deepseekimage-understandingllm-pluginmultimodalocrtext-only-llmvision-bridgevlm