visionpower
@piercehuang663
VisionPower:一个用于 Codex、Claude Desktop、Cursor 及其他 Agent 的便携式图像理解 MCP 服务器。
为纯文本 DeepSeek 模型赋予视觉能力 - 一个 DeepSeek Harness 插件,可在聊天图像到达 LLM 之前将其透明地转换为 OCR 文本及视觉模型描述。直接在 Models 设置页面配置视觉后端(GLM-4V、Qwen-VL、Gemini、Ollama 等);支持多后端故障转移链、双层...
描述由原文机器翻译而来。