visionpower
@piercehuang663
VisionPower: Codex、Claude Desktop、Cursor、およびその他のエージェント用のポータブルな画像理解 MCP サーバー。
テキスト専用の DeepSeek モデルに視覚機能を提供します。チャット画像を OCR テキストとビジョンモデルによる説明に変換し、LLM へ送信する前の透過的な処理を行う DeepSeek Harness プラグインです。ビジョンバックエンド(GLM-4V, Qwen-VL, Gemini, Ollama など)を Models 設定ページから直接構成可能で、マルチバックエンドのフォールバックチェーンやダブルレイヤー機能などを備えています。
元言語から機械翻訳された説明です。