すべてのプラグインに戻る

dsh-visionary

@zhuiyueya

概要

テキスト専用の DeepSeek モデルに視覚機能を提供します。チャット画像を OCR テキストとビジョンモデルによる説明に変換し、LLM へ送信する前の透過的な処理を行う DeepSeek Harness プラグインです。ビジョンバックエンド(GLM-4V, Qwen-VL, Gemini, Ollama など)を Models 設定ページから直接構成可能で、マルチバックエンドのフォールバックチェーンやダブルレイヤー機能などを備えています。

元言語から機械翻訳された説明です。

トピック

deepseekimage-understandingllm-pluginmultimodalocrtext-only-llmvision-bridgevlm