すべてのプラグインに戻る

vision-tool

@yanxinwang-ml

概要

テキスト専用の DeepSeek Harness モデルに画像認識機能を追加します。analyzeimage ツールを登録し、Harness 独自の ctx.llm 経由で画像を専用のビジョンモデル(デフォルトは zhipu/glm-4.6v-flash)にルーティングします。テキストモデルのセッションでも画像認識が可能になります。

元言語から機械翻訳された説明です。

インストール

terminal
npx @deepseek-ai/dsh plugin add dsh-plugin-vision-tool
パッケージを追加し、カーネルが何を inject するかを解決できるようにします。