zhipu_ai_api_key ですべての機能を有効化できます。
テキスト対話
画像理解
glm-5.3-flash はネイティブにマルチモーダルなので、メインモデルの場合は Agent の Vision ツールがそのまま画像認識に使用します。テキスト専用の chat モデル(glm-5.2、glm-5.1、glm-5-turbo など)はビジョンに対応していないため、その場合は専用の glm-5v-turbo モデルに自動的にフォールバックします。zhipu_ai_api_key を設定すれば追加の設定は不要です。
音声認識
認証情報は
zhipu_ai_api_key を自動的に再利用します。音声ファイルは 25MB 未満を推奨します。サイズが大きすぎるファイルはサーバ側で拒否される可能性があります。
ベクトル
embedding-3、embedding-2。embedding を変更した後は /memory rebuild-index コマンドを実行してインデックスを再構築する必要があります。