Skip to main content
Zhipu AI はテキスト対話、画像理解、音声認識(ASR)、ベクトル(Embedding)をサポートしており、1 つの zhipu_ai_api_key ですべての機能を有効化できます。
Web コンソールの「モデル管理」ページから、以下のすべての機能をワンストップで設定でき、設定ファイルを手動で編集する必要はありません。

テキスト対話

画像理解

glm-5.3-flash はネイティブにマルチモーダルなので、メインモデルの場合は Agent の Vision ツールがそのまま画像認識に使用します。テキスト専用の chat モデル(glm-5.2glm-5.1glm-5-turbo など)はビジョンに対応していないため、その場合は専用の glm-5v-turbo モデルに自動的にフォールバックします。zhipu_ai_api_key を設定すれば追加の設定は不要です。

音声認識

認証情報は zhipu_ai_api_key を自動的に再利用します。音声ファイルは 25MB 未満を推奨します。サイズが大きすぎるファイルはサーバ側で拒否される可能性があります。

ベクトル

選択可能なモデル:embedding-3embedding-2。embedding を変更した後は /memory rebuild-index コマンドを実行してインデックスを再構築する必要があります。