dashscope_api_key で有効化できます。
テキスト対話
画像理解
dashscope_api_key を設定すると、Agent の Vision ツールは自動的に Qwen のビジョンモデルを呼び出して画像を認識します。qwen3.7-plus / qwen3.6-plus / qwen3.5-plus / qwen3-max などのモデルはそのままマルチモーダルです。メインモデルがテキスト専用(qwen-turbo など)の場合は、自動的に qwen-vl-max にフォールバックします。
Vision モデルを手動で指定したい場合:
qwen3.7-plus、qwen3.6-plus、qwen3.5-plus、qwen3-max。
画像生成
qwen-image-2.0、qwen-image-2.0-pro。
音声認識
認証情報は
dashscope_api_key を自動的に再利用します。1 ファイルあたり 10MB 未満、長さ 300 秒以内を推奨します。
音声合成
よく使われる音色の例:
完全な音色(普通話 / 各地の方言 / バイリンガルなど)は、Web コンソールの「モデル管理 → 音声合成」のドロップダウンから視覚的に選択できます。
ベクトル
text-embedding-v4 です。embedding を変更した後は /memory rebuild-index コマンドを実行してインデックスを再構築する必要があります。