メインコンテンツへスキップ
OpenAI は最も広範な機能をカバーするベンダーで、テキスト対話、画像理解、画像生成、音声認識(ASR)、音声合成(TTS)、ベクトル(Embedding)の各機能を同時に担えます。1 つの open_ai_api_key で Agent はすべての機能を利用できます。
Web コンソールの「モデル管理」ページから、以下のすべての機能をワンストップで設定でき、設定ファイルを手動で編集する必要はありません。

テキスト対話

画像理解

gpt-5.5gpt-5.4gpt-4ogpt-4.1 などの OpenAI モデルはネイティブにビジョンをサポートしています。open_ai_api_key を設定すると、Agent の Vision ツールは自動的にメインモデルを使用して画像を認識します。メインモデルがビジョンに対応していない場合や明示的に指定したい場合は、設定ファイルで指定できます:
サポートする Vision モデル:gpt-5.5gpt-5.4gpt-5.4-minigpt-5.4-nanogpt-5gpt-4.1gpt-4.1-minigpt-4o

画像生成

設定ファイルで画像生成モデルを指定すると、Agent が画像生成スキルを呼び出す際に自動的に OpenAI にルーティングされます:
サポートする画像生成モデル:gpt-image-2gpt-image-1

音声認識

認証情報は open_ai_api_key を自動的に再利用します。

音声合成

ベクトル

選択可能なモデル:text-embedding-3-smalltext-embedding-3-largetext-embedding-ada-002。embedding を変更した後は /memory rebuild-index コマンドを実行してインデックスを再構築する必要があります。