open_ai_api_key で Agent はすべての機能を利用できます。
テキスト対話
画像理解
gpt-5.5、gpt-5.4、gpt-4o、gpt-4.1 などの OpenAI モデルはネイティブにビジョンをサポートしています。open_ai_api_key を設定すると、Agent の Vision ツールは自動的にメインモデルを使用して画像を認識します。メインモデルがビジョンに対応していない場合や明示的に指定したい場合は、設定ファイルで指定できます:
gpt-5.5、gpt-5.4、gpt-5.4-mini、gpt-5.4-nano、gpt-5、gpt-4.1、gpt-4.1-mini、gpt-4o。
画像生成
設定ファイルで画像生成モデルを指定すると、Agent が画像生成スキルを呼び出す際に自動的に OpenAI にルーティングされます:gpt-image-2、gpt-image-1。
音声認識
認証情報は
open_ai_api_key を自動的に再利用します。
音声合成
ベクトル
text-embedding-3-small、text-embedding-3-large、text-embedding-ada-002。embedding を変更した後は /memory rebuild-index コマンドを実行してインデックスを再構築する必要があります。