メインコンテンツへスキップ
Google Gemini はテキスト対話、画像理解、画像生成(Nano Banana シリーズ)をサポートしており、1 つの gemini_api_key ですべての機能を有効化できます。
Web コンソールの「モデル管理」ページから、以下のすべての機能をワンストップで設定でき、設定ファイルを手動で編集する必要はありません。

テキスト対話

画像理解

Gemini の全シリーズモデルはネイティブにビジョンをサポートしています。gemini_api_key を設定すると、Agent の Vision ツールは自動的にメインモデルを使用して画像を認識します。追加設定は不要です。 Vision モデルを手動で指定したい場合:

画像生成