FlexyAgents は、プレーンテキストを超えて AI でナレッジをエンリッチできます。Gemini Vision は画像を説明し、セマンティック検索が「請求ページのスクリーンショット」を見つけられるようにします。Gemini はポッドキャストや研修動画を検索可能なテキストに文字起こしします。
ホスト型インフラでは、サブスクリプションに (1) インポート vs クロールの画像認識、(2) インポート vs クロールのメディア文字起こし — それぞれ別の月次上限が含まれる場合があります。OCR(ピクセルから抽出したテキスト)と基本メタデータは Vision の代替ではなく、別経路です — これらの「画像認識」クォータが計測する対象ではありません。
組織向けに有効な Google Gemini API キーを追加すると(設定 → LLM API キー)、Vision と文字起こしの呼び出しは Google アカウント経由で処理され、これらの操作に対する FlexyAgents ホスト型クォータは加算されません。