FlexyAgents kann Wissen über reinen Text hinaus mit KI anreichern: Gemini Vision beschreibt Bilder, damit die semantische Suche „Screenshots der Rechnungsseite“ findet, und Gemini transkribiert Podcasts oder Schulungsvideos in durchsuchbaren Text.
Auf gehosteter Infrastruktur kann Ihr Abonnement separate monatliche Obergrenzen umfassen für (1) Bilderkennung bei Importen vs. Crawls und (2) Medientranskription bei Importen vs. Crawls. OCR (Text aus Pixeln) und Basis-Metadaten ersetzen Vision nicht — das sind getrennte Pfade und nicht das, was diese „Bilderkennungs“-Quotas messen.
Einen gültigen Google-Gemini-API-Schlüssel für Ihre Organisation hinzuzufügen (Einstellungen → LLM-API-Schlüssel) leitet Vision und Transkription über Ihr Google-Konto, sodass gehostete FlexyAgents-Quotas für diese Vorgänge nicht hochzählen.