ナレッジ

インポートとサポート形式

FlexyAgents が取り込むファイルタイプ、大容量インポートの扱い、オプションの AI エンリッチメント付き画像とメディア、埋め込み後もチャンクが有用であるための編集上のヒント。

pdf インポートドキュメントナレッジベース画像音声動画

コンテンツがすでにファイルとして存在する場合、インポートはナレッジベースを最も早く立ち上げる方法です。FlexyAgents はテキストを抽出し、埋め込み用に分割し、選択したベースに紐づけます。

画像は OCR に加え、オプションで Gemini による説明を経由できます。Gemini が利用可能な場合、音声と動画は文字起こしできます — クォータと BYOK については、ドキュメント → ナレッジ → AI Vision、文字起こし、制限を参照してください。

品質は依然として重要です。OCR 済み PDF、複雑な表、スライドデッキは、確実な取得のためにクリーンアップが必要な場合があります。

サポート形式

一般的なオフィス形式(Word、Excel、CSV)、PDF、HTML/Markdown/JSON/XML、RTF、一般的なアーカイブ(ZIP、RAR、TAR、GZ)、画像(JPEG、PNG、GIF、WebP、BMP、TIFF、SVG テキスト抽出)、メディア(例:MP4、WebM、MP3、WAV、OGG)は、通常のダッシュボードでサポートされています。

正確な許可リストと最大ファイルサイズは変更される場合があります — 製品内インポーターを正としてください。一部のアーカイブタイプ(例:7z)はブロックされる場合があります。

パスワード保護または DRM 保護されたファイルは、インポート前に復号する必要があります。

  • PDF:テキストネイティブ PDF を優先してください。スキャン PDF は OCR への依存度が高くなります。
  • 画像:意味のあるファイル名を付けてください。クロールした HTML の alt テキストは、Vision が無効でも役立ちます。

取得のための構造化

見出し、短いセクション、明示的なタイトルを使用し、チャンク境界が概念と一致するようにしてください。alt テキストのない画像だけに重要な事実を埋め込まないでください。

ファイル間の重複コンテンツはノイズを増やします。重複排除するか、正規ドキュメントを指定してください。

ボリュームとバッチ インポート

製品 API とダッシュボード フローは、レート制限付きで 1 リクエストあたり複数ファイルを受け付ける場合があります。大規模移行はタイムアウトを避けるため分散し、埋め込みキューを監視してください。

エンタープライズ移行では、ソース システムでコンテンツが継続的に更新される場合、インポートとコネクターを組み合わせてください。

更新とバージョン管理

コネクターが利用できない場合は、改訂ファイルを再インポートしてください。大規模な置換は再埋め込みに時間がかかる場合があります。

規制対象コンテンツを削除する際は法務と調整してください — 古いベクトルを残すのではなく、意図的にソースを削除またはアーカイブしてください。

自社スタックで構築

根拠のあるアシスタントを本番投入する準備はできましたか?

トライアルを開始するか、展開、ガバナンス、エンタープライズ要件についてご相談ください。