📊 決算資料のグラフの中にしか答えがない質問、これまでのRAGだと拾えなかったんです。
タイトル: How to extract meaning from charts and tables in PDFs
URL:
PDFをテキスト抽出せず、ページをそのまま画像として検索対象にするアプローチをWeaviateが紹介しています。注目ポイントを3つに絞って紹介します。
🔍 OCR不要のマルチベクトル検索
ページ全体を1本のベクトルに圧縮せず、画像パッチごとに複数のベクトルを持たせ、クエリとのMaxSimで局所マッチングします。チャートやレイアウトの視覚情報を壊さずに検索できるのがポイントです。
🖼️ ドラッグ&ドロップで導入完了
Weaviate CloudにPDFを入れるだけで各ページを高解像度画像化しBLOB保存、専用モジュールが自動でベクトル化します。NVIDIAの決算資料92ページの取り込みはわずか約90秒でした。
🤖 出典付きで数値を回答
「自動車事業の売上推移は?」と聞くと、$346M→$586M(+69%)という五四半期分の棒グラフのページを正しく検出。Query Agentを使えば根拠ページの画像付きで回答も生成できます。
チャートだらけで扱いにくかったPDFこそ、実は一番おいしいユースケースだったという発想の転換が面白いところです。
#
RAG# #
Weaviate#