登録して招待リンクを共有すると、動画再生報酬と紹介報酬を獲得できます。

cv usk
@cv_usk
AI / Software Research Notes AI Agent, LLMOps, MLOps, Software Architecture 投稿は個人の意見です。
参加 May 2026
279 フォロー中    412 ファン
📊 決算資料のグラフの中にしか答えがない質問、これまでのRAGだと拾えなかったんです。 タイトル: How to extract meaning from charts and tables in PDFs URL: PDFをテキスト抽出せず、ページをそのまま画像として検索対象にするアプローチをWeaviateが紹介しています。注目ポイントを3つに絞って紹介します。 🔍 OCR不要のマルチベクトル検索 ページ全体を1本のベクトルに圧縮せず、画像パッチごとに複数のベクトルを持たせ、クエリとのMaxSimで局所マッチングします。チャートやレイアウトの視覚情報を壊さずに検索できるのがポイントです。 🖼️ ドラッグ&ドロップで導入完了 Weaviate CloudにPDFを入れるだけで各ページを高解像度画像化しBLOB保存、専用モジュールが自動でベクトル化します。NVIDIAの決算資料92ページの取り込みはわずか約90秒でした。 🤖 出典付きで数値を回答 「自動車事業の売上推移は?」と聞くと、$346M→$586M(+69%)という五四半期分の棒グラフのページを正しく検出。Query Agentを使えば根拠ページの画像付きで回答も生成できます。 チャートだらけで扱いにくかったPDFこそ、実は一番おいしいユースケースだったという発想の転換が面白いところです。 #RAG# #Weaviate#
もっと見る