TwiScan
人気
コミュニティ
アカウントコレクション
ログイン
登録
English
日本語
한국의
简体中文
繁体中文
登録して招待リンクを共有すると、動画再生報酬と紹介報酬を獲得できます。
今すぐ登録
検索結果
OCR
OCR コミュニティ
1つのキーワードが1つのコミュニティです。
コミュニティ作成
アカウント
見つかりません
OCR
を含む検索結果
Itaru Tomita / 冨田到
@itarutomy
2026.08.12 07:00
画像を見ながらOCRや検索といった外部ツールを使って答えを出すマルチモーダルAIエージェントの評価を、最終的な正解率だけで済ませるのは足りない、と指摘する論文が出た( 正解にたどり着けたとしても、それが根拠のある推論の結果なのか、途中の誤りがたまたま打ち消し合って正解しただけなのかは、最終的な正誤だけでは見分けがつかない。論文はこうした失敗パターンを4つに整理しているが、なかでも厄介なのが「Phantom Grounding」と呼ぶ現象だ。証拠そのものは正しく引用しているのに、結論に出てくる数字や固有名詞がその証拠には書かれていない、一見もっともらしいのに中身が伴わないケースを指す。 研究チームが提案するLedgerMindは、推論の途中経過を1本のテキストに垂れ流すのをやめ、ツールの出力(OCR結果や検索結果など)を出どころ・種類・信頼度付きの「証拠台帳(Structured Evidence Ledger)」として記録する。以降の推論は台帳に載っている証拠しか引用できないうえ、引用しているだけでは不十分だとして、結論の数字や固有名詞が引用元の証拠と実際に一致しているかまで照合する。簡単な質問には軽い経路、複雑な質問には重い経路へ自動で振り分け、余計な深読みで正しい答えを崩す「考えすぎ」も防ぐ。さらに、間違いに気づいたときの修正も自由に書き直させず、証拠の差し替えやツールの呼び直しなど決まった操作だけに絞っている。自由な書き直しは、直しているつもりで新しい未検証の主張を紛れ込ませやすいためだ。 VTC-Benchというベンチマークでは、Gemini-3-Flashと組み合わせて58.9%(同じモデル単体の素の性能から+12.4ポイント)まで伸ばし、既存手法の最高値を更新している。検証した中で一番性能が低かったKimi-K2.6ほど伸び幅が大きく、あるサブベンチマークでは正解率が19.5%から46.0%(+26.5ポイント)まで跳ね上がった。もっとも興味深いのはアブレーション実験(仕組みを1つずつ外して効果を確かめる実験)で、この証拠台帳を丸ごと外すと正解率が68.9%から53.5%まで急落する。「証拠を引用しろ」と指示するだけでは足りず、構造として引用先を強制する部分こそが効いている、という結果だ。
もっと見る
0
0
0
9
2
コミュニティへ転送
iwashi / Yoshimasa Iwase
@iwashi86
2026.06.24 10:00
Mistral も OCR の新バージョン出している。baiduに続き熱い。
0
0
0
8
1
コミュニティへ転送
iwashi / Yoshimasa Iwase
@iwashi86
2026.06.24 03:30
baiduのOCR。 ベンチ上はかなり強く見える。
0
0
0
1
0
コミュニティへ転送
コニー
@cony_0626
2026.02.22 10:25
今日はねこの日だにゃん♩
0
0
5
371
32
コミュニティへ転送
うちの🦍
@uchino0212uk
2024.09.14 12:52
帰宅を喜んでくれる王くん🐭
0
0
5
237
8
コミュニティへ転送
七ツ森りり👸💜🐶
@riri_nntmr
2021.05.11 04:54
ロケ撮影✌🏻がんばるぞ✌🏻
0
0
69
3.3K
119
コミュニティへ転送
あわつまい
@MaiAwatsu
2026.07.22 10:29
縮地な美里ちゃんと彩希帆🫶🏻笑 #
舞台アサルトリリィ
#
0
0
0
9
2
コミュニティへ転送
らんしぇ🐴C108(土)東3マ32a🐢とてもとても返信遅✍️
@r_ra_ra_r
2026.01.21 14:29
勝利の女神:NIKKE 🐇ブラン🐇 #
NIKKE
# #
NIKKEcosplay
#
0
0
4
195
30
コミュニティへ転送
読み込み中...