註冊並分享邀請連結,可獲得影片播放與邀請獎勵。

meng shao
@shao__meng
追踪 AI 前沿,精选解读一手技术资料 分享 Agent 构建与 AI Coding 实践,拆解 Agent 工程架构和细节、技术选型与企业应用案例 前 CTO|AI 技术顾问 · 企业培训 公众号 / 小红书:AI 启蒙小伙伴 合作请私信 📮
加入 November 2023
1.1K 正在關注    34.4K 粉絲
Doc + Jev => DocJev @llama_index 团队最新开源文档分类与拆分工具 DocJev,给它一个 PDF/DOCX/PPTX 和一份用自然语言写的类别规则,它可以告诉你这份文档属于哪个类别,或者把一份“文件包”按边界拆成若干子文档并给出各自页码范围。 开源地址: 核心架构:解析与决策分离 1. 解析层(OCR/文本化):默认用 liteparse,本地原生 Python 解析器,免费、无 API 费用;可选 LlamaParse,基于 VLM,擅长复杂版式,分 Cost Effective / Agentic / Agentic Plus 三档,支持版本锁定和缓存。DOCX/PPTX 需借助 LibreOffice 先渲染成 PDF。 2. 决策层(Jev):把归一化后的页文本发给 Jev 托管服务,返回类别、概率和分布。 这个分离带来两个直接好处:解析结果可复用(parse 一次,classify/split 多次,metrics.decision_ms 可单独看推理耗时);换 OCR 后端不影响决策逻辑。“6 倍速度”的对比是包含 liteparse 解析时间的全链路数字。
顯示更多
0
5
37
14
轉發到社區