TwiScan
人気
コミュニティ
アカウントコレクション
ログイン
登録
English
日本語
한국의
简体中文
繁体中文
登録して招待リンクを共有すると、動画再生報酬と紹介報酬を獲得できます。
今すぐ登録
Ren
@Ryrenz
🇺🇸 美国全栈程序员 💻 ⚙️ 整理小白能懂的优质 AI 教程 📚 📢 持续挖掘实用的 AI 提效方式 🤖 💰 分享我关于投资、副业、职场的思考 🧠 📝 开源我所有的内容创作与 AI 变现经验 📈
参加 March 2025
678
フォロー中
10.8K
ファン
Ren
@Ryrenz
2026.08.24 07:06
📕 扫描版的老书,能整本转成 Markdown 或 EPUB GitHub 上 6.2K stars 手上有一堆扫描版的旧书和资料,问题是它们本质上是一叠图片:搜不了、复制不了、在手机上看要不停放大挪位置。想转成电子书,普通 OCR 一碰到表格就散、遇到公式就废,转出来还得手工修半天。 PDF Craft 专门冲着扫描书籍去的。它基于 DeepSeek OCR 做识别,表格和公式都在处理范围内。转 Markdown 或 EPUB 时,封面、脚注、目录识别、表格渲染和公式渲染都能配置。EPUB 这边给的选项很细:表格可以用 HTML 也可以直接裁原图,公式可以走 MathML、SVG 或者原图裁剪,识别不准的时候至少还能保留原样。 OCR 有本地和云端两条路,本地跑需要支持 CUDA 的 PyTorch 环境,模型从 Hugging Face 下载,支持自定义缓存目录和离线加载;不想折腾环境就接兼容 OpenAI 接口的云端服务。PDF 解析和渲染默认依赖 Poppler 和 pdf2image。 版本上有个变化要注意:v1.0.0 起移除了 LLM 文本纠错,改用 DeepSeek OCR,还想要旧版纠错功能的话用 v0.2.8。MIT 协议。 书数字化了才算真正属于你。 GitHub:
もっと見る
0
0
0
0
0
コミュニティへ転送
人気のあるユーザー
GIGA特撮ヒロイン【公式】
@giga_web
63K ファン
New York Post
@nypost
4.2M ファン
オリコンニュース
@oricon
1.9M ファン
TVer新着
@TVer_info
100.9K ファン
ツイッター速報〜BreakingNews
@tweetsoku1
256.8K ファン
Reuters
@Reuters
26.4M ファン
First Squawk
@FirstSquawk
569K ファン
billboard
@billboard
16.8M ファン
ファミ通.com
@famitsu
1.4M ファン
Bloomberg
@business
10.5M ファン
モデルプレス
@modelpress
2.1M ファン
PR TIMESテクノロジー
@PRTIMES_TECH
28.2K ファン
一劍浣春秋
@chee828
0 ファン
吴说区块链
@wublockchain12
181.5K ファン
zerohedge
@zerohedge
3.4M ファン