TwiScan
热门
社区
账号集合
登录
注册
English
日本語
한국의
简体中文
繁体中文
注册并分享邀请链接,可获得视频播放与邀请奖励。
立即注册
GitHubDaily
@GitHub_Daily
💡 挖掘开源的价值 🧑🏻💻 坚持分享 GitHub 上高质量、有趣、实用的教程、AI工具、前沿 AI 技术 🧐 A list cool, interesting projects of GitHub. ✏️ 公众号:GitHubDaily
加入 May 2023
206
正在关注
88.1K
粉丝
GitHubDaily
@GitHub_Daily
2026.08.23 10:00
想在自己产品里加文字识别功能,装完 Tesseract 调半天参数,中英混排还是识别得七零八落。 docTR 是个 PyTorch 写的文字识别库,几行代码就能把 PDF 或者图片里的文字整页取出来。 它分两步走,先定位每个词在页面上的位置,再识别里面的字符,两步各自的模型都能单独换。 GitHub: 打开版面识别之后,标题、正文、表格、页眉页脚会被分别标出来,取完就知道哪段是哪段。 扫描件常见的歪页、旋转页有专门的处理选项,输出正框还是斜框自己选。 Hugging Face 上挂了在线演示,也有 Colab 笔记本,不想装环境的话先在网页上丢张图试试效果。 项目最早由 Mindee 做出来,现在交给 t2k 团队接手维护,前两天还在提交代码。 要给自己的项目接一层文字识别,比从零训个模型省事不少。
显示更多
0
0
1
5
1
转发到社区
热门用户
狱
@Wx1n11124
0 粉丝
New York Post
@nypost
4.2M 粉丝
First Squawk
@FirstSquawk
569K 粉丝
Reuters
@Reuters
26.4M 粉丝
オリコンニュース
@oricon
1.9M 粉丝
吴说区块链
@wublockchain12
181.5K 粉丝
空空道人
@Kongkongda5882
34.1K 粉丝
TVer新着
@TVer_info
100.9K 粉丝
ツイッター速報〜BreakingNews
@tweetsoku1
256.8K 粉丝
玉米棒棒
@fljjx61
0 粉丝
中國新聞社
@CNS1952
547.4K 粉丝
看中國
@kanzhongguo
348.8K 粉丝
李李Momo💋
@Lili33O49
23.7K 粉丝
华尔街观察 Xtrader
@cnfinancewatch
129.7K 粉丝
zerohedge
@zerohedge
3.4M 粉丝