注册并分享邀请链接,可获得视频播放与邀请奖励。

搜索结果 HYO
HYO 贴吧
一个关键词就是一个贴吧,路径全站唯一。
创建贴吧
用户
未找到
包含 HYO 的推特
chudai💦💦 直播间通道1v1线下:
0
0
11.7K
1.1K
转发到社区
我通过了你的主奴验证请求,快来点击头像跟玩具聊天吧~
0
15
4K
169
转发到社区
《直播精華,正片陸續上架敬請期待》北部場好熱鬧,大家都出現了嘟嘟雞成功快被我們掰彎了請大家努力集氣雖然嘟嘟雞要射精前真的很吵
显示更多
0
10
4.3K
487
转发到社区
多数人觉得 OCR 卷到头了,无非拍照转文字。但腾讯混元刚开源的 HyOCR-1.5 跳出了这套路子——1B 参数纯视觉端到端模型,在 OmniDocBench v1.6 上以 94.74 分拿下端到端第一,推理速度还提了 6.37 倍。 传统 OCR 流水线要拼接检测、识别、版面分析多个模型,慢且重。HyOCR-1.5 一个模型端到端输出,还用了 DFlash 投机解码:并行猜测多条解码路径,快速筛最优结果,让推理大幅加速。在 Transformers 上快 6.37 倍,vLLM 快 2.14 倍,最后单页文档端到端推理只要 1.408 秒。原先处理百页要几分钟,现在半分钟搞定,成本跟着跳水。 更关键的是全栈开源。模型权重、训练代码、推理流程全部开放,没有 API 调用费,数据不离开本地。对天天要处理合同、发票、古籍的团队来说,这种又快又省还不泄露数据的方案,每月可能省出一个人力成本。 它的适用面也没局限在中英文。通过 Agentic Data Flow,HyOCR-1.5 扩展到了 331 种语言、古文字识别,还能做多图问答。128K 上下文窗口加上 4K 分辨率,长图、竖排文档都能直接处理,不用切块、不用额外对齐。 当然,开源不等于「无脑能用」。虽然 1B 参数消费级显卡就跑得动,但装环境、跑 Demo 还是需要一点技术底子。社区已经有热心人封装一键包,不过暂时不够傻瓜化;追求「上传即得结果」的朋友,可以蹲一下腾讯混元后续的云服务。 但我觉得,这款模型最大的价值不是技术指标——而是它把「高质量、低成本、全栈可控」这三件事同时装进了一个能跑在任何机器上的 1B 小模型中,让普通团队也能用上以前大厂才烧得起的 OCR 能力。开源给了杠杆,试错的门槛已经很低。 怎么踩上这个杠杆?👉 普通用户:关注腾讯混元公众号,先看技术细节,把云服务上线消息存下来。开发者:去 GitHub 搜 JevenYu/HyOCR,拉模型跑 Demo,立刻替换掉项目里那条慢速 OCR 管道。产品经理/创业者:拿几张你最痛苦的文档测一测速度、精度和成本,说不定下一个垂直文档处理工具的原型就出来了。
显示更多
0
48
231
47
转发到社区
被绑起来的乔乔 喜欢吗? @ToBulaer @ToBuerma @KawasawaSen @BulmaList ㊙️屌娘操起女人来,比男人还要猛 ㊙️你还想看乔乔干什么?可以留言告诉我
显示更多
0
71
2.9K
116
转发到社区
AI影片 凡人修仙傳 銀月II【劇情預覽】 全13min For more, please visit my profile page/完整內容請前往: 友情推薦: 圖包動圖 fansky→awei,hyominli,huachen,subking 中配劇情 fansky→ailin,ggd,QSWX,NinePM 檢索: #AI影視# #國漫# #腹黑的X# #nsfw# #doonghua# #video# #凡人修仙传# #银月#
显示更多
0
0
170
100
转发到社区