登録して招待リンクを共有すると、動画再生報酬と紹介報酬を獲得できます。

超级个体|柿子
@yaohui12138
超级个体践行者|AI产品经理,日常分享 AI搞钱实战,AI编程系列教程,AI工作流实操, 只分享干货,利他即利己. 公众号:AI超级个体柿子 博客/咨询/合作:
302 フォロー中    22.2K ファン
我就知道!肯定能行
杨立昆转发了,百度 Unlimited OCR 又回到 HuggingFace Models Trending 第二。 这个 3B 开源模型发布刚满一个月,GitHub 已有约 1.66 万 Star,HuggingFace 近月下载超过 223 万次。我翻了下 HuggingFace Trending 榜单,它竟然还排在 GLM-5.2 前面。 我去读了论文。开发者持续讨论它,核心原因是长 PDF 终于有机会不再逐页识别、最后硬拼成一份结果。 它的 R-SWA 会一直看着原文里的视觉信息,只保留最近 128 个输出 Token 作为“工作记忆”。像抄一本书:眼睛一直看着原文,脑子只记刚刚抄到哪儿。 官方给出的边界是:标准 32K 最大长度下,一次前向推理可连续解析数十页,解码阶段的 KV Cache 保持恒定。海外帖子里流传的“100 页”更猛,但那不是论文给出的通用承诺。 我的判断是,OCR 下一轮要卷的已经不止单页识别率,还包括整份文档能否连续读完,以及页数增加后成本会不会跟着失控。 项目地址: #无限OCR# #UnlimitedOCR# #百度# #文心大模型# #文心#
もっと見る
受害者+1
我能做的又好又快,全靠AI构建的核心决策引擎 现在市面上的AI自媒体生产流程往往只实现了基础的信息抓取,分析,和产出 这种程度,想要真正做好远远不够 我的这套核心决策引擎,本质上其实是一套harness工程,复杂程度不亚于搭建一个agent,针对于平台,账号,内容,都有非常详细的粒度拆解 是我的产品思维和工程思维的得意之作,之前听don哥说的“鼓励好的skill开源”理论,我觉得是非常正确的 等我每个平台做到一万粉,会考虑直接开源出来,或者直接卖课
もっと見る