註冊並分享邀請連結,可獲得影片播放與邀請獎勵。

檢索結果 transformersbw
transformersbw 貼吧
一個關鍵字就是一個貼吧,路徑全站唯一。
建立貼吧
用戶
未找到
包含 transformersbw 的搜尋結果
既然 Kimi K3 已经把开放 Agent 模型带到 2.8T 参数这个规模,@Meta 为什么还发布一个 30B 的 Muse Glimmer? Kimi K3 代表的是一条很明确的路线:继续扩大开放模型的能力边界—— 2.8T 参数、1M context、视觉理解,面向长程 coding、知识工作和深度推理。Kimi 官方还建议用 64+ accelerators 的 supernode 部署它。它更接近在回答: 开放模型还能承载多复杂的 Agent 任务? Glimmer 选择的是另一种部署尺度。 30B 多模态、Apache 2.0 开放权重。 HuggingFace在发布说明里直接写了本地 coding、文档分析、个人助手,以及 “Claw- or Hermes-like setups”;发布当天还提供 transformers、llama.cpp、vLLM 接入,并展示了 GGUF 量化和 OpenAI-compatible endpoint 的本地运行路径。 Llama 早就能接进 Agent,Glimmer 的变化不在于第一次具备这项能力。我认为重点是: 这次发布把模型的使用语境更明确地放到了自行部署 Agent 的开发者场景里。 当然,本地不等于轻量。HF 给出的 BF16 推理参考仍是 1×80GB H100,这不是普通人能部署的;量化后的性能、硬件门槛和长期运维成本,还需要真实使用验证。 所以 Meta 发 Glimmer,并不是拿 30B 去打压 2.8T。 K3 把开放模型推向更大的能力规模;Glimmer 则把多模态、开放权重、量化路径和本地 Agent 工作流结合在一起。 Meta 这次关注的可能是另一类需求:开发者是否能把模型部署、修改,再接进自己的文件、工具和工作流。 出处:
顯示更多
0
47
45
1
轉發到社區
多数人觉得 OCR 卷到头了,无非拍照转文字。但腾讯混元刚开源的 HyOCR-1.5 跳出了这套路子——1B 参数纯视觉端到端模型,在 OmniDocBench v1.6 上以 94.74 分拿下端到端第一,推理速度还提了 6.37 倍。 传统 OCR 流水线要拼接检测、识别、版面分析多个模型,慢且重。HyOCR-1.5 一个模型端到端输出,还用了 DFlash 投机解码:并行猜测多条解码路径,快速筛最优结果,让推理大幅加速。在 Transformers 上快 6.37 倍,vLLM 快 2.14 倍,最后单页文档端到端推理只要 1.408 秒。原先处理百页要几分钟,现在半分钟搞定,成本跟着跳水。 更关键的是全栈开源。模型权重、训练代码、推理流程全部开放,没有 API 调用费,数据不离开本地。对天天要处理合同、发票、古籍的团队来说,这种又快又省还不泄露数据的方案,每月可能省出一个人力成本。 它的适用面也没局限在中英文。通过 Agentic Data Flow,HyOCR-1.5 扩展到了 331 种语言、古文字识别,还能做多图问答。128K 上下文窗口加上 4K 分辨率,长图、竖排文档都能直接处理,不用切块、不用额外对齐。 当然,开源不等于「无脑能用」。虽然 1B 参数消费级显卡就跑得动,但装环境、跑 Demo 还是需要一点技术底子。社区已经有热心人封装一键包,不过暂时不够傻瓜化;追求「上传即得结果」的朋友,可以蹲一下腾讯混元后续的云服务。 但我觉得,这款模型最大的价值不是技术指标——而是它把「高质量、低成本、全栈可控」这三件事同时装进了一个能跑在任何机器上的 1B 小模型中,让普通团队也能用上以前大厂才烧得起的 OCR 能力。开源给了杠杆,试错的门槛已经很低。 怎么踩上这个杠杆?👉 普通用户:关注腾讯混元公众号,先看技术细节,把云服务上线消息存下来。开发者:去 GitHub 搜 JevenYu/HyOCR,拉模型跑 Demo,立刻替换掉项目里那条慢速 OCR 管道。产品经理/创业者:拿几张你最痛苦的文档测一测速度、精度和成本,说不定下一个垂直文档处理工具的原型就出来了。
顯示更多
0
48
231
47
轉發到社區
网上 AI 课多到看不过来,绝大多数是把概念念一遍。下面这条路线全部免费,按顺序走: 1、【Google 机器学习速成课程】 第一站,用来建立地图。几小时过完,知道训练、损失、过拟合这些词到底在说什么。这步不求深,求的是后面听别人讲话能跟上。 2、【 第二站,直接上手做出能跑的模型。这门课反着教,先让你训练出一个能用的图像分类器,再回头讲原理。前面会有很多看不懂的地方,正常,这一步就是让你先获得反馈。 3、【Karpathy 的 Neural Networks: Zero to Hero】 第三站,也是这条路线的核心。前 OpenAI 和特斯拉的 Karpathy 从零手写反向传播,一路写到一个能跑的 GPT,每一行代码都讲清楚为什么。跳过前两步直接看这个会很吃力,因为缺地图和手感。 4、【Hugging Face 官方课程】 第四站,从原理转向工程。讲怎么用 transformers 库加载模型、微调、部署,以及大模型和智能体相关的实践。到这一步你才开始有能力做出别人能用的东西。 5、【 短课】 补充站,吴恩达团队和各家公司合作的小课,每门一两个小时,专门讲某个具体主题,比如提示词、检索增强、智能体。哪块不懂补哪块,不用按顺序刷。 6、【斯坦福 CS231n】 深挖站,公开课里讲视觉和神经网络原理最扎实的一门,作业量很大。前面几步都走完还想往学术方向走再来碰。 顺序不能反。先有地图,再有手感,最后补原理,反过来九成人会在第二步放弃。
顯示更多
说真的,GitHub上藏着一堆宝贝,大多数人根本不知道。 我整理了35个仓库,分四类给你,建议截图收藏,以后用得上。 一、学习类(打基础用的) 1️⃣ public-apis — 免费API大合集,做项目直接拿来用,不用自己造轮子 2️⃣ build-your-own-x — 边做边学,比看书强十倍 3️⃣ developer-roadmap — 不知道学什么方向?进去看一眼,路线图全给你画好了 4️⃣ free-programming-books — 免费编程书,能省不少钱 5️⃣ coding-interview-university — 自学计算机科班内容,有人靠这个进了大厂 6️⃣ the-art-of-command-line — 终端用得溜,效率直接翻倍 7️⃣ project-based-learning — 项目驱动学习,学完就能上手 8️⃣ you-dont-know-js — 你以为你懂JavaScript?进去看看再说 9️⃣ freeCodeCamp — 免费编程课,从零开始也能跟上 二、工具类(干活用的) 1️⃣ system-design-primer — 系统设计必读,面试聊架构全靠它 2️⃣ tech-interview-handbook — 面试准备手册,刷完通过率肉眼可见地高 3️⃣ javascript-algorithms — 算法可视化,看得懂,记得住 4️⃣ 30-seconds-of-code — 实用代码片段,复制粘贴直接用 5️⃣ gitignore — 各语言.gitignore模板,别再手写了 6️⃣ the-book-of-secret-knowledge — 黑客资源合集,懂的人懂 7️⃣ awesome-selfhosted — 想自建应用?这里全是开源替代品 8️⃣ markitdown — 各种文件一键转Markdown,省事 9️⃣ maigret — 3000多个网站OSINT查询,信息收集神器 三、AI基础设施类(现在最值钱的方向) 1️⃣ ollama — 本地跑AI模型,不花一分钱API费 2️⃣ langchain — 构建AI应用的基础框架,绕不开 3️⃣ n8n — AI自动化工作流,能替你干很多重复活 4️⃣ dify — 可视化创建AI代理,不会代码也能玩 5️⃣ langflow — 拖拽式搭AI管道,门槛极低 6️⃣ mem0 — 给AI代理加记忆层,让它记住你说过的话 7️⃣ open-webui — 自建ChatGPT界面,数据留在本地 8️⃣ aider — 终端里的AI编程助手,写代码快很多 9️⃣ huggingface-transformers — 现代AI的地基,绕不开这个 四、多代理AI类(下一波红利在这) 1️⃣ browser-use — AI直接控制浏览器帮你干活 2️⃣ crewai — 多个AI代理组团协作,像个虚拟团队 3️⃣ autogen — 微软出的多代理框架,稳 4️⃣ metagpt — AI代理模拟整个软件公司,细思极恐 5️⃣ tradingagents — 交易多代理框架,量化方向的人注意了 6️⃣ lobe-hub — 可视化多代理平台,管理起来方便 7️⃣ cocoindex — 长文本代理引擎,处理大文档用得上 8️⃣ agency-agents — 完整AI代理机构框架,直接拿来二开 这35个仓库,光是AI这块就够你研究半年。 现在不收藏,等你想用的时候根本找不到。
顯示更多
兄弟们,40个有用的GitHub仓库,强烈建议收藏起来! 1. public-apis — 免费API合集 2. build-your-own-x — 边做边学 3. developer-roadmap — 学任何技术 4. free-programming-books — 免费书籍 5. system-design-primer — 掌握系统设计 6. coding-interview-university — 自学计算机 7. the-art-of-command-line — 精通终端 8. project-based-learning — 项目式学习 9. you-dont-know-js — 深入学JavaScript 10. the-book-of-secret-knowledge — 黑客资源 11. tech-interview-handbook — 面试通关 12. awesome-selfhosted — 自建应用 13. javascript-algorithms — 可视化算法 14. 30-seconds-of-code — 实用代码片段 15. gitignore — 各语言模板 16. ollama — 本地运行AI模型 17. langchain — 快速构建AI应用 18. n8n — AI自动化工作流 19. openclaw — 本地AI助手 20. dify — 可视化创建AI代理 21. langflow — 拖拽式AI管道 22. mem0 — AI代理记忆层 23. browser-use — AI控制浏览器 24. ruflo — Claude代理编排 25. crewai — 多代理AI团队 26. hermes-agent — 开源AI代理 27. markitdown — 文件转Markdown 28. maigret — 3000+网站OSINT 29. open-webui — 自建ChatGPT界面 30. aider — 终端AI编程助手 31. agency-agents — 完整AI代理机构 32. tradingagents — 交易多代理框架 33. browserbase-skills — Claude网页SDK 34. autogen — 微软多代理框架 35. metagpt — AI代理软件公司 36. lobe-hub — 可视化多代理平台 37. huggingface-transformers — 现代AI基础 38. cocoindex — 长文本代理引擎 39. freeCodeCamp — 免费编程学习 40. stable-diffusion-webui — 本地AI画图
顯示更多
0
22
798
237
轉發到社區