太猛了!AMD用 mini PC,直接跑 235B 模型
视频里 Lisa Su 把一个汉堡大小的 mini PC 举在手里,现场演示本地运行大模型,整个过程没有数据中心、没有云服务、也没有租用 GPU
主角是 Ryzen AI Max+ 395(Strix Halo)。这是目前把 CPU 和 GPU 融合得比较彻底的 x86 芯片,配备 128GB 统一内存。在 Linux 系统下,GPU 可以直接使用约 110GB 内存
对比很直观:RTX 5090 只有 32GB,4090 只有 24GB。这个小设备在内存容量上直接是它们的 3 倍以上
社区实测显示,在模型装不下单张 NVIDIA 显卡的场景下,特定推理任务(比如 DeepSeek R1)的性能能超过 RTX 5080 3 倍以上
设备层面,GMKtec EVO-X2 128GB 版的真实成交价大概在 1800-2500 美元左右(AMD 官方参考平台会更贵)
对重度使用 AI 的人来说,这件事的实际意义在于:可以用 Ollama、LM Studio 这类工具,本地跑真正有能力的模型。隐私完全掌握在自己手里,没有 token 限制,也不用担心半夜被限流
它特别适合需要处理私有文档的 RAG、本地 Agent 原型开发、长时间稳定运行的场景。云端订阅短期内不会消失,但对很多具体工作来说,本地这条路已经开始变得可行且有吸引力
顯示更多