M5 Ultra Mac Studio 测评,苹果评测界的大神级人物 @viticci Viticci 刚交出了一份极具杀伤力的答卷。 他把搭载 256GB 统一内存、售价高达 11299 美元的顶配 M5 Ultra Mac Studio 当成了个人研发底座, 用开源框架 Hermes 驱动本地智能体连续无休跑了整整 99 天来完成年度重磅调研, 跑完这套漫长长任务的云端 API 开销硬生生被按在了 0 元。
很多人第一反应是一万多美元买台电脑简直疯了, 但只要算清背后的算力账本, 你就会发现这完全是本地 AI 智能体时代的分水岭。
传统组装 PC 哪怕塞进最顶级的 RTX 5090 显卡, 算力跑单次短任务确实更猛, 但那张卡被厂商精准阉割在了 32GB 显存里。面对 70B 以上的开源大模型或者需要挂载多个子智能体的复杂长任务, 显存瞬间被撑爆溢出, 机箱风扇狂啸不说, 系统还要被迫把上下文疯狂裁剪。
而苹果的四芯架构直接把 256GB 内存全部变成了显卡可以随意调用的显存池, 配合高达 1.2 TB/s 的恐怖带宽, 彻底消除了内存墙的存在。
实测在本地跑顶尖开源模型时, 生成速度稳定跨过每秒 100 词大关, 预填充处理长文本的速度比上一代直接暴涨了 150%。
更耐人寻味的是静默常驻的系统底气。它不需要你给机房上水冷降噪, 一个安静的小盒子摆在桌角, 里面同时开着数个负责写代码、搜资料和做质检的本地 Agent 蜂群, 数据不离本地一个字节, 电费只有几十瓦, 还能享受完整的原生桌面软件生态。
以前买电脑是花钱买一块处理日常事务的屏幕, 从今天起是用一次性硬件折旧彻底买断一个替你全天候干活的数字参谋部。
如果给你一台 256GB 显存起步、完全不花 Token 费用的本地算力怪兽, 你最想让它在后台替你 24 小时挂机跑什么任务? 我先说, 抓取全网行业论文做本地知识图谱重构, 以前心疼几百刀 API 费舍不得全量跑的任务, 终于可以无脑开工了。 Viticci 对比 5090 的核心交互跑分图表和本地开源模型搭配建议, 评论区自取