3000亿参数塞进一块芯片:AMD说,以后跑AI,不用连网了

9月初,德国柏林,IFA 2026。
AMD一开场就甩出王炸:锐龙AI Max PRO 400系列,代号Gorgon Halo。
这芯片最吓人的不是算力,是内存。
CPU和GPU共享一块192GB的统一内存,其中最多160GB能分给显卡当显存。
160GB显存是什么概念?
现在笔记本上的独立显卡,显存普遍只有8到24GB。
你掏空钱包买的顶配游戏本,显存可能还没人家零头多。
内存管够,为什么这么重要?
因为本地跑大模型,瓶颈从来不是算力,是内存。
一个3000亿参数的模型,用4位量化压缩后大约要占150GB。
刚好塞进这160GB显存里。
所以AMD敢拍胸脯:全球首款能在本地跑3000亿参数大模型的x86处理器,就是我。
以前想跑这种规模的模型,你得连上云,把数据传上去,再拉结果下来。
现在不用了。笔记本本地就能跑,数据不出门。
需要处理敏感数据、又要求低延迟的企业级AI应用,相当于买了个”随身机房”。
三款型号:旗舰款Max+ PRO 495,16核32线程,最高5.2GHz,NPU算力55TOPS;往下是PRO 490,12核;PRO 485,8核。
清一色Zen 5架构,配RDNA 3.5核显加XDNA 2 NPU。
这么猛的料,谁来装?
惠普、联想、华硕,Q3出货,主打商用AI PC、移动工作站和小型台式机。
消费级版本?今年晚些时候再说。
不过得泼盆冷水:内存是真的肉疼。
2026年全球DRAM短缺,LPDDR合同价一年涨了146%。
苹果想给高配Mac上个24GB内存都供货告急,AMD这192GB大套餐,定价和出货量都得打问号。
但方向已经太明白了:AI正从云端往下走,往每个人的桌面上走。
以前拼的是”云端有多强”,以后拼的是”你自己的电脑有多能装”。
这场仗,AMD挑了条别人没走过的路。