首页 时政热点 科技头条 智能AI 安全攻防 数码硬件 开发者生态 汽车 游戏 社会热点 开源推荐 医疗健康 归档 标签 关于
汽车 morning

企业爆买AI Box

摘要

一台放在办公桌上、比机顶盒大不了多少的机器,塞着上百 GB 统一内存,断网也能跑千亿参数大模型。不用机房,不用机柜,插电即用,数据不出房门。这就是AI Box,一台搬上办公桌的数据中心。 AI Box赛道中苹果、英伟达、AMD、微软、英特尔悉数到场。但这种形态并不新鲜,为何2026年“连上显示器就是台电脑”的小盒子成了必争之地? 大模型有两种用法:调云端,或者在本地跑。 云端意味着AI能力无上限,...

Mac 统一内存 DGX Spark token Studio Box 英伟达 DeepSeek 32GB
2026-09-22 1 阅读 约10分钟阅读 半导体产业纵横
分享:
字号:
一台放在办公桌上、比机顶盒大不了多少的机器,塞着上百 GB 统一内存,断网也能跑千亿参数大模型。不用机房,不用机柜,插电即用,数据不出房门。这就是AI Box,一台搬上办公桌的数据中心。 AI Box赛道中苹果、英伟达、AMD、微软、英特尔悉数到场。但这种形态并不新鲜,为何2026年“连上显示器就是台电脑”的小盒子成了必争之地? 大模型有两种用法:调云端,或者在本地跑。 云端意味着AI能力无上限,模型不用自己管,最强的能力随时可用。但账也很清楚:订阅制里,ChatGPT Pro、Claude Max 都是 200 美元/月封顶;封顶之外按量计费,9 月 3 日刚发布的 GPT-6 Astra,输出价格是每百万token 50 美元。对跑智能体的重度用户,一次长任务输出数万 token,一个月烧掉几百到上千美元是常态。 业内人士表示,过去两年企业上 AI,绝大多数卡在“从概念到落地”的摸索期:场景要试、流程要换、提示词要调。这个阶段每一分钟都在花 token 的钱,而老板往往只给得出方向,给不出具体要求。“烧了很多钱,出什么结果呢?不知道。” 本地部署的逻辑因此成立:主流模型大多开源免费(DeepSeek、Qwen 系列均为宽松协议开源),硬件一次性购入,之后没有 token 账单,数据不出机房。预研、验证、反复试错,成本是固定的。 AI Box因此而生。 01 什么样的Box才能叫AI Box? AI本地部署有一道硬门槛:模型得先“装得下”,内存就是AI Box的入场券。 跑大模型的前提,是权重全部装进内存或显存。DeepSeek-R1 满血版 6710 亿参数,全精度(FP16)需要约 1.3TB 显存,FP8 量化约 0.7—0.8TB,即使 4-bit 量化也要 400—480GB8。作为对照,一张 RTX 5090 是 32GB 显存9,一台高配笔记本是 24—32GB 统一内存——只能塞下 70 亿参数级别的小模型。 这就是桌面 AI 设备最大的技术命题:在一台放得进桌子的机器里,塞进尽可能大的统一内存,喂给模型尽可能高的带宽,再把功耗压进办公室插座能承受的范围。 容量决定能跑多大的模型,带宽决定多少人能同时用、出字有多快,功耗决定它能不能放在办公室而不是机房。在这三个维度上,最戏剧化的事情是:准备最充分的那家公司,本来不是为 AI 设计的。 2020 年,苹果把 Mac 迁到自研 M 系列芯片,做了一个当时看相当激进的决定:CPU、GPU、神经引擎共享同一块内存,内存即显存。这个叫统一内存(UMA)的架构,初衷是砍掉数据在芯片间搬运的开销、压低功耗。 五年后大模型时代降临,这套架构刚好踩中了所有需求点。 今天的 Mac Studio,M3 Ultra 版本最高可选 512GB 统一内存、内存带宽 819GB/s,整机最大持续功耗 480W10;9 月 22 日发售的 M5 Ultra 款,带宽进一步拉到 1.2TB/s,国行 46999 元起。苹果官方口径,这台机器可以跑 6000 亿参数以上的模型。 据报道,过去几个月,OpenAI 采购了数万台 Mac mini 和 Mac Studio用于强化学习和Agent的开发,需求旺到多次催促苹果发货。库克在 7 月的财报电话会上承认,“越来越多客户把 Mac mini 用作运行智能体的强大平台、部署 Mac Studio 集群在本地运行前沿模型”,并表示当季 Mac 一直面临供应限制。 02 英伟达:不卖机器,卖“同款架构” 如果说苹果是“无心插柳”,英伟达则是看到了市场需求后的“降维打击”。 DGX Spark 用的是 GB10 Grace Blackwell 超级芯片,128GB 统一内存、273GB/s 带宽、FP4 精度下 1 PFLOPS 算力,整机功耗 240W,官方标称单机可推理 2000 亿参数模型、两台互联跑 4050 亿。美国官网售价 4699 美元,国行首发价约 3 万元,内存涨价后已逼近 4 万。 单看纸面参数,它对 Mac Studio 毫无优势。但 DGX Spark 跑的是 DGX OS(Ubuntu),软件栈和数据中心里的万卡集群同源,CUDA 生态、企业级支持,开发者在桌上调好的东西,可以无缝搬到云上。 围绕英伟达DGX Spark,宏碁、华硕、戴尔、技嘉、惠普、联想、微星七家 OEM 同时推出同芯片整机,微星的版本低到 2999 美元,联想 ThinkStation PGX 去年 7 月已经进入中国政企采购目录。相对于苹果,英伟达给AI Box更加清晰的市场定位与销售野心。 如果说 Spark 是给开发者的入门机,DGX Station 就是给小团队的桌边工作站:GB300 芯片、748GB 一致性内存(252GB HBM3e 加 496GB LPDDR5X)、FP4 20 PFLOPS、整机 1600W,官方宣称能跑万亿参数模。虽然功耗已经摸到普通办公室电路的上限,但仍然比机房服务器低一个数量级。 今年 6 月 Build 大会,微软发布 Surface RTX Spark Dev Box:和 DGX Spark 同款 GB10 芯片、128GB 统一内存、1 PFLOPS,热设计功耗压到 100W,预装 Windows 11 Pro 开发者版,标称本地可跑 1200 亿参数模型、百万 token 上下文,下半年在美国发售,媒体估价 3000—3500 美元。它的入场意义大于产品意义:Windows 生态需要一个官方答案,告诉开发者本地 AI 不必非买 Mac。 03 X86阵营:展示推理时代的性价比 AMD 的Ryzen AI Max+ 395(代号 Strix Halo)把 128GB 统一内存、256GB/s 带宽做进了 55—120W 的功耗墙,NPU 50 TOPS、平台总算力约 126 TOPS。今年三季度,换代的 Ryzen AI Max 400(Gorgon Halo)会把统一内存上限拉到 192GB,官方称可跑 3000 亿参数模型。 X86的底牌是兼容,Windows、Linux 直接装,企业已有的运维体系全部复用。性能不是最强,但不用换生态,就是采购决策里最大的权重。 英特尔推出了 Panther Lake(Core Ultra 300 系),NPU 算力 50 TOPS,塞进每一台笔记本和迷你主机;最接近盒子形态的 NUC 16 Pro,内存上限 96GB,定位是 Copilot+ 迷你 PC。值得注意的是,英特尔的AI Box不只是放在桌面上的盒子,英特尔还把AI Box放到了智能汽车上,让过去算力不足的汽车拥有算力加成。可以看出,英特尔将AI Box的目标定位到了更具体的B端场景中。 04 AI Box,到底谁在买? 盒子卖出去之后,到底干出了什么? 在高职教育场景中,学校把备课、批改、实训答疑、教案沉淀分别做成教师、学生、管理三组智能体,装在盒子里本地化运行。试点后的数据是:教师周均备课时间从 9.2 小时降到 5.1 小时,每班批改时间从 2 小时压到 0.4 小时,实训错误率从 22% 降到 14.3%,优秀教案复用率从不到 10% 提到 67%。 另一个是
这篇文章对您有帮助吗?

订阅66必读

每日精选科技资讯,直达你的邮箱