
BW 2026回顾丨个人AI终端之外,NVIDIA没有忘记游戏玩家
非常荣幸,周末受NVIDIA的邀请,去到了Bilibili World现场,体验了一把什么叫二次元的人山人海。
进入正题前先吐槽一下,每年这BW都跟说好了一样,必有台风“确认参展”,作为一个北漂两年刚回来的“老二刺猿”,难得跑趟上海却因为返程车次大多都被取消而差点没回了家,幸好“魔都拐弯”定律再度发力……

当然,展会现场依旧是相当的热闹,去年30万,今年扩容到40万玩家、6万Coser,还有停在入场口的那上千痛车,只能感慨现在的二次元热情实在是太顶了。当然,我这种30岁大龄“老二刺猿”熟悉的IP已经都差不多过时了,所以我的目标主要还是3号馆和5号馆里本次参展的各家科技品牌,包括像七彩虹、华硕等DIY硬件厂商,闪迪、雷克沙等存储厂牌、雷蛇、洛斐这种外设厂商。
作为目前全球市值第一的科技巨头NVIDIA的展台,自然也是其中最受各位玩家关注的——除了外形是RTX 50系显卡公版“皮肤”等比例放大的展台格外吸睛,相信不少玩家是被每天限量发售的RTX 5080 FE显卡吸引来的(bushi)。

而我个人认为,本次NVIDIA展台内的最关键展品,莫过于皮衣黄在6月初台北电脑展上带来的Arm架构RTX Spark芯片,这次是在国内迎来的硬件首秀。
基于Linux平台的DGX Spark
近两年,NVIDIA这个名字与AI几乎深深捆绑在了一起,在BW展台的现场,你能够看到此前NV为个人用户做本地AI部署而创建的DGX Spark硬件,这样一个与苹果Mac mini相仿尺寸的盒子里,装得却是基于NVIDIA和联发科联合打造,由完整的台积电3nm工艺 CPU、NPU配合一块 NVIDIA GB10 GPU,通过NVLink – C2C连在一起的超强芯片。

采用统一内存架构,CPU和GPU共享128GB统一内存池,带宽高达273GB/s,CPU和GPU之间的互联带宽也高达 600 GB/s,是传统PCIe 5.0协议的5倍。

在如此暴力的硬件堆叠下,这颗芯片可以释放出 1 PetaFLOP的 FP4 稀疏化算力。这意味着什么?它意味着以往需要一整台高能耗、高噪音服务器/工作站才能跑动的任务,如今被平滑地塞进了一台巴掌尺寸的小主机内,而且可以通过ConnectX-7接口进行快速扩展互联,不断增强算力性能。
这个产品的诞生初衷,大体是为了解决两大痛点:隐私焦虑与Token按次付费的成本
随着 OpenClaw、Hermes等AI智能体的爆发,几乎所有AI日常用户都开始将更多的工作交给Agent去处理,起码我自己是这样的。
而这样几乎“影分身”的工作链,无疑需要让Agent更深入系统底层去帮我们执行日常任务、语义搜索、处理本地文件。但把个人或者集体的敏感数据交给云端模型,无异于“把猫丢进有毒药瓶的黑箱”,是否泄露是否滥用纯看模型公司的好恶。况且,云端方案按次调用、按Token计费,对于一般是常驻后台长期执行任务的智能体来说,成本也是难以承受之重。
NVIDIA给出的解法是120B 大模型 + 100万上下文本地常驻
- 120B~200B 参数大模型本地盲跑:基于 Linux、面向开发者的DGX Spark桌面单机能跑200B参数大模型,即便是新推出的更轻量级基于Windows的RTX Spark在本地也能使用参数量高达120B的模型,这是把云端的功能拉回了本地;
- 100万Token上下文:长文档、巨量历史对话一次性全部塞入,本地模型不“健忘”;
- 而且,因为Token生成来自于本地算力,因此你所运行的指令,所消耗的,也就是一点电费了。
在展会现场,NVIDIA的PM给我们演示了他们的Demo:用纸笔手绘了一个“AI五层蛋糕架构塔图”,在接入了DGX Spark的摄像头前举着,直接对麦克风下达语音指令。
使用了阿里Qwen 3.6(35B 多模态)大模型的智能体通过ChatLive网页自动分屏:左侧代码快速生成弹出,右侧则在几十秒内无缝渲染出了一个现代风格、可点击的动态HTML网页图像。对效果、设计不满意,还可以快速再次生成,整个过程没动键盘,只动了动嘴,且隐私安全完全保存在本地。

同时,现场还演示了智能体识别物理插座能否用于空调供电、实时个人健康菜品推荐等多模态场景,即便模型体量不大,做一些基本的工作也绰绰有余且非常迅速。
基于Windows平台的RTX Spark
而这次国内首度亮相的RTX Spark使用了与DGX Spark一样的芯片,区别在于RTX Spark面向更多普通消费者,采用的是大家最熟悉的Windows操作系统。

以往的 Windows ARM笔记本之所以被讥讽为“大号平板”,根本原因在于ARM芯片厂商,大多GPU图形性能孱弱,对于手机/平板这样的移动设备,是足够了,但这样的性能难以打动消费级用户尤其是游戏玩家。而 RTX Spark的GPU是PC级的,基于NVIDIA Blackwell架构,有6144个CUDA核心、第五代Tensor Core、第四代RT Core,这是RTX 5070级别的图形渲染性能。

所以现场演示中,NV的工作人员直接运行了Arm原生《永劫无间》实机
现场使用的是联想的YOGA Pro 15笔记本,在 2560x1600分辨率下,开启全景光线追踪和DLSS 4x MFG。游戏画面清晰,流畅度也超过100FPS,完成度和适配效果极佳。

此外,现场还展示了虚幻引擎5的实时渲染Demo
现场还用RTX Spark笔记本运行虚幻引擎 5(UE5)开发的重型城市渲染Demo。整个工程文件超过90GB/108GB,运行时需要吞掉 70~80GB 的内存。
面对这种常规x86 PC必定会爆显存的极限场景,RTX Spark 依靠128GB统一内存和DLSS技术,不论是高速穿梭场景、拖拽编辑建筑物,画面始终丝滑,毫无卡顿,另外有一个演示中的很关键点——在不插电的纯电池状态下,性能依旧保持,这是原先x86笔记本产品一直难以逾越的难题。

这次的现场,也有如华硕、联想、惠普、微星等厂商展出的他们将要发布的搭载RTX Spark的笔记本/mini主机产品,预计都会在今年秋季发布。

情绪价值拉满:二游限定与GeForce玩家的专属记忆
除了前沿科技,NVIDIA 同样深谙 BW 现场年轻玩家的真实需求——作为一个“二次元浓度”绝对超标的展会,现场不来点二次元元素肯定说不过去。
在NVIDIA展区的中央,陈列了8款由华硕、微星、七彩虹等AIC厂商与时下四款顶流二游(二次元游戏)《异环》、《鸣潮》、《白银之城》、《明日方舟:终末地》的联名RTX 5080显卡,以及联想定制的《异环》主题笔记本、攀升《鸣潮》定制主机,直接将现场的情绪价值拉满。

还有致敬 GeForce 历史高光时刻的“GeForce玩家典藏卡”抽奖,隐藏款应该是《赛博朋克2077》夜之城特别版 RTX 2080 Ti 闪卡,可惜我没有抽中,囧……不过我有皮衣黄亲口认证“它改变了一切”的「GTX 1080」,这波还算不亏。

写在最后
其实没什么太多可说的了,预估在9、10月份,我们应该就能够看到搭载RTX Spark的笔记本/主机产品上市,届时大家应该就能体验到全新芯片带来的个人AI算力机器的能力跃升,目前还值得关注的信息,更多应该是实际场景下的续航表现(官方说笔记本这边好像是80W的TDP)以及最关键的价格。
我在之前的一个回答里就表达过对这些产品的价格担忧,AI浪潮之下,且不说存储芯片暴涨带来的BOM成本必然提升,单就说消费级的AI需求催生的原始消费冲动,就可能把这类产品的售价推高到一个普通用户难以触及的水平(比如第一波“养虾”的,给Mac mini买爆了)。而好的产品,不是吹出来的,是用户要用真金白银投票的,空有口碑没有销量,结果如何,已经有一众先例了。好消息是,NVIDIA拥有足够强大的生态支撑,也有足够的号召力。
另外,让我有点感慨的是,NVIDIA等厂商似乎终于在AI之外,又想起了消费级游戏业务,想到了玩家们的需求,这两年,玩家们实在是过得太辛苦了……