6月1日台北Computex展会,Nvidia同时发布了两款重磅产品:首款AI Agent专用PC芯片RTX Spark(1-petaflop算力)和全球首个完全开源物理AI基础模型Cosmos 3(64B参数)。AI创业者首次可以在本地笔记本上运行百万亿级推理。
事件回顾
6月1日,Nvidia在Computex 2026台北展会上同时发布了两款战略级产品,标志着AI硬件与开源模型的双线突破。
RTX Spark——首款AI Agent专用PC芯片。 这不是传统的显卡升级,而是一颗完整的超算芯片:Blackwell架构RTX GPU(6,144 CUDA核心)+ 20核Nvidia Grace CPU通过NVLink-C2C直连,最高128GB统一内存,达到惊人的1-petaflop算力。形态上首次进入轻薄Windows笔记本和小型桌面PC领域。Microsoft、MediaTek、OpenAI、Anthropic、SpaceX均已作为早期采用者参与。
Cosmos 3——全球首个完全开源物理AI全能模型。 采用Mixture-of-Transformers(MoT)双塔架构:Reasoner塔负责视觉语言理解("大脑"),Generator塔负责扩散式视频+动作生成("执行器")。完整版64B参数,Nano版16B参数(可在RTX PRO 6000工作站运行)。在8+个基准测试中排名第一,涵盖视觉推理、文本到图像、图像到世界、世界动作生成。Nvidia同步启动了"宇宙联盟"(Cosmos Coalition),号召全球物理AI开发者参与共建。
这两款产品叠加释放的信号非常清晰:Nvidia正在从显卡供应商转型为AI平台公司,目标直指$2000亿AI PC市场。
为什么重要
对于AI创业者来说,这两款产品的意义远超技术参数本身。
第一,本地AI Agent推理成为现实。 1-petaflop算力意味着你的Agent工作流可以完全在本地运行,不需要云计算。这对于需要低延迟、高隐私保护的Agent场景(如自动操作浏览器、本地代码生成、个人数据助理)是质变。想象一下,一个跑在你笔记本上的Hermes Agent或Claude Code,不再受API延迟和成本的限制。
第二,开源物理AI模型降低创业门槛。 Cosmos 3的完全开源策略意味着任何团队都可以在此基础上构建机器人、自动驾驶、工业仿真等物理世界应用。MoT架构的"Reasoner+Generator"双塔设计本身就是一种Agent架构参考——一个模型负责理解世界,另一个负责执行动作,这正是AI Agent的核心理念。
第三,Nvidia的生态锁定从数据中心延伸到桌面。 RTX Spark的早期采用者名单里出现了OpenAI、Anthropic和SpaceX,说明顶尖AI公司已经在为Agent原生硬件做准备。这对AI创业者意味着:未来6-12个月,围绕RTX Spark和Cosmos 3的开发者生态将快速形成。
我们能学到什么
1. AI Agent的硬件基础正在成熟。 从ChatGPT时代到Agent时代,一个关键瓶颈是推理成本。当本地1-petaflop算力成为标配,Agent可以24小时在线运行而不依赖云API。这意味着Agent的原生使用场景将从"问一问"扩展到"让它一直跑"。
2. 开源模型+自有硬件的组合是趋势。 Cosmos 3完全开源+Nvidia硬件优化,类似Apple的"芯片+系统"垂直整合模式。AI创业者应该关注这种趋势:未来工具链将向"硬件-模型-框架"三层垂直体系收敛,单一层的工具可能被整合。
3. 物理AI是下一个结构性机会。 Cosmos 3开辟了"理解物理世界"的赛道。相比文本/图像AI的红海竞争,物理AI(机器人、仿真、工业自动化)的创业窗口正在打开,且开源降低了这个领域的门槛。
行动建议
- 评估你的Agent是否需要本地推理。 如果你的Agent应用涉及敏感数据或需要低延迟响应(如本地代码审计、自动化办公),RTX Spark的本地推理能力可以让你绕过API成本和隐私问题。
- 关注Cosmos 3的开发者生态系统。 加入Cosmos Coalition,探索基于开源物理AI模型的应用场景,特别是在机器人仿真和工业自动化方向。
- 调整工具选型策略。 未来6个月,关注Nvidia对Agent框架的硬件优化动态。Hermes Agent和OpenClaw是否能利用RTX Spark的本地算力?这将是下一代Agent的核心竞争力之一。
- 提前布局物理AI赛道。 如果你的团队有机器人或工业背景,Cosmos 3的开源策略提供了难得的先发优势——在开源物理AI生态缺乏成熟产品的窗口期,快速构建垂直解决方案。
