NVIDIA Vera v0.9 用 88-core Olympus、LPDDR5X 和 1,800GB/s NVLink-C2C 强化 tool calling、data processing 与 RL 的 CPU 侧路径,但所有性能倍数仍是 vendor benchmark。
Agentic workload 的瓶颈会由 accelerator 扩散至 serial orchestration、memory latency、data movement 和 CPU-GPU coherence;CPU 价值量提升是系统协同逻辑,不代表 GPU 需求减弱。
Vera 规格包括 88 个 Olympus cores、176 threads、最高 1.5TB LPDDR5X,以及 1,800GB/s NVLink-C2C。
I/O 规格包括 dual-socket 176 条或 Vera Rubin 96 条 PCIe 6.4/CXL 3.1 lanes,用于 CPU、GPU、memory 与 peripheral 协同。
NVIDIA 内部测试声称 bandwidth 提升 3x、peak latency 降低 40%、loaded single-thread IPC 最高提升 1.9x、RL training 提升 1.8x。
Agentic workload 的瓶颈会由 accelerator 扩散至 serial orchestration、memory latency、data movement 和 CPU-GPU coherence;CPU 价值量提升是系统协同逻辑,不代表 GPU 需求减弱。
若第三方测试和 Vera Rubin 量产证明低时延与 per-core bandwidth 优势,CPU-GPU 一体化可扩大 rack 级利润池;若软件和应用无法利用这些特征,规格不会自动转为更高 TCO 回报。
白皮书为 Version 0.9,原文只标注 July 2026;内部 benchmark 缺少独立价格、功耗、量产稳定性和同口径系统比较,不应提前资本化。