scripod.com

#567. 黄仁勋:Agent 时代普通人和企业的新生产力,AI 基础设施竞赛下的计算革命

Shownote

📝 本期播客简介 本期我们克隆了:Yahoo Finance《Nvidia GTC Taipei 2026: Jensen Huang Full Keynote》 [https://www.youtube.com/watch?v = q_umfWm8J28] 原内容更新时间:2026-06-01 本期节目是 NVIDIA 创始人兼 CEO 黄仁勋在 GTC Taipei 2026 的完整主题演讲。黄仁勋回到台湾,面向全球供应链伙伴、开发者、企业客户和 AI 产业生态,系统阐述了 NVIDIA 对下一阶段 AI 时代的判断:Agentic AI 已经到来,AI 不再只是生成内容,而是开始理解、推理、规划、调用工具并完成工作。 在这场 keynote 中,黄仁勋提出了几个极具冲击力的判断:“AI 现在是利润生成器。AI 现在是 GDP 生成器。”“Compute 现在就是收入,Compute 就是利润。”“过去我们为人类创造 CPU,而人类只有十亿人。未来会有数十亿个 Agent。” 围绕这些判断,他进一步解释为什么 AI Factory 会成为人类历史上最大规模的基础设施建设之一,为什么 Vera Rubin 不是一颗芯片而是一整套面向 Agent 的超级计算系统,为什么 Vera CPU 要为 “没有耐心的 Agent” 重新设计,以及为什么 PC、汽车、机器人、工厂和基站都会变成 Agentic 系统。 这不仅是一场产品发布会,更是一套关于未来十年计算范式的完整宣言:软件会从应用程序变成 Agent,数据中心会从成本中心变成 token 工厂,企业会拥有自己的 Agent 工具链,个人电脑也可能从 “打开应用的机器” 变成个人 AI 助手的家。 👨‍💼 本期主讲人 黄仁勋,NVIDIA 创始人兼 CEO。他带领 NVIDIA 从 GPU 公司发展为加速计算、AI 芯片、AI 系统、网络、软件平台与 AI 基础设施公司。在本场 GTC Taipei 2026 演讲中,他重点发布并解释了面向 Agentic AI 时代的 Vera Rubin、Vera CPU、NVIDIA DSX、Nemotron 3 Ultra、RTX Spark、Cosmos 3 与 Isaac GR00T 等关键产品与平台。 ⏱️ 时间戳 00:00 开场 & 播客简介 Agentic AI 已经到来 01:32 回到台湾:感谢台湾供应链生态与 GTC Taipei 现场 03:50 有用的 AI 到来了:从 GitHub commit 暴增看软件生产力跃迁 07:10 AI 从成本变利润:token 需求、GDP 生成器与 compute 经济学 09:40 什么是 Agent:模型、harness、memory、工具与 runtime 13:10 从 prompt 到代码、GIF 和 CAD:Agentic AI 的实际工作方式 16:30 软件公司不会被 Agent 消灭,反而会迎来更大工具需求 新计算模型与 AI Factory 18:20 CUDAX 库成为 Agent 的工具箱:CUDA 生态的新价值 21:10 Agent 是终极分布式计算模型:大脑、身体与工作坊 24:20 为什么 Vera Rubin 是下一代系统:为解耦、异构、分布式 Agent 而生 27:40 NVIDIA 从 GPU 公司变成 AI 基础设施公司 29:40 DSX AI Factory:用数字孪生设计和运营 AI 工厂 33:30 一吉瓦 AI 工厂的经济学:compute 就是收入,token 就是利润 36:50 AI Cloud 生态扩张:CoreWeave、Nebius、Nscale、GMI 等区域云机会 Vera Rubin:为 Agent 时代打造的超级计算系统 40:10 Vera Rubin 全面量产:供应链规模达到 Grace Blackwell 的两倍 43:20 从 DGX-1 到 Vera Rubin:AI 超级计算机的十年演进 46:00 Vera Rubin NVL72:面向 prompt、context、推理和规划 48:40 Vera CPU Rack 与 Vera BlueField:Agent 的编排、记忆与安全 51:00 现场展示 Vera Rubin:无缆线、无软管、无风扇的新一代机架设计 54:20 从 Hopper 到 Blackwell 再到 Vera Rubin:从预训练、推理到 Agentic inference Vera CPU:为数十亿 Agent 设计的 CPU 57:20 为什么旧 CPU 不适合 Agent:人类按秒等待,Agent 按纳秒等待 59:30 CPU 是指挥,GPU 是乐团:CPU 延迟直接影响 token 吞吐 01:02:00 Vera 的四个关键指标:单线程性能、每核带宽、总带宽与能效 01:05:10 Vera 架构细节:Olympus core、LPDDR5X、PCIe Gen 6 与高速 fabric 01:08:20 真实工作负载提升:SQL 加速三倍,实时流处理加速六倍 01:10:30 一个新市场的开始:为 Agent 而不是为人类制造 CPU 企业 Agent 工具链与超级 Agent 01:12:40 未来十年的应用模式:每家公司都会运行 Agent 01:14:20 NVIDIA Agent Toolkit:模型、harness、工具、技能与 runtime 01:16:00 Open Shell:让企业安全运行 Agent 的开源 runtime 01:18:00 Cadence 芯片设计 Agent:从数周验证周期压缩到数小时 01:21:10 企业软件的新机会:Agent 不会消灭软件公司,而会放大软件价值 Nemotron 3 Ultra 与开放模型 01:23:00 Nemotron 3 Ultra 发布:开放模型、开放数据与开放训练方法 01:25:00 混合架构模型:SSM 与 MoE 结合,速度提升五倍 01:26:40 成本降低百分之三十:让企业能打造自己的专有 Agent 01:28:00 与 Cadence、CrowdStrike、Palantir、SAP、ServiceNow 等合作 重新发明 PC:从个人电脑到个人 AI 01:29:10 Microsoft 与 NVIDIA 重新发明 PC:Agent 会运行在个人电脑上 01:31:00 RTX Spark:面向 Agent 的新一代 Windows AI PC 01:33:00 N1X 芯片:Blackwell RTX GPU、Grace CPU 与统一内存 01:35:00 本地 Agent 示例:用 RTX Spark 协助完成建筑设计工作流 01:38:00 Adobe、创作者工具与 Agent 友好型软件生态 01:40:00 三类新 Windows 机器:笔记本、台式机与 DGX Station 01:43:00 PC 的未来:从打开应用的工具,变成家庭里的个人 AI 超级计算机 Physical AI、机器人与世界模型 01:46:00 Agentic AI 本质上是数字机器人:所有设备都会运行 Agent 01:48:00 Physical AI 的核心难题:机器人需要第一人称世界数据 01:50:00 Cosmos 3 发布:面向 physical AI 的开放 frontier omni model 01:52:30 Compute 就是数据:用 Cosmos 生成、仿真和训练物理世界 AI 01:54:20 AlpamayoR1:面向自动驾驶汽车的开放推理模型 01:56:00 Isaac GR00T:面向人形机器人的开放开发平台与参考机器人 总结与收束 01:58:30 过去六个月计算机行业已被彻底改变 02:00:00 Agentic 计算模式会复制到云、本地、PC、机器人、汽车和边缘设备 02:02:00 NVIDIA 从 GPU、系统公司走向 AI 基础设施公司 02:04:00 感谢台湾生态与全球合作伙伴,祝 COMPUTEX 顺利 🌟 精彩内容 💡 Agentic AI 已经到来 黄仁勋在开场不久就明确表示,AI 的下一波浪潮已经从生成式 AI 走向 Agentic AI。AI 不再只是回答问题,而是能够观察、理解、推理、规划、调用工具并执行任务。他用软件开发、代码生成、CAD 文件生成等例子说明,AI 已经开始真正 “完成工作”。 “下一波 AI 是 agentic AI。今天我们可以说,agentic AI 已经到来了,有用的 AI 已经到来了。” 💰 Compute 就是收入,token 就是利润 这场演讲最核心的商业判断之一,是 AI 已经从成本中心变成利润中心。黄仁勋认为,当 token 能够带来收入和利润时,AI Factory 就不再只是数据中心,而是生产 token 的工厂。每瓦能生成多少 token,直接决定企业的收入能力。 “AI 现在是利润生成器。AI 现在是 GDP 生成器。” “Compute 现在就是收入,Compute 就是利润。” 🏭 AI Factory 是下一代基础设施 黄仁勋把未来的数据中心定义为 AI Factory,并强调这是人类历史上最大规模的基础设施建设之一。它不只是买 GPU,而是从芯片、机架、网络、供电、冷却、电网到运维软件的全栈协同设计。NVIDIA DSX 正是为了帮助客户设计、模拟、部署和运营这些巨型 AI 工厂。 “全世界都在竞相建设 AI factory。这是人类历史上最大规模的基础设施建设。” 🧠 Vera Rubin 不是一颗芯片,而是一套 Agentic 系统 Vera Rubin 是本场演讲最重要的硬件发布之一。黄仁勋反复强调,它不是单一 GPU,也不是单一芯片,而是为了运行 Agentic AI 而打造的多机架、podscale 超级计算系统。它包含 GPU、CPU、网络、存储、安全、内存系统和整套软件栈,用于支撑 Agent 的思考、记忆、工具调用和执行。 “Vera Rubin 不只是为了运行 AI。Vera Rubin 是为了运行 Agent 打造的。” ⚙️ Vera CPU:为没有耐心的 Agent 而生 黄仁勋提出一个非常形象的观点:过去的 CPU 是为人类设计的,因为人类可以按秒等待;但 Agent 是按纳秒等待的,它们每一次工具调用、数据库访问和代码执行都要求极低延迟。因此,Vera CPU 的目标不是传统意义上的出租更多 core,而是以极高单线程性能、极高带宽和高能效来服务 Agent。 “过去我们为人类创造 CPU,而人类只有十亿人。未来会有数十亿个 Agent。” “CPU 是指挥,GPU 是乐团。” 🛠️ 每家公司都会构建自己的 Agent 在企业 AI 部分,黄仁勋把 Agent 拆成四个关键组成:模型、harness、工具与 runtime。NVIDIA 的 Agent Toolkit、Open Shell、Nemotron 模型和 CUDAX 工具库,都是为了让企业能够安全地构建、调优和运行自己的 Agent。Cadence 芯片设计 Agent 的案例展示了这个模式的威力:过去数周的验证流程,现在可以压缩到数小时。 “每家公司都会成为 Agent 公司。” 🧬 Nemotron 3 Ultra:开放模型也是企业基础设施 NVIDIA 发布 Nemotron 3 Ultra,并强调它不仅开放模型,还开放训练数据和训练方法。黄仁勋认为,企业需要从强大的开放模型开始,再加入自己的专有数据和工作流,打造属于自己的专有超级 Agent。它的核心卖点是速度提升五倍、成本降低百分之三十,并面向长程推理和工具使用优化。 “目标很简单,就是让你能拿走全部内容,在上面继续添加,让它变得更好,让它成为你自己的东西。” 💻 PC 将被重新发明 黄仁勋将 Microsoft 与 NVIDIA 的新 PC 产品线描述为四十年来 PC 的一次重大重新发明。未来 PC 不再只是打开应用、点击和打字的机器,而会成为本地运行 Agent 的个人 AI 平台。RTX Spark、台式机和 DGX Station 分别对应移动、本地常驻和高性能工作站场景。 “十年后的 PC,和你今天理解的 PC,会完全不一样。” 🤖 Physical AI 与机器人时代 演讲最后,黄仁勋把 Agentic AI 扩展到物理世界。他指出,自动驾驶汽车、人形机器人、工厂设备、农业机械、基站甚至卫星,都会成为 Agentic 系统。NVIDIA Cosmos 3 是面向 physical AI 的开放世界模型,Isaac GR00T 则是面向人形机器人的开放平台和参考机器人。 “Agentic AI 本质上就是数字机器人。” “机器人时代,从这里开始。” 🌐 播客信息补充 本播客采用原有人声声线进行播客音频制作,也可能会有一些地方听起来怪怪的 使用 AI 进行翻译,因此可能会有一些地方不通顺; 如果有后续想要听中文版的其他外文播客,也欢迎联系微信:iEvenight 在小宇宙查看该单集文稿 [https://oia.xiaoyuzhoufm.com/player/6a1e8760122ade5348e85027?openTranscript = true & utm_source = rss & as = cHQ9MTIyNjE5MjQ3JmN0PXJzcyZtdD04 & autoOpen = false]

Highlights

本期播客基于黄仁勋在 GTC Taipei 2026 的完整主题演讲,系统阐述了 NVIDIA 对 Agentic AI 时代的判断与战略布局。黄仁勋提出 AI 已从成本中心转变为利润和 GDP 生成器,计算能力直接等同于收入和利润,并宣布未来将为数十亿个 AI Agent 设计 CPU,而非仅为人类服务。
00:00
AI 已成为利润和 GDP 生成器
03:00
Agentic AI 时代已经到来
06:29
Token 已成为盈利单位
07:13
Agentic AI 由大语言模型和编排框架组成
09:43
Agent 数量将远超人类
13:13
模型是大脑,harness 是身体,工具和 runtime 是工作坊
16:37
四万名工程师参与,史上最具雄心的工程
18:26
AI 工厂是最大规模基础设施,需全栈协同设计
21:17
基础设施投资已从数百亿增至千亿美元级别
26:59
自建系统实现更快推理与更高能效
27:47
每瓦性能决定收入,token 即利润
29:41
AI 已从成本中心转变为利润中心
33:35
Vera Rubin 系统面向 AI Agent 设计
36:53
NVIDIA 推理成本全球最低
40:12
专为没有耐心的 Agent 打造,追求极低延迟
43:26
Vera CPU 专为 Agent 设计,追求世界级单线程性能
46:00
Vera CPU 相比 X86 性能提升显著
48:46
Vera CPU 性能是 X86 的 1.8 倍
53:36
Agent 数量将远超人类且缺乏耐心
54:20
未来十年每家公司都将成为 Agent 公司
57:21
Agent 的四个关键组成部分:工具、模型、harness 和 runtime
59:32
验证周期从数周缩短至数小时
1:02:03
速度提升五倍,成本降低 30%
1:05:11
Windows 和开放架构是 PC 普及的关键
1:08:25
个人计算革命的新黎明
1:10:33
本地模型与云端协作,Agent 调用本地工具完成工作流
1:12:42
Agent 可辅助完成从建模到渲染的全流程
1:14:28
重新发明 PC 产品线,推出 RTX Spark 等三类 Windows 机器
1:16:02
PC 将像手机一样,从工具演变为个人 AI 平台
1:18:06
AI 超级计算机将像智能手机一样普及
1:21:10
Physical AI 数据必须来自机器人第一人称视角
1:23:08
Cosmos 3 能理解、推理、生成和仿真
1:25:05
全球 80% 汽车制造商已加入 NVIDIA Hyperion 平台
1:26:48
全球首辆具备推理能力的自动驾驶汽车
1:28:05
黄仁勋宣布为机器人系统提供参考平台,并发布了参考人形机器人 Isaac GR00T。
1:29:10
打通从仿真到部署的完整流程
1:31:11
Agentic AI 已彻底改变计算机行业
1:34:00
Agentic AI 是下一波浪潮

Chapters

开场 & 播客简介
00:00
Agentic AI 已经到来
回到台湾:感谢台湾供应链生态与 GTC Taipei 现场
01:32
有用的 AI 到来了:从 GitHub commit 暴增看软件生产力跃迁
03:50
AI 从成本变利润:token 需求、GDP 生成器与 compute 经济学
07:10
什么是 Agent:模型、harness、memory、工具与 runtime
09:40
从 prompt 到代码、GIF 和 CAD:Agentic AI 的实际工作方式
13:10
软件公司不会被 Agent 消灭,反而会迎来更大工具需求
16:30
新计算模型与 AI Factory
CUDAX 库成为 Agent 的工具箱:CUDA 生态的新价值
18:20
Agent 是终极分布式计算模型:大脑、身体与工作坊
21:10
为什么 Vera Rubin 是下一代系统:为解耦、异构、分布式 Agent 而生
24:20
NVIDIA 从 GPU 公司变成 AI 基础设施公司
27:40
DSX AI Factory:用数字孪生设计和运营 AI 工厂
29:40
一吉瓦 AI 工厂的经济学:compute 就是收入,token 就是利润
33:30
AI Cloud 生态扩张:CoreWeave、Nebius、Nscale、GMI 等区域云机会
36:50
Vera Rubin:为 Agent 时代打造的超级计算系统
Vera Rubin 全面量产:供应链规模达到 Grace Blackwell 的两倍
40:10
从 DGX-1 到 Vera Rubin:AI 超级计算机的十年演进
43:20
Vera Rubin NVL72:面向 prompt、context、推理和规划
46:00
Vera CPU Rack 与 Vera BlueField:Agent 的编排、记忆与安全
48:40
现场展示 Vera Rubin:无缆线、无软管、无风扇的新一代机架设计
51:00
从 Hopper 到 Blackwell 再到 Vera Rubin:从预训练、推理到 Agentic inference
54:20
Vera CPU:为数十亿 Agent 设计的 CPU
为什么旧 CPU 不适合 Agent:人类按秒等待,Agent 按纳秒等待
57:20
CPU 是指挥,GPU 是乐团:CPU 延迟直接影响 token 吞吐
59:30
Vera 的四个关键指标:单线程性能、每核带宽、总带宽与能效
1:02:00
Vera 架构细节:Olympus core、LPDDR5X、PCIe Gen 6 与高速 fabric
1:05:10
真实工作负载提升:SQL 加速三倍,实时流处理加速六倍
1:08:20
一个新市场的开始:为 Agent 而不是为人类制造 CPU
1:10:30
企业 Agent 工具链与超级 Agent
未来十年的应用模式:每家公司都会运行 Agent
1:12:40
NVIDIA Agent Toolkit:模型、harness、工具、技能与 runtime
1:14:20
Open Shell:让企业安全运行 Agent 的开源 runtime
1:16:00
Cadence 芯片设计 Agent:从数周验证周期压缩到数小时
1:18:00
企业软件的新机会:Agent 不会消灭软件公司,而会放大软件价值
1:21:10
Nemotron 3 Ultra 与开放模型
Nemotron 3 Ultra 发布:开放模型、开放数据与开放训练方法
1:23:00
混合架构模型:SSM 与 MoE 结合,速度提升五倍
1:25:00
成本降低百分之三十:让企业能打造自己的专有 Agent
1:26:40
与 Cadence、CrowdStrike、Palantir、SAP、ServiceNow 等合作
1:28:00
重新发明 PC:从个人电脑到个人 AI
Microsoft 与 NVIDIA 重新发明 PC:Agent 会运行在个人电脑上
1:29:10
RTX Spark:面向 Agent 的新一代 Windows AI PC
1:31:00
N1X 芯片:Blackwell RTX GPU、Grace CPU 与统一内存
1:33:00

Transcript

依凯: 欢迎收听跨国串门计划,这是一档专注于让中文听众无障碍,欣赏全球优质外语播客的节目。通过先进的 AI 声文克隆技术,我们不仅将内容翻译成中文,还完美保留了原主持人和嘉宾的独特声音。为您呈现全球顶尖的 AI 财经健康与科技领域精品内容。我是主播依凯,一位热衷于 AI 领域的产品经理。很荣幸能为您搭建这座,跨越语言障碍的桥梁。接下来让我为您简单介绍,本期我们克隆的这档节目,并分享几句非常精彩的原话。本期我们克隆的是 Yahoo Finance。在 2026 年 6 月 1 日更新的 NVIDIA GTC ...
小宇宙
Open in 小宇宙