分享
黄仁勋在AI界超级碗GTC2024的主旨演讲: 精华及全文(附视频)
输入“/”快速插入内容
黄仁勋在AI界超级碗GTC2024的主旨演讲: 精华及全文(附视频)
用户8537
用户8537
2024年3月19日修改
🔗 原文链接:
https://mp.weixin.qq.com/s/1-hJxdOq...
原创 天空之城城主 Web3天空之城
2024-03-19 13:17
🎉
GTC 2024 黄仁勋演讲摘要20240319.pdf
黄仁勋演讲全文.pdf
文+视频:天空之城·城主授权转载
万众期待的AI界科技界春晚-NVIDIA GTC 2024大会今天正式开幕。这不仅是一场面向开发者的盛会, 更是NVIDIA创始人黄仁勋独领风骚、引领业界方向的重要舞台。
以下和大家分享这一次黄教主大会主旨演讲中的精彩内容, 附上视频完整版及书面文字版,方便大家深入了解。
视频完整版的B站传送门:
【【精校】Nvidia GTC2024 黄仁勋主旨演讲 2024.3.19【中英】-哔哩哔哩】
https://b23.tv/eEDeOq4
此次GTC大会聚集了来自气候科技、无线电科学等不同领域的研究人员,他们正探索如何利用AI、机器人技术控制下一代6G无线电、自动驾驶汽车等。大会还邀请了众多公司代表,他们将运用加速计算解决普通计算机无法应对的难题,应用领域涵盖生命科学、医疗健康、基因组学、零售、物流、制造、工业等。
NVIDIA的发展历程始于1993年。2006年,革命性的CUDA计算模型诞生,成为里程碑。2012年,AI首次接触CUDA,标志着AlexNet的出现。2016年,NVIDIA发明了DGX-1超级计算机,8个GPU实现170 teraflops计算能力。从2017年Transformer到2022年ChatGPT,这些技术点燃全球想象力,彰显AI非凡潜力。2023年,生成式AI崭露头角,开启全新产业征程。
数据中心正成为NVIDIA生成Token、浮点数的重要基地。就像工业革命时期的发电机创造了电力,NVIDIA如今正在AI工厂中用GPU生成极其有价值的新型电子Token。以AI为核心的新产业正在形成。
NVIDIA的灵魂在于计算机图形学、物理、AI的交叉融合,这些在Omniverse模拟的虚拟世界中交汇。今天展示的内容皆为模拟而非动画,它之所以美,源于其背后的物理学规律,就像真实的世界一样。更神奇的是,这些动画由机器人、AI创作。观众将欣赏到前所未有的AI自制音乐会。
加速计算已到达临界点,通用计算逐渐失去动力。加速计算在性价比上远超通用计算,几乎遍布所涉足的每个行业。它的影响不局限于单一行业。各行业正在利用数字孪生技术,实现全流程数字化、高保真模拟。这意味着要大幅提升计算规模。合作伙伴正携手NVIDIA,共同推动整个生态系统进入加速计算时代。
加速计算的另一大优势在于,当整个基础设施与GPU耦合时,便可轻松实现AI生成能力。NVIDIA已与一些重要合作伙伴建立了深度关系。ANSYS、新思科技、Cadence这些顶级公司,正在利用NVIDIA GPU加速系统的巨大安装基础,为最终用户、系统制造商、CSP创造巨大机遇与客户需求。
Blackwell是NVIDIA推出的全新GPU平台,将涵盖与Hopper兼容的普通系统和与Grace CPU连接的专用系统。Blackwell提供了前所未有的算力,有望突破物理极限,为互联网产业注入新动力。
在处理海量数据和复杂计算时,精确性和范围至关重要。配备第五代NV Link的全新Transformer引擎速度惊人。在多GPU环境中,信息同步与更新必不可少。
新型超算的高速运转离不开早期问题检测和替换机制。同时,数据加密对价值数亿美元的AI模型和代码至关重要。高速压缩引擎可将数据高效导入导出,速度提升20倍。Nvidia必须全力保留这些功能,因为这些超算的投资和能力都十分惊人。
全新的FP8格式让内存可容纳更多参数,大幅提升计算速度。生成式AI作为一种全新计算范式正在兴起。NVLink交换芯片实现所有GPU同时全速通信,仿佛成为一个巨无霸GPU。直接驱动铜技术的突破让系统更加经济实惠。
训练一个1.8万亿参数的GPT模型,传统方法可能需要8000个GPU、15MW电力,历时90天。而Blackwell只需2000个GPU,功耗4MW。
NVIDIA GPU有一半时间运行在云端,专注于生成Token,如Copilot、ChatGPT等。庞大的语言模型需要后台超算的支持。要在众多GPU中高效分配任务,CUDA和其丰富生态系统不可或缺。Blackwell惊人的推理能力是Hopper的30倍,有望成为未来生成式AI的核心引擎。这些AI工厂旨在产生智慧而非电力。AWS、GCP、Oracle、微软纷纷为Blackwell做好准备。