英伟达于6月2日举办ComputeX 2024大会,展示了其在加速计算和生成式AI领域的最新成果。英伟达推出了由RTX支持的AI助手G-Assist项目,旨在为PC游戏和应用提供上下文感知的帮助,并为NVIDIA ACE数字人平台打造了首个基于PC的NVIDIA NIM推理微服务。
通信行业分析指出,AI应用正在加速落地,持续看好算力基础设施的投资机会。一方面,垂直应用的落地依赖于基础模型的积累和升级,需要云侧算力基础设施的支持。另一方面,端侧应用的推理性能优化同样需要云侧工具的辅助。英伟达即将发布的RTX AI Toolkit将帮助开发者构建在PC上运行的AI模型,同时,NVIDIA TensorRT Cloud将对模型进行优化,以实现RTX GPU产品的峰值性能,相较于预训练模型,性能提升可达4倍。随着多模态数据融合和行业AI应用的扩展,算网基础设施的需求有望持续增长,看好光模块、高速连接、液冷散热等环节的投资机遇。
计算机行业认为,SLM优化为端侧开发者提供了巨大的想象空间,AI在办公、教育等领域应用的落地速度有望加快。Microsoft和NVIDIA的合作使得开发者能够轻松接入由RTX加速的SLM,作为Windows Copilot Runtime的一部分在设备上运行RAG功能,从而访问基础模型中未充分表示的特定领域信息,增强小语言模型的能力。
传媒互联网行业指出,英伟达的G-Assist AI Agent助手支持多种模态输入,能够根据玩家的游戏进程提供个性化的回复,优化游戏体验。NVIDIA NIM简化了生成式AI的集成,提升了开发人员的工作效率,有望加速数字护士、客服、导师等数字人的应用。游戏、广告营销等行业均有望受益于AI助手,实现用户体验和公司变现效率的提升。
海外行业动态显示,英伟达公布了下一代计算平台Rubin,配备了新的GPU、基于Arm的新CPU Vera,以及先进的网络平台。Rubin预计将在2026年推出。英伟达正在持续降低将数据转化为智能的成本,GPU和CPU组合的加速计算能力可达100倍,而功耗仅增加3倍,每瓦性能比单独使用CPU提高了25倍。合作伙伴包括永擎电子、华硕、技嘉科技等企业,英伟达的AI计算平台迭代将推动AI产业变革,市场地位和影响力将进一步加强。持续看好铜连接、液冷技术及AI服务器相关产业的发展机会。
相关标的覆盖了通信、计算机、传媒互联网等多个行业,包括运营商、光模块、连接器、散热、PCB、主设备商、IDC、工业互联网、卫星互联网、物/车联网等多个领域的公司。