AI重点要闻
英伟达开源模型Llama-Nemotron超越DeepSeek-R1
- 英伟达于2025年4月发布开源模型Llama-Nemotron系列,包括LN-Nano8B、LN-Super49B和LN-Ultra253B,其中LN-Ultra253B在推理能力方面全面超越DeepSeek-R1。
- Llama-Nemotron的构建分为五个阶段:神经架构搜索(NAS)、垂直压缩与FFN融合、知识蒸馏与继续预训练、监督微调(SFT)和大规模强化学习。
- 模型利用神经架构搜索Puzzle框架优化推理效率,通过“逐块局部蒸馏”和FFN融合技术减少内存占用并提升计算利用率。
- 监督微调环节使用混合指令数据和强教师模型进行训练,强化学习环节通过大规模训练提升科学推理能力。
小米Mi-BRAG智能引擎亮相
- 小米发布Mi-BRAG知识库问答系统,解决传统大模型知识更新成本高、缺乏对企业专有知识库洞察力及数据泄露风险等问题。
- Mi-BRAG应用全格式兼容、全模态解析、多语种问答和细粒度溯源四项关键技术,支持多种文档格式解析和多元信息处理。
- 第三方评测机构SuperCLUE评估显示,Mi-BRAG在RAG生成能力评测中排名第一,得益于其创新的数据构建方法和模型训练范式。
星动纪元联合清华发布首个AIGC机器人大模型VPP
- 星动纪元开源首个AIGC机器人大模型VPP,利用互联网视频数据进行训练,直接学习人类动作,减轻对高质量机器人真机数据的依赖。
- VPP采用两阶段学习框架,第一阶段利用视频扩散模型学习预测性视觉表征,第二阶段通过VideoFormer和DiT扩散策略进行动作学习。
- VPP在CalvinABC-D基准测试中表现优异,仿真环境任务完成平均长度达到4.33,真机测试成功率67%,显著优于其他方法。
华为联合清华打造首个园区网络智能体
- 清华大学携手华为打造首个园区网络智能体,推动高校网络迈向“自动驾驶”新时代。
- 华为iMasterNCE-CampusInsight系统对网络状态和用户体验进行数字孪生与建模,通过DeepSeek大模型实现自然语言交互。
- 网络智能体NetMaster驱动校园网络运维迈向“自动驾驶”新时代,核心是与DeepSeek深度协同,构建网络运维Copilot和Wi-Fi优化Agent。
企业动态
Mistral发布Medium3大模型
- Mistral宣布推出Mistral3系列模型的中等量级版本Medium3,具有前沿级别的性能和更低的成本,并具备多种企业功能。
- Medium3在各项基准测试中表现达到或超过Anthropic旗下ClaudeSonnet3.7的90%,成本仅为每百万Token输入0.4美元、每百万Token输出2美元。
- Medium3在编程、STEM、多模态理解等专业应用场景中领先,并可持续预训练、完全微调,易于集成到企业知识库中。
阿里开源创新大模型搜索引擎ZeroSearch
- 阿里开源ZeroSearch大模型搜索引擎,无需与真实搜索引擎交互即可激励大模型搜索能力。
- ZeroSearch利用大模型在大规模预训练过程中积累的丰富知识,将其转化为检索模块,动态控制生成内容的质量。
- 在NQ、TriviaQA等7大问答数据集上评测,ZeroSearch显著提升了模型的搜索能力,超过谷歌搜索。
AI行业洞察
腾讯技术团队协助DeepEP通信框架,性能显著提升
- 腾讯技术团队针对DeepSeek开源的DeepEP通信框架进行深度优化,使其在多种网络环境下实现显著性能提升。
- 优化后的DeepEP在RoCE网络环境性能提升100%,IB网络环境提升30%,为企业开展AI大模型训练提供更高效解决方案。
Anysphere完成9亿美元融资,估值达90亿美元
- AI编程工具开发商Anysphere完成9亿美元融资,公司估值达90亿美元,由ThriveCapital领投,a16z和Accel等机构参与。
- Anysphere累计融资金额已超过1.73亿美元,AI编程工具赛道竞争加剧,OpenAI曾传出有意收购竞争对手Windsurf的消息。
技术前沿
RepliBench:检测大模型“自我复制”能力
- 英国研究机构AISI介绍RepliBench基准,用于检验AI“自我复制”的能力,关注AI自主复制可能导致的风险。
- RepliBench将自主复制能力拆解为获取计算资源、窃取模型权重、复制到新设备和持久化驻留四大核心模块。
- 评估结果显示,前沿AI模型尚不具备在现实世界中完全自主复制的能力,但在与具有清晰接口的系统交互方面表现显著。
风险提示
- 以上内容基于历史数据完成,在政策、市场环境发生变化时存在失效的风险;历史信息不代表未来。