英伟达据称开发万亿参数开源模型Nemotron4

IT时代网8月12日消息,据外媒援引项目参与者的消息,芯片厂商英伟达正在研发新一代 AI 模型系列 Nemotron 4,意图与全球最先进的开源模型正面竞争。

英伟达是美国少数主动把模型开源的大型科技企业。今年以来,AI 的开发与运行成本一路走高,而价格更低的中国模型在性能上逐步逼近 Anthropic、OpenAI 等顶尖实验室的系统,开源路线因此重新受到追捧。近期几起涉及自主 AI 智能体的网络攻击,也把聚光灯打到了开源模型身上——这类模型通常不对网络安全用途设限。

英伟达打的算盘很清楚:用开放的模型生态把 AI 应用面摊得更开,顺带拉动自家 GPU 算力的需求。生成式 AI 副总裁 Kari Briski 在一封邮件里写道,投资 Nemotron,是因为相信每家企业、每个国家都该用得上前沿的开源模型。

参与开发的员工透露,规模最大的那一款参数预计至少达到 1 万亿。发布日期还没定,最终训练也没收尾,不过有员工判断,最快今年秋末就能见雏形。

动作不止于此。上个月英伟达刚和多家企业拉起一个联盟,一道开发、共享 AI 安全与网络安全工具,还和微软等巨头联名签署公开信,表态支持开放权重模型,避免创新能力流向海外。

与此同时,英伟达端出了 Nemotron 3.5 Lightning,补足现有模型矩阵,主攻代码审查、工具调用、安全告警监控、账单问答这类任务;另有一个开源的模型路由库 NeMo Switchyard,能按不同任务把活儿自动派给最合适的模型。

注:本文中包含AI辅助创作的内容。

THE END