财联社
财经通讯社
打开APP
英伟达据悉正开发开源AI模型Nemotron 4,参数规模或超1万亿
①英伟达据悉正开发新一代AI模型系列Nemotron 4,最大模型预计参数至少1万亿个,最快今年秋末准备就绪;
                ②英伟达发布AI模型Nemotron 3.5 Lightning及NeMo Switchyard,两款产品可帮助企业降Token成本、保护专有数据。

财联社8月11日讯(编辑 牛占林)在席卷硅谷的“开源”与“闭源”之争中,英伟达已成为支持开源AI最积极的科技巨头之一。

据媒体周二报道,这家芯片巨头正在开发新一代AI模型系列Nemotron 4,目标是打造能够与全球顶尖开源模型相抗衡的产品。

知情人士称,英伟达是少数几家推出开源模型的大型美国科技公司之一。随着今年AI相关法案数量大幅增加,以及中国低成本AI模型的能力逐渐接近Anthropic和OpenAI等美国头部AI实验室的顶尖系统,开源模型受到越来越多关注。

近期一系列涉及自主AI智能体的黑客攻击事件也进一步推高了市场对开源模型的关注,尤其是由于开源模型在网络安全领域的使用通常缺乏相应限制。

据报道,多名参与该项目的英伟达员工透露,Nemotron 4系列中规模最大的模型预计将拥有至少1万亿个参数。

英伟达目前尚未确定Nemotron 4的发布时间,模型最终训练工作也尚未完成。不过,多名员工表示,该模型最快可能于今年秋末准备就绪。

就在上个月,英伟达与其他企业共同成立联盟,旨在开发并共享AI安全与网络安全工具。此外,英伟达还与微软等科技巨头共同签署公开信,支持开放权重模型,以避免AI创新“向海外转移”。

另据报道,英伟达周二还发布了Nemotron 3.5 Lightning,这是其现有AI模型产品线的新增成员,主要面向代码审查、工具调用、安全警报监控以及账单问题解答等任务。

英伟达企业生成式AI软件副总裁Kari Briski表示,Nemotron 3.5 Lightning融合了更强大模型的知识,但模型规模要小得多。

英伟达同时推出了NeMo Switchyard,这是一款开源模型路由库。简单来说,这是一种能够根据不同AI智能体的任务需求,自动选择合适模型的工具。

Briski表示,这两款产品都能够帮助企业降低AI Token成本,同时保护企业的专有数据。“你不需要总是把这些常规任务交给更大的模型,但路由器会持续在模型质量、响应速度和成本之间进行权衡。”

此外,企业还需要保护自己的知识产权。Briski表示,对于很多企业来说,尤其是网络安全、材料科学等专业领域的公司,一个重要担忧是,AI服务商最终可能会成为它们的竞争对手。

她补充说:“企业确实需要考虑一个问题:‘他们究竟把自己的知识产权交给了谁?’因为这些AI服务商最终可能会进入它们所在的市场。”

开源模型的一大优势是可以根据企业自身需求进行定制,企业能够利用自己的数据对模型进行进一步训练。

对于英伟达而言,同样的情况也成立。Briski表示,英伟达最初开发Switchyard,就是为了满足自身控制AI Token成本的需求,同时也希望掌握自己的知识产权。

她声称:“我们现在已经能够证明,这套方案可以在提高效率和准确性的同时降低成本。考虑到目前Token的消耗量如此之大,我认为这是很多人目前都非常关注的问题。”

英伟达此次发布新模型的前一天,Meta刚刚发布了最新开源模型Muse Glimmer。Meta表示,这款模型规模足够小,甚至可以在配备单块消费级GPU的Mac或PC上运行。

环球市场情报 美股动态
财联社声明:文章内容仅供参考,不构成投资建议。投资者据此操作,风险自担。
商务合作
热门解锁
相关阅读
评论
发送
复制
取消
垃圾广告
政治激进内容
色情低俗内容
取消