①最新报道称,Anthropic目标最早于9月或10月初登陆资本市场;
②与年初完成近万亿美元估值融资的意气风发不同,近来市场焦点已经转向低成本AI竞争、监管压力以及AI投资回报疑虑。
财联社8月11日讯(编辑 牛占林)在席卷硅谷的“开源”与“闭源”之争中,英伟达已成为支持开源AI最积极的科技巨头之一。
据媒体周二报道,这家芯片巨头正在开发新一代AI模型系列Nemotron 4,目标是打造能够与全球顶尖开源模型相抗衡的产品。
知情人士称,英伟达是少数几家推出开源模型的大型美国科技公司之一。随着今年AI相关法案数量大幅增加,以及中国低成本AI模型的能力逐渐接近Anthropic和OpenAI等美国头部AI实验室的顶尖系统,开源模型受到越来越多关注。
近期一系列涉及自主AI智能体的黑客攻击事件也进一步推高了市场对开源模型的关注,尤其是由于开源模型在网络安全领域的使用通常缺乏相应限制。
据报道,多名参与该项目的英伟达员工透露,Nemotron 4系列中规模最大的模型预计将拥有至少1万亿个参数。
英伟达目前尚未确定Nemotron 4的发布时间,模型最终训练工作也尚未完成。不过,多名员工表示,该模型最快可能于今年秋末准备就绪。
就在上个月,英伟达与其他企业共同成立联盟,旨在开发并共享AI安全与网络安全工具。此外,英伟达还与微软等科技巨头共同签署公开信,支持开放权重模型,以避免AI创新“向海外转移”。
另据报道,英伟达周二还发布了Nemotron 3.5 Lightning,这是其现有AI模型产品线的新增成员,主要面向代码审查、工具调用、安全警报监控以及账单问题解答等任务。
英伟达企业生成式AI软件副总裁Kari Briski表示,Nemotron 3.5 Lightning融合了更强大模型的知识,但模型规模要小得多。
英伟达同时推出了NeMo Switchyard,这是一款开源模型路由库。简单来说,这是一种能够根据不同AI智能体的任务需求,自动选择合适模型的工具。
Briski表示,这两款产品都能够帮助企业降低AI Token成本,同时保护企业的专有数据。“你不需要总是把这些常规任务交给更大的模型,但路由器会持续在模型质量、响应速度和成本之间进行权衡。”
此外,企业还需要保护自己的知识产权。Briski表示,对于很多企业来说,尤其是网络安全、材料科学等专业领域的公司,一个重要担忧是,AI服务商最终可能会成为它们的竞争对手。
她补充说:“企业确实需要考虑一个问题:‘他们究竟把自己的知识产权交给了谁?’因为这些AI服务商最终可能会进入它们所在的市场。”
开源模型的一大优势是可以根据企业自身需求进行定制,企业能够利用自己的数据对模型进行进一步训练。
对于英伟达而言,同样的情况也成立。Briski表示,英伟达最初开发Switchyard,就是为了满足自身控制AI Token成本的需求,同时也希望掌握自己的知识产权。
她声称:“我们现在已经能够证明,这套方案可以在提高效率和准确性的同时降低成本。考虑到目前Token的消耗量如此之大,我认为这是很多人目前都非常关注的问题。”
英伟达此次发布新模型的前一天,Meta刚刚发布了最新开源模型Muse Glimmer。Meta表示,这款模型规模足够小,甚至可以在配备单块消费级GPU的Mac或PC上运行。