Nvidia 研發 Nemotron 4 對標頂級開源模型
據報 Nvidia 正開發新一代開源 AI 模型 Nemotron 4,參數量至少達 1 萬億,目標挑戰全球頂尖開源模型。該公司尚未公布推出日期,但有員工透露最快可在今年秋末準備就緒。
據《The Information》周二報道,晶片巨頭 Nvidia(輝達)正開發新一代開源 AI 模型系列 Nemotron 4,目標是與全球頂尖開源模型看齊。報道引述參與項目的員工消息,指出最大的 Nemotron 4 模型將至少有 1 萬億個參數。
Nvidia 是少數推出開源模型的主要美國企業。今年隨着 AI 帳單金額急升,加上中國廉價模型逐漸逼近美國頂尖實驗室 Anthropic 及 OpenAI 的系統能力,開源模型備受關注。近期多宗涉及自主 AI 代理的網絡攻擊被揭發,亦進一步增加外界對開源模型的關注,因為開源模型在網絡安全使用上未有嚴格限制。
報道提到,Nvidia 仍未為 Nemotron 4 設定推出日期,最終訓練尚未完成,但員工透露模型最快可於秋末準備就緒。Nvidia 未有即時回應路透社的查詢。
上月 Nvidia 聯同其他公司成立聯盟,共同開發及分享 AI 安全與網絡安全工具。該公司又與微軟(Microsoft)等科企聯署公開信,支持開放權重模型,以免創新流向海外。
同日下午,Nvidia 發布了 Nemotron 3.5 Lightning,作為現有產品線的新增型號,專為代碼審查、工具使用、安全警報監控、解答賬單問題等任務而設。公司亦推出 NeMo Switchyard,這是一個開源的模型路由庫,能夠自動將 AI 任務分配至最合適的模型。
去年底,Nvidia 發布了第三代開源模型系列,當時正值中國 AI 實驗室的模型數量大幅增加。
資料來源:The Standard。
閱讀原文報道 →