DeepSeek披露用国产芯片训练下一代AI模型

近日,DeepSeek举办投资者活动,投资者需前往北京或杭州办公室,上交手机等电子设备,仅提供笔纸记录,梁文锋通过网络电话参会,以防泄密。梁文锋表示,公司重要优先事项是使用更多国产芯片训练模型,在华为芯片或其他国产GPU上训练是最大赌注之一,“必须成功”。他预计华为最早今年第四季度开始交付训练芯片。目前DeepSeek正训练2万亿参数模型,超过V4的1.4万亿,并计划开发8万亿参数模型。

编辑/李雅
本平台发布/转载的内容仅用于信息分享,不代表我司对外的任何意见、建议或保证,我们倡导尊重与保护知识产权,如发现本站文章存在版权问题,烦请将版权疑问、授权证明、版权证明、联系方式等,发邮件至info@tonews.cn,我们将第一时间核实、处理。同时,欢迎各方媒体、机构转载和引用,但要严格注明来源:今日商讯。

您可能感兴趣的文章