您的当前位置:首页>资讯 > 正文

环球观天下!天数智芯:天垓100完成百亿级参数大模型训练

  • 2023-06-13 15:59:54 来源:经济参考网


(资料图片仅供参考)

日前,在第五届智源大会AI系统分论坛上,上海天数智芯半导体有限公司(以下简称“天数智芯”)宣布,在天垓100加速卡的算力集群,基于北京智源人工智能研究院(以下简称“智源研究院”)70亿参数的Aquila语言基础模型,使用代码数据进行继续训练,稳定运行19天,模型收敛效果符合预期,天数智芯有支持百亿级参数大模型训练的能力。

据悉, 在北京市海淀区支持下,智源研究院、天数智芯与爱特云翔共同合作,联手开展基于自主通用GPU的大模型CodeGen(高效编码)项目,通过中文描述来生成可用的C、Java、Python代码以实现高效编码。智源研究院负责算法设计、训练框架开发、大模型的训练与调优,天数智芯负责提供天垓100加速卡、构建算力集群及全程技术支持,爱特云翔负责提供算存网基础硬件及智能化运维服务。

在三方努力下,在基于天垓100加速卡的算力集群上,100B Tokens编程语料、70亿参数量的AquilaCode大模型参数优化工作结果显示,1个Epoch后loss下降到0.8,训练速度达到87K Tokens/s,线性加速比高达95%以上。在HumanEval基准数据集上,以Pass@1作为评估指标,自主算力集群训练出来的模型测试结果达到相近参数级别大模型的SOTA水平,在AI编程能力与国际主流GPU产品训练结果相近。

天垓100完成百亿级参数大模型训练,迈出了自主通用GPU大模型应用的重要一步。 据介绍, 接下来,天数智芯将与合作伙伴继续深入合作,建设更大规模的天垓100算力集群,完成更大参数规模的大模型训练,以自主通用GPU产品更好支持国内大模型创新应用,助力人工智能产业自主生态建设。

(文章来源:经济参考网)

标签:

推荐阅读

环球观天下!天数智芯:天垓100完成百亿级参数大模型训练

日前,在第五届智源大会AI系统分论坛上,上海天数智芯半导体有限公司(

每日焦点!微软750亿美元收购暴雪再遇阻 美国FTC向法院申请禁令阻止交易

微软收购动视暴雪的交易再起波澜。当地时间6月12日,美国联邦贸易委员

世界快看点丨天津警方开展打击农村赌博违法犯罪专项行动 抓获涉案人员2100余名

(周亚强)记者13日从天津市公安局获悉,自2022年11月天津公安机关

中航重机(600765)产业链一体化提速,驱动新一轮高成长|天天报道

事件:中航重机拟受托管理聚能钛日常经营:6月12日晚间,公司发布公告

环球信息:赵允让是谁的后人_赵允让

1、有后代。2、濮安懿王允让是宋太宗的儿子商王元份的儿子。3、英宗赵

猜您喜欢

【版权及免责声明】凡注明"转载来源"的作品,均转载自其它媒体,转载目的在于传递更多的信息,并不代表本网赞同其观点和对其真实性负责。亚洲在线网倡导尊重与保护知识产权,如发现本站文章存在内容、版权或其它问题,烦请联系。 联系方式:8 86 239 5@qq.com,我们将及时沟通与处理。

教育