新华通讯社主管

首页 >> 正文

天数智芯:天垓100完成百亿级参数大模型训练
2023-06-13 钟宣 来源: 经济参考网

  日前,在第五届智源大会AI系统分论坛上,上海天数智芯半导体有限公司(以下简称“天数智芯”)宣布,在天垓100加速卡的算力集群,基于北京智源人工智能研究院(以下简称“智源研究院”)70亿参数的Aquila语言基础模型,使用代码数据进行继续训练,稳定运行19天,模型收敛效果符合预期,天数智芯有支持百亿级参数大模型训练的能力。

  据悉, 在北京市海淀区支持下,智源研究院、天数智芯与爱特云翔共同合作,联手开展基于自主通用GPU的大模型CodeGen(高效编码)项目,通过中文描述来生成可用的C、Java、Python代码以实现高效编码。智源研究院负责算法设计、训练框架开发、大模型的训练与调优,天数智芯负责提供天垓100加速卡、构建算力集群及全程技术支持,爱特云翔负责提供算存网基础硬件及智能化运维服务。

  在三方努力下,在基于天垓100加速卡的算力集群上,100B Tokens编程语料、70亿参数量的AquilaCode大模型参数优化工作结果显示,1个Epoch后loss下降到0.8,训练速度达到87K Tokens/s,线性加速比高达95%以上。在HumanEval基准数据集上,以Pass@1作为评估指标,自主算力集群训练出来的模型测试结果达到相近参数级别大模型的SOTA水平,在AI编程能力与国际主流GPU产品训练结果相近。

  天垓100完成百亿级参数大模型训练,迈出了自主通用GPU大模型应用的重要一步。 据介绍, 接下来,天数智芯将与合作伙伴继续深入合作,建设更大规模的天垓100算力集群,完成更大参数规模的大模型训练,以自主通用GPU产品更好支持国内大模型创新应用,助力人工智能产业自主生态建设。

 

凡标注来源为“经济参考报”或“经济参考网”的所有文字、图片、音视频稿件,及电子杂志等数字媒体产品,版权均属经济参考报社,未经经济参考报社书面授权,不得以任何形式刊载、播放。获取授权

部分社会民生领域供需失衡难题待解

部分社会民生领域供需失衡难题待解

今年以来,随着经济社会恢复常态化运行,经济呈现良好势头,但部分社会民生领域“短板”仍存。

·宠物经济方兴未艾 年增相关企业近百万家

吞吐有“智” 运煤不见“煤”——津冀重要港口绿色转型见闻

吞吐有“智” 运煤不见“煤”——津冀重要港口绿色转型见闻

作为京津冀地区的出海口和航运枢纽,天津市与河北省的重要港口运用数字化手段减排降耗,在提升效能的同时保护海洋生态环境。

·京畿大省“向海图强”打造“蓝色”新引擎

经济参考报社版权所有 本站所有新闻内容未经经济参考报协议授权,禁止转载使用

新闻线索提供热线:010-63074375 63072334 报社地址:北京市宣武门西大街57号

JJCKB.CN 京ICP备18039543号