新华通讯社主管

首页 >> 正文

阿里云发布通义千问2.0 模型参数达千亿级
2023-11-01 记者 郭倩 来源: 经济参考网

    10月31日,阿里云正式发布千亿级参数大模型通义千问2.0。当天,通义千问APP在各大手机应用市场正式上线,所有人都可通过APP直接体验最新模型能力。

    据介绍,过去6个月,通义千问2.0在性能上取得巨大飞跃,相比4月发布的1.0版本,通义千问2.0在复杂指令理解、文学创作、通用数学、知识记忆等能力上均有显著提升。

    中英文理解能力是大语言模型的基本功。英语任务方面,通过大幅增加参数量,通义千问2.0能更好地理解和处理复杂的语言结构和概念;中文任务方面,通义千问2.0由于模型在训练中学习了更多中文语料,进一步强化了中文理解和表达能力。

    在数学推理、代码理解等领域,通义千问2.0进步明显。在推理基准测试GSM8K中,通义千问展示了强大的计算和逻辑推理能力;在HumanEval测试中,通义千问得分紧跟GPT-4和GPT-3.5,该测试主要衡量大模型理解和执行代码片段的能力,这一能力是大模型应用于编程辅助、自动代码修复等场景的基础。

    据介绍,通义千问2.0在指令遵循、工具使用、精细化创作等方面作了技术优化,能够更好地被下游应用场景集成。通义大模型官网上线了多模态和插件功能,支持图片输入、文档解析等细分任务。

    与此同时,基于通义大模型训练的8大行业模型组团上线,他们分别是通义灵码-智能编码助手、通义智文-AI阅读助手、通义听悟-工作学习AI助手、通义星尘-个性化角色创作平台、通义点金-智能投研助手、通义晓蜜-智能客服、通义仁心-个人专属健康助手、通义法睿-AI法律顾问。8大行业模型面向当下最受欢迎的多个垂直场景,使用领域数据进行专门训练。用户可以在官网直接体验模型功能,开发者可以通过网页嵌入、API/SDK调用等方式,将模型能力集成到自己的大模型应用和服务中。

    据了解,截至10月底,阿里云已与60多个行业头部伙伴进行深度合作,推动通义千问在办公、文旅、电力、政务、医保、交通、制造、金融、软件开发等领域的落地。

    阿里云CTO周靖人透露,阿里云计划近期开源通义千问72B版本,此前,阿里云已先后开源7B和14B版本模型,模型累计下载量超过100万。阿里云将持续支持千行百业的开发者基于通义千问开源模型进行模型和应用创新。

 

凡标注来源为“经济参考报”或“经济参考网”的所有文字、图片、音视频稿件,及电子杂志等数字媒体产品,版权均属经济参考报社,未经经济参考报社书面授权,不得以任何形式刊载、播放。获取授权

一人网贷 个人信息几十家企业共享——部分网络贷款平台涉嫌侵犯个人隐私现象调查

一人网贷 个人信息几十家企业共享——部分网络贷款平台涉嫌侵犯个人隐私现象调查

部分网贷平台在APP下载、隐私协议签订等环节,大量获取借贷者手机通讯录等隐私信息并“共享”给第三方。

·架起“绿水青山”和“金山银山”之间的桥梁

让传统文化“可知可感”——“天下第一名社”的产业发展路

让传统文化“可知可感”——“天下第一名社”的产业发展路

被称为“天下第一名社”的西泠印社通过一个小小的亚运观众礼包,呈现出一条体现自身特色的文化产业之路。

·黄河之畔涌动新动能——济南新旧动能转换起步区走笔

经济参考报社版权所有 本站所有新闻内容未经经济参考报协议授权,禁止转载使用

新闻线索提供热线:010-63074375 63072334 报社地址:北京市宣武门西大街57号

JJCKB.CN 京ICP备18039543号

010140010080000000000000011100001310748372