文章标签:阿里云, 开源模型, 大语言模型, Qwen-14B
【阿里巴巴云新闻】9月25日,阿里云的开源项目“通义千问”宣布其140亿参数的大规模模型Qwen-14B以及相应的对话模型Qwen-14B-Chat,已经可以向公众免费提供,且可以应用于商业场景。值得注意的是,Qwen-14B在多项权威评测中表现出了超越同类型模型的能力,甚至在某些指标上达到了Llama2-70B的水平。在此之前,阿里云已经开放了70亿参数的模型Qwen-7B,并在一个多月的的时间里,获得了超过100万的下载量,赢得了开源社区的高度评价和认可。
Qwen-14B是一款高性能开源模型,能够支持多种语言,相较于同类模型,它使用了更多的高质量数据进行训练,整个训练数据超过了3万亿Token,这使得该模型具备了更强大的推理、认知、规划和记忆能力。此外,Qwen-14B最大支持8k的上下文窗口长度,可以更好地处理长文本输入。
Qwen-14B在十二个权威测评中全方位超越同规模SOTA大模型
Qwen-14B-Chat是一款基于基座模型并通过精细的SFT技术加以优化的对话生成模型。得益于基座模型的卓越性能,Qwen-14B-Chat在内容生成的精确性方面有了显著的提升,同时也更贴近人类的喜好。此外,该模型还能在内容创作方面带来更多的想象空间和丰富的创意,从而极大地拓宽了其应用范围。
Qwen是一款卓越的工具调用专家,它能够让开发者迅速地构建基于Qwen的智能体。通过简单的指令,开发者就可以教授Qwen如何运用各种复杂工具,例如利用Code Interpreter工具来执行Python代码,从而进行繁琐的数学计算、数据分析和图表绘制等任务。此外,Qwen还能够开发出具备多文档问答以及长文撰写等功能的“高级数字助理”。
在当前的AI应用开发与更新领域,拥有百亿参数级别的强大语言模型已成为开发者和研究人员的主要选用工具。其中,Qwen-14B模型在小型模型领域的性能表现尤为突出,其卓越的性能表现使其在诸多同类模型中独树一帜。在MMLU、C-Eval、GSM8K、MATH、GaoKao-Bench等12个权威测试中,Qwen-14B都取得了优于其他所有参测模型的最佳成绩,其表现甚至超过了所有的SOTA(即当前最先进的技术水平)大模型,包括超越了Llama-2-13B模型,以及比Llama 2的34B、70B模型也不相上下。此外,Qwen-7B模型也进行了全新的升级,其核心指标最高提升了22.5%,这无疑为其在未来的应用中提供了更强大的性能基础。
Qwen-14B性能超越同尺寸模型
用户可以轻松地从魔搭社区获取所需的模型,同时,通过阿里云的灵积平台,他们也可以方便地访问和调用Qwen-14B以及Qwen-14B-Chat。作为一家以用户为中心的公司,阿里云致力于提供包括模型训练、推理、部署和精调在内的一站式服务,从而满足用户的各种需求。
在8月份,阿里云开源通义千问70亿参数基座模型Qwen-7B,先后荣登HuggingFace和Github的热门趋势榜单。仅仅一个月多的时间,其累计下载量已经突破了100万大关。开源社区中,基于Qwen的模型数量超过了50个,同时,包括知名工具和框架在内的多个社区成员都开始采用并集成Qwen。
通义千问是中国大型语言模型中最具影响力和广泛应用的,已经在国内外众多领域得到广泛应用,其用户数量已经超过了1亿。在国内,通义千问已经被广泛应用于多个行业,包括电商、社交、智能客服等领域,成为了许多企业和个人开发者的必备工具之一。此外,通义千问也为科研机构提供了强大的支持,帮助他们在自然语言处理、语音识别等方面取得了重要的进展。在国际上,通义千问也受到了广泛的认可和应用,例如阿里巴巴的淘宝、钉钉、未来精灵等产品都基于通义千问进行开发,同时也被许多外部的科研机构和创业企业所采用。通义千问的成功表明了中国人工智能技术的实力和潜力,为其在未来的人工智能领域的发展奠定了坚实的基础。
浙江大学联合高等教育出版社基于Qwen-7B开发了智海-三乐教育垂直大模型,已在全国12所高校应用,可提供智能问答、试题生成、学习导航、教学评估等能力,模型已在阿里云灵积平台对外提供服务,一行代码即可调用;浙江有鹿机器人科技有限公司在路面清洁机器人中集成了Qwen-7B,使机器人能以自然语言与用户进行实时交互,理解用户提出的需求,将用户的高层指令进行分析和拆解,做高层的逻辑分析和任务规划,完成清洁任务。
阿里云CTO周靖人表示,阿里云将持续拥抱开源开放,推动中国大模型生态建设。阿里云笃信开源开放的力量,率先开源自研大模型,希望让大模型技术更快触达中小企业和个人开发者。
阿里云还牵头建设了中国最大的AI模型开源社区魔搭ModelScope,团结全行业的力量,共同推动大模型技术普惠和应用落地。过去两个月内,魔搭社区的模型下载量从4500万飙升到8500万,增幅接近100%。
阿里云, 开源模型, 大语言模型, Qwen-14B