当前位置:首页 > 财经新闻 > 正文

阿里云免费开放“通义千问”升级版

  讯(记者 周雪松)925日,阿里云开源通义千问140亿参数模型Qwen-14B及其对话模型Qwen-14B-Chat,免费可商用。Qwen-14B在多个权威评测中性能超越Llama2,刷新同尺寸模型性能天花板。阿里云此前开源了70亿参数模型Qwen-7B等,一个多月下载量破100万,成为开源社区的口碑之作。

  Qwen-14B是一款支持多种语言的高性能开源模型,相比同类模型使用了更多的高质量数据,整体训练数据超过3万亿Token,使得模型具备更强大的推理、认知、规划和记忆能力。Qwen-14B最大支持8k的上下文窗口长度。

  Qwen-14B-Chat是在基座模型上经过精细SFT得到的对话模型,生成内容的准确度大幅提升,也更符合人类偏好,内容创作上的想象力和丰富度也有显著扩展。

  Qwen拥有出色的工具调用能力,能让开发者更快地构建基于QwenAgent(智能体)。开发者可用简单指令教会Qwen使用复杂工具,比如使用Code Interpreter工具执行Python代码以进行复杂的数学计算、数据分析、图表绘制等;还能开发具有多文档问答、长文写作等能力的高级数字助理

  Qwen-14BMMLUC-EvalGSM8KMATHGaoKao-Bench12个权威测评中取得最优成绩,超越所有测评中的SOTAState-Of-The-Art)大模型,也全面超越Llama-2-13B,比起Llama 234B70B模型也并不逊色。

阿里云免费开放“通义千问”升级版

  用户可从魔搭社区直接下载模型,也可通过阿里云灵积平台访问和调用Qwen-14BQwen-14B-Chat。阿里云为用户提供包括模型训练、推理、部署、精调等在内的全方位服务。

  8月,阿里云开源通义千问70亿参数基座模型Qwen-7B,先后冲上HuggingFaceGithubtrending榜单。短短一个多月,累计下载量突破100万。开源社区出现了50多个基于Qwen的模型,社区多个知名的工具和框架都集成了Qwen

  通义千问是落地最深、应用最广的中国大模型,国内已有多个月活过亿的应用接入通义千问,大量中小企业、科研机构和个人开发者都在基于通义千问开发专属大模型或应用产品,如阿里系的淘宝、钉钉、未来精灵,以及外部的科研机构、创业企业。

  浙江大学联合高等教育出版社基于Qwen-7B开发了智海-三乐教育垂直大模型,已在全国12所高校应用,可提供智能问答、试题生成、学习导航、教学评估等能力,模型已在阿里云灵积平台对外提供服务,一行代码即可调用;浙江有鹿机器人科技有限公司在路面清洁机器人中集成了Qwen-7B,使机器人能以自然语言与用户进行实时交互,理解用户提出的需求,将用户的高层指令进行分析和拆解,做高层的逻辑分析和任务规划,完成清洁任务。

  除了开源开放自研大模型,阿里云还牵头建设了中国最大的AI模型开源社区魔搭ModelScope,团结全行业的力量,推动大模型技术普惠和应用落地。过去两个月内,魔搭社区的模型下载量从4500万飙升到8500万,增幅接近100%

  阿里云副总裁、公众与客户沟通部总经理张启表示:“一花独放不是春,百花齐放春满园。不管是闭源大模型的还是开源大模型,自研大模型还是第三方大模型,大规模参数模型还是小规模参数模型,通用大模型还是行业、企业专属大模型,阿里云全部欢迎和支持,共同建设一个最大的大模型自由市场。我们希望所有大模型都能跑在阿里云上,跑得更快、更便宜、更安全。也因为此,阿里云率先开源7B14B模型,并将持续开源开放,为开源社区贡献力量。