阿里云开源通义千问14B模型 周靖人 持续拥抱开源开放 (阿里云开源通义千问)

文章编号:36619 资讯动态 2024-11-30 通义千问 阿里云 开源大模型

「消息」9月25日,阿里云开源通义千问140亿参数模型Qwen-14B及其对话模型Qwen-14B-Chat,免费可商用。Qwen-14B在多个权威评测中超越同等规模模型,部分指标甚至接近Llama2-70B。阿里云此前开源了70亿参数模型Qwen-7B等,一个多月下载量破100万,成为开源社区的口碑之作。

Qwen-14B是一款支持多种语言的高性能开源模型,相比同类模型使用了更多的高质量数据,整体训练数据超过3万亿Token,使得模型具备更强大的推理、认知、规划和记忆能力。Qwen-14B最大支持8k的上下文窗口长度。

阿里云开源通义千问14B,周靖人:持续拥抱开源开放

图1:Qwen-14B在十二个权威测评中全方位超越同规模SOTA大模型

Qwen-14B-Chat是在基座模型上经过精细SFT得到的对话模型。借助基座模型强大性能,Qwen-14B-Chat生成内容的准确度大幅提升,也更符合人类偏好,内容创作上的想象力和丰富度也有显著扩展。

Qwen拥有出色的工具调用能力,能让开发者更快地构建基于Qwen的Agent(智能体)。开发者可用简单指令教会Qwen使用复杂工具,比如使用Code Interpreter工具执行Python代码以进行复杂的数学计算、数据分析、图表绘制等;还能开发具有多文档问答、长文写作等能力的“高级数字助理”。

百亿以内参数级别大语言模型是目前开发者进行应用开发和迭代的主流选择,Qwen-14B进一步提高了小尺寸模型的性能上限,从众多同尺寸模型中冲出重围,在MMLU、C-Eval、GSM8K、MATH、GaoKao-Bench等12个权威测评中取得最优成绩,超越所有测评中的SOTA(State-Of-The-Art)大模型,也全面超越Llama-2-13B,比起Llama2的34B、70B模型也并不逊色。与此同时,Qwen-7B也全新升级,核心指标最高提升22.5%。

阿里云开源通义千问14B,周靖人:持续拥抱开源开放

图2:Qwen-14B性能超越同尺寸模型

用户可从魔搭社区直接下载模型,也可通过阿里云灵积平台访问和调用Qwen-14B和Qwen-14B-Chat。阿里云为用户提供包括模型训练、推理、部署、精调等在内的全方位服务。

8月,阿里云开源通义千问70亿参数基座模型Qwen-7B,先后冲上HuggingFAce、Github的trending榜单。短短一个多月,累计下载量突破100万。开源社区出现了50多个基于Qwen的模型,社区多个知名的工具和框架都集成了Qwen。

阿里云开源通义千问14B,周靖人:持续拥抱开源开放

通义千问是落地最深、应用最广的中国大模型,国内已有多个月活过亿的应用接入通义千问,大量中小企业、科研机构和个人开发者都在基于通义千问开发专属大模型或应用产品,如阿里系的淘宝、钉钉、未来精灵,以及外部的科研机构、创业企业。

浙江大学联合高等教育出版社基于Qwen-7B开发了智海-三乐教育垂直大模型,已在全国12所高校应用,可提供智能问答、试题生成、学习导航、教学评估等能力,模型已在阿里云灵积平台对外提供服务,一行代码即可调用;浙江有鹿机器人科技有限公司在路面清洁机器人中集成了Qwen-7B,使机器人能以自然语言与用户进行实时交互,理解用户提出的需求,将用户的高层指令进行分析和拆解,做高层的逻辑分析和任务规划,完成清洁任务。

阿里云CTO周靖人表示,阿里云将持续拥抱开源开放,推动中国大模型生态建设。阿里云笃信开源开放的力量,率先开源自研大模型,希望让大模型技术更快触达中小企业和个人开发者。

阿里云还牵头建设了中国最大的AI模型开源社区魔搭ModelScope,团结全行业的力量,共同推动大模型技术普惠和应用落地。过去两个月内,魔搭社区的模型下载量从4500万飙升到8500万,增幅接近100%。

附:

魔搭社区模型地址:

魔搭社区模型体验:

阿里云灵积平台地址:

Qwen论文地址:

HuggingFace:

特约稿件,未经授权禁止转载。详情见 转载须知 。

阿里云开源通义千问14B,周靖人:持续拥抱开源开放


本文地址: https://www.gpxz.com/article/2236f120eafd39a41072.html
全局中部横幅
全局中部横幅
登录

欢迎登录支付宝,支付宝-全球领先的独立第三方支付平台,致力于为广大用户提供安全快速的电子支付/网上支付/安全支付/手机支付体验以及转账收款/水电煤缴费/信用卡还款等生活服务应用;为广大为从事电子商务的网站提供支付产品/支付服务的在线订购和技术支持等服务,帮助商家快速接入支付工具,高效、安全、快捷地开展电子商务。

蓝客多官网

蓝客多团队始于2012年10月,我们从帮助企业建站出发,帮助商家搭建微信公众号商城/小程序,门店小程序系统,轻会员营销,共享员工,共享门店系统,借助小程序的功能特性和微信生态,提供系统工具加方案,让门店能够快速、低成本拓客,实现业务增长。蓝客多助力传统中小商家接入互联网,解决门店运营难题。

锦州市瑞达铁路机械制造有限公司

锦州市瑞达铁路机械制造有限公司是生产铁路小型养路机械的专业工厂,位于美丽的海滨城市-锦州,地处辽宁省西南部,北依松岭山脉,南临渤海辽东湾,位于著名的“辽西走廊”东端,地理位置优越、交通便利,是集设计、开发、生产和销售铁路机械设备为一体的专业化企业。

传化集团

传化集团创业于1986年,布局传化化学、新安化工、传化物流、传化科技城四大战略业务,打造智能制造、物流科技、都市产业新城三大样板,服务和引领中国智造。集团下属传化智联(002010)、新安股份(600596)两家上市公司,十余家国家高新技术企业,产品和服务覆盖全球100多个国家和地区。

朔州科瑞机械租赁

公司拥有各种型号工程机械,性能优良。专业从事土石方工程、地基工程、安装工程。为客户提供项目所需的各种型号的挖掘机、破碎锤、装载机、压路机、吊车、自卸车、拖板车、发电机组、搅拌机、钢管、钢模等。给客户提供性价比和方便的租赁服务。

台湾博士DR气动工具,气动打磨机,气动角磨机

本公司特别推出dr气动工具网,经销博士DR气动工具,DR气动扳手,DR气动打磨机,DR气动刻磨机等。dr气动工具选卡尼尔,台湾DR气动工具网

VR虚拟景区

VR全景图片和视频平台,视频环视,3D建模漫游渲染,720云全景平台,为您打造真正的空中全景地图。..

手持式SF6泄漏检测仪

上海端懿电气科技有限公司(www.duanyidianqi.com)是开关柜局部放电检测仪,智能地下管线探测仪等设备的专业制造商,为各类电力用户提供高电压试验及检测的完备解决方案,是集研发、生产、销售于一体的技术企业

中天票务在线

中天票务在线-常年代理北京各类演出票务-北京演唱会门票-北京国安主场门票-国安球票-北京北汽男篮球票-CBA北京首钢男篮门票-北京农商银行男篮门票-北控男篮主场门票-工人体育场演出门票-北京人和主场门票-鸟巢演出门票-体育赛事门票-郭德纲北京相声专场

装修网

猎装网是一站式服务的装修设计服务三方平台网站,为业主提供装修设计服务、装修效果图参考、旧房二手房翻新服务,以及装修报价方案对比,装修先上猎装网-猎行家,装好房。

中国品牌档案

中国品牌档案栏目是中央电视台开创的一档企业纪实类节目,栏目在CCTV-9和CCTV老故事频道播出。中国品牌档案栏目一经播出,便受到国内外企业家的广泛好评

携车网

携车网是上海车水马龙信息技术股份有限公司旗下网站。上海车水马龙信息技术股份有限公司成立于2011年,是国内最早进入汽车后市场的O2O网站,致力于为车主提供省钱、省事、透明的高品质汽车维修保养服务。


全局底部横幅