当前位置：首页 > 科技赋能

阿里云统一钱文14B模型开源了！性能超越Llama2

时间：2024-05-19 15:54:12 科技赋能

9月25日，阿里云开源统一钱文亿参数模型Qwen-14B及其对话模型Qwen-14B-Chat，免费商用。

Qwen-14B的性能在多项权威评测中超越Llama2，为同尺寸模型树立了新的天花板。

阿里云此前开源了70亿参数模型Qwen-7B等，一个多月下载量突破万次，成为开源社区的知名作品。

Qwen-14B是一款支持多种语言的高性能开源模型。

与同类模型相比，它使用了更多高质量的数据。

整体训练数据超过3万亿Token，使得模型的推理、认知、规划能力更加强大。

和记忆能力。

Qwen-14B 支持最大上下文窗口长度为 8k。

图1：Qwen-14B在十二项权威测试中全面超越同比例的SOTA大型模型。

Qwen-14B-Chat是在基础模型上通过精确的SFT得到的对话模型。

借助基础模型的强大性能，Qwen-14B-Chat生成内容的准确性得到了大幅提升，更加符合人类的喜好。

内容创作的想象力和丰富性也显着拓展。

Qwen 拥有出色的工具调用能力，可以让开发者更快地构建基于 Qwen 的 Agent。

开发者可以通过简单的指令教Qwen使用复杂的工具，例如使用Code Interpreter工具执行Python代码来进行复杂的数学计算、数据分析、图表绘制等；他们还可以开发具有多文档问答和长文本写作等功能的“高级数字工具”。

Qwen-14B在MMLU、C-Eval、GSM8K、MATH、GaoKao-Bench等12项权威评测中取得最好成绩，超越评测中所有SOTA（State-Of-The-Art）大型模型，同时各方面超越Llama -2-13B 不逊于Llama 2的34B和70B型号。

图2：Qwen-14B的性能超过同尺寸型号用户可以直接从Moda社区下载模型。

，或者通过阿里云灵机平台接入调用Qwen-14B和Qwen-14B-Chat阿里云为用户提供包括模型训练、推理、部署、微调等全方位的服务。

8月份，阿里云上线。

开放同易钱文70亿参数库模型Qwen-7B，先后进入HuggingFace、Github趋势榜。

短短一个多月的时间，累计下载量突破一万。

开源社区已经出现了超过50个基于Qwen的模型，社区中很多知名的工具和框架都集成了Qwen。

统一钱文是国内实施最深入、应用最广泛的大型模式。

国内有很多月销量过亿的应用接入了统一钱文。

大量中小企业、科研机构和个人开发者正在使用基于统一钱文的统一钱文。

询问独家大型模型或应用产品的开发情况，如阿里巴巴的淘宝、钉钉、未来精灵，以及外部科研机构和初创公司。

浙江大学和高等教育出版社基于Qwen-7B开发了知海-三乐教育垂直模型。

已在全国12所高校应用，可提供智能问答、试题生成、学习导航、教学评价等能力。

该模型已用于阿里巴巴云灵机平台对外提供服务，一行代码即可调用；浙江优路机器人科技有限公司将Qwen-7B集成到道路清洁机器人中，让机器人能够用自然语言与用户实时交互，理解用户提出的需求。

分析拆解用户的高层指令，进行高层逻辑分析和任务规划，完成清理任务。

除了开源和自研的大模型之外，阿里云还牵头打造了中国最大的开源AI模型社区ModelScope，联合全行业的力量推动大模型技术的普惠和应用。

近两个月来，Moda社区的模型下载量从1万猛增至1000，增幅近%。

阿里云副总裁、公众与客户传播部总经理张奇表示：“一花独开不成春，百花齐放满园。

无论是闭源大模型或者开源大模型、自研大模型、第三方大模型无论是大型参数化模型还是小规模参数化模型、通用大模型还是行业企业专属大模型，阿里云都欢迎和欢迎支持它们，共同打造最大的大模型自由市场，希望所有的大模型都能跑得更快、更便宜、更安全。

正因为如此，阿里云率先开源了7B和14B。

模型并将继续这样做，为开源社区做出贡献。

阿里云统一钱文14B模型开源了！性能超越Llama2相关文章