当前位置:首页>高新技术

阿里云开源通义千问14B模型

信息来源:科技日报   责任编辑:李婷婷   时间:2023-10-06   访问量:1515

 9月25日,记者从阿里云获悉,通义千问140亿参数模型Qwen-14B及其对话模型Qwen-14B-Chat正式开源,免费可商用。阿里云此前已开源70亿参数模型Qwen-7B等,一个多月下载量破100万。

  Qwen-14B是一款支持多种语言的高性能开源模型,相比同类模型使用了更多的高质量数据,整体训练数据超过3万亿Token,使得模型具备更强大的推理、认知、规划和记忆能力。Qwen-14B最大支持8k的上下文窗口长度。

  用户可从魔搭社区直接下载模型,也可通过阿里云灵积平台访问和调用Qwen-14B和Qwen-14B-Chat。阿里云为用户提供包括模型训练、推理、部署、精调等在内的全方位服务。

  大规模预训练模型参数量大、训练成本高,开源大模型可以帮助用户简化模型训练和部署的过程,使得用户不必从头训练模型,只需下载预训练好的模型并进行微调,就可快速构建高质量的模型或进行相应的应用开发。阿里云表示,希望通过开源,让海量的中小企业和开发者更快用上通义千问大模型。

  据悉,国内已有多个月活过亿的应用接入通义千问,大量中小企业、科研机构和个人开发者在基于通义千问开发专属大模型或应用产品。

  阿里云CTO周靖人表示,阿里云将持续拥抱开源开放,推动中国大模型生态建设,让大模型技术更快触达中小企业和个人开发者。


上一篇:百度首发量子领域大模型,量羲平台实现“四算合一”

下一篇:新一代机器人闪亮登场

Copyright 2023 www.wanqiqianshang.com All Rights Reserved
网站首页 - 关于我们 - 联盟章程 - 帮助中心 - 使用协议 - 版权隐私 - 联系方式 - 广告服务 - 违规举报
万企千商网 版权所有 京ICP备2022030058号-1  中华人民共和国电信业务经营许可证(京B2-20231259)  中国互联网举报中心 举报电话:4008009085 处置流程

京公网安备 11010602104668号