华业网
  • 首 页
  • 可 持 续 发 展
  • 投 资
  • 市 场
  • 合 作
  • 创 新
  • 人 事
  • 观 点
No Result
View All Result
  • 首 页
  • 可 持 续 发 展
  • 投 资
  • 市 场
  • 合 作
  • 创 新
  • 人 事
  • 观 点
No Result
View All Result
No Result
View All Result
Home 全行业 信息技术

阿里云发布开源模型Qwen2系列 增强安全性对齐及多语言能力

by Thomas Chang
2024年6月12日
A A

阿里云最近发布其最新通义千问(Qwen)大型语言模型Qwen2系列,不仅性能表现突出,改善安全性对齐,并在训练数据中增加了27种语言相关的高质量数据,提升了模型的多语言能力。

Qwen2系列上线不久后,便在业内权威开源评测榜单Hugging Face的开放LLM排行榜上名列第一。 通义千问开源模型拥有5亿到1,100亿参数的多种尺寸,已在Hugging Face和Github等平台上获得超过700万次下载量。

此次发布的Qwen2系列包含5个尺寸的预训练及指令微调模型,Qwen2-0.5B、Qwen2-1.5B、Qwen2-7B、Qwen2-57B-A14B和Qwen2-72B,其中Qwen2-57B-A14B为混合专家模型(MoE)。 Qwen2以增强的性能和多语言能力为特色,展示了与人类价值观更好的对齐,使其更接近有用、诚实和安全的AI。

作为对开源社区的贡献,Qwen2系列模型均已开源,在其AI模型社区ModelScope(魔搭)和协作AI平台Hugging Face上供商业或研究目的使用。

阿里云首席技术官周靖人表示,「坚持开源开放是阿里云的重要策略,我们希望打造一朵AI时代最开放的云,让算力更普惠、让AI更普及。」

多语言能力及长文本支持

通过利用阿里云的优化训练方法,Qwen2-72B在语言理解、语言生成、多语言能力、编码、数学、推理等多个方面的15个标准测试中胜过其他领先的开源模型。 此外,Qwen2-72B增大了上下文长度支持,最高达到128K tokens。

为了增强其多语言能力,除了原本具备的中英文能力,Qwen 2的训练新增了27种语言覆盖亚洲、欧洲、中东地区,例如日文、韩文,越南语、印尼语、泰语、马来语、他加禄语、德语、法语、意大利语、阿拉伯语等。

除此之外,还为不同的Qwen2模型应用了群组查询注意力(Grouped-query attention, GQA)技术,以优化计算效率与模型性能之间的平衡,在模型推理过程中提升速度并减少内存使用。

负责任的AI

值得注意的是,通过后训练,Qwen2模型的输出在诸如MT-bench这样的基准测试中展示了与人类价值观更好的对齐,这是评估聊天机器人多轮对话和遵循指令能力的多轮问题集,这两个方面是人类偏好的两个关键要素。

通过纳入人类反馈以更好地与人类价值观对齐,这些模型在安全性和责任方面表现良好,能够应对与非法活动、欺诈、色情和隐私侵犯相关的多语言不安全查询,以防止模型的滥用。 在小模型方面,Qwen2-7B也在包括代码在内的多项基准测试中超越了其它相似尺寸的先进模型。

深入探索新兴技术主题

阿里云的Qwen2模型系列的推出和表现再次证明其在AI领域的领导地位,特别是在开放源代码的大型语言模型方面。 通过加强性能、多语言能力和安全性的对齐,Qwen2旨在推动AI技术的进步,同时确保其应用符合人类价值观和伦理标准。 随着AI技术的快速发展,像Qwen2这样的模型在推进技术创新的同时,也提醒我们需关注其在社会中的应用和影响。 阿里云对开源社区的贡献,包括使这些先进的模型可用于商业和研究目的,进一步展示了公司致力于推广AI知识和技术的开放获取,旨在激发全球范围内的创新和发展。

Tags: 创新与研发

其他资讯

信息技术

领跑100|联想×吉利,共筑汽车智算新引擎

2025年7月3日
信息技术

华为宣布开源盘古7B稠密和72B混合专家模型

2025年7月1日
信息技术

德勤与阿里云联合举办「GenAI 探索实验室」活动

2025年6月28日
信息技术

国家信息中心与联想集团签署战略合作协议

2025年6月27日
信息技术

HDC 2025:开发者搭上“鸿蒙快车”,鸿蒙生态加速前行

2025年6月24日
信息技术

阿里云于澳门举办科技赋能 共赢未来 AI工作坊 助力澳门构建本土AI生态圈

2025年6月17日
<简体> <繁體>

松下电器中国共创加速计划正式启动!

2025年7月2日

...

英特华管理合伙人Eduardo Morcillo荣获“华业”大中华区年度卓越并购顾问

2025年6月17日

...

博世与中电丰业达成多年期合作协议,将为其提供兆瓦级PEM电解槽产品

2025年7月8日

...

哈啰Robotaxi业务完成超30亿元融资

2025年6月24日

...

德勤与阿里云联合举办「GenAI 探索实验室」活动

2025年6月28日

...

默克宣布投资约七千万欧元扩建其在华试剂生产

2025年6月30日

...

以CBI驱动增长,用AI提质增效:YPN中国2025线下峰会高能来袭!

2025年6月27日

...

“WeTech for Education”教育科技赛事颁奖典礼圆满举行 腾讯携手香港教育界共创数字教育新篇章

2025年7月3日

...

小鹏汽车6月共交付新车34,611台,2025上半年累计交付197,189台,超过2024全年交量

2025年7月3日

...

Manitowoc万利多高新技术研发中心挂牌

2025年7月5日

...

华业网 (Greater China Business) 致力于促进全球跨国公司、机构在华贸易、投资与业务发展;促进大中华区业务交流与合作;关注最新企业动态和行业趋势;分享经营与管理经验;传播卓越理念,为各方在华取得商业成功,促进可持续发展、友好交流贡献力量。

联 系 我 们 | CONTACT US

商务合作联系:  partnership#apac-business.com

媒体资讯联系:  editor#apac-business.com

人力资源联系:  hr#apac-business.com

* (替换# 为 @)

www.apac-business.com

  • 首 页
  • 可 持 续 发 展
  • 投 资
  • 市 场
  • 合 作
  • 创 新
  • 人 事
  • 观 点

Copyright © 华业网 Greater China Business | 沪ICP备2022016631号-2

No Result
View All Result
  • 首 页
  • 可 持 续 发 展
  • 投 资
  • 市 场
  • 合 作
  • 创 新
  • 人 事
  • 观 点

Copyright © 华业网 Greater China Business | 沪ICP备2022016631号-2

沪公网安备 31011402010150号