核心规格

厂商alibaba
版本2.5-72b
发布日期2024-09-19
上下文窗口131072 tokens
输入模态text
输出模态text
许可Qwen License
文档https://qwenlm.github.io/

基准测试表现

基准得分单位评测日期备注来源
MMLU86.1%2024-09-195-shot查看
HUMANEVAL86.6pass@12024-09-19查看
GSM8K88.4%2024-09-190-shot CoT查看
MATH83.1%2024-09-190-shot CoT查看
BBH82.4%2024-09-193-shot CoT查看

定价

项目价格币种
输入$0.5 / MtokUSD
输出$0.8 / MtokUSD
缓存读$0 / MtokUSD
缓存写$0 / MtokUSD

数据来源: https://help.aliyun.com/zh/model-studio/getting-started/models · 截至 2024-09-19

合规性

  • 数据驻留: CN
  • SOC2: ✗
  • HIPAA: ✗
  • GDPR: ✗
  • ISO 27001: ✗

Qwen2.5 72B

模型概述

Qwen2.5 72B 是阿里巴巴于 2024 年 9 月 19 日发布的开源权重旗舰模型,是 Qwen2.5 系列的一员。模型在中文理解上处于领先地位,覆盖 29+ 种语言,拥有 131K 上下文窗口。在学术基准上,Qwen2.5 72B 在 MMLU(86.1)上与 Llama 3.1 70B 持平或略胜,并在数学(83.1 vs 71.8)和代码(HumanEval 86.6 pass@1)上显著领先。模型以 Qwen License 发布,对商用几乎无限制(仅有少量使用约束),已成为中文市场部署、中英双语 RAG 系统、以及涉及中文上下文的代码生成管道的首选。模型原生支持结构化输出、工具调用与长文档摘要。

核心规格

属性数值
厂商阿里巴巴
版本2.5-72b
发布日期2024-09-19
上下文窗口131,072 tokens
输入模态文本
输出模态文本
许可证Qwen License
文档地址https://qwenlm.github.io/

基准测试表现

基准得分单位备注
MMLU86.1%5-shot
HumanEval86.6pass@1
GSM8K88.4%0-shot CoT
MATH83.1%0-shot CoT
BBH82.4%3-shot CoT

定价

档位价格(每百万 token)
输入(阿里云)$0.50
输出(阿里云)$0.80
缓存读取$0.00
缓存写入$0.00

定价来源:https://help.aliyun.com/zh/model-studio/getting-started/models (截至 2024-09-19)。开源权重亦允许自托管。

优势

  • 开源权重模型中中文理解能力领先。
  • 代码与数学表现强劲,在多项基准上超越 Llama 3.1 70B。
  • 131K 上下文窗口可处理长中文文档与代码库。
  • API 定价竞争力强,仅 $0.50/$0.80 每百万 token。

劣势

  • Qwen License 较 Apache 2.0 存在少量商用限制。
  • 厂商生态以中国为主,海外社区工具链成熟度较低。
  • 72B 文本版本不支持原生多模态(Qwen2.5-VL 为独立模型)。

适用场景

  • 中国市场的客服与内容生成。
  • 中英双语 RAG 系统,需平衡中英文检索。
  • 面向中文开发者的代码生成管道。
  • 需要强数学与推理且成本敏感的学术研究。

参考文献