学术研究 场景推荐:GPT-4 32K
学术研究 → GPT-4 32K
场景概述
GPT-4 32K 由 Openai 发布,是 学术研究 场景下的推荐选项之一。
推荐模型
| 排名 | 厂商 | 上下文窗口 | Score |
|---|---|---|---|
| #10 | Openai | 32K | 56/100 |
性能分析
基准测试表现
| 基准 | 得分 |
|---|---|
| MMLU | 80.8 |
| HUMANEVAL | 76.8 |
| GSM8K | 81.6 |
| MATH | 40.1 |
| BBH | 79.2 |
| GPQA | 40.9 |
优势
- MMLU 得分 80.8,知识推理能力强。
- 上下文窗口 32K,支持长文本。
需求
- 需要 openai 的 API 密钥
- 输入长度须在 32K 上下文窗口内