调试排错:AI 模型选型指南
调试排错
场景概述
本页聚焦 调试排错 场景,介绍该场景的核心需求、推荐模型以及评估标准。
选型标准
- HumanEval 得分 ≥ 70
评估标准
- HumanEval 得分 ≥ 70
最佳实践
- 提供清晰的函数签名与示例
- 代码场景使用较低温度(0.0-0.3)
推荐模型
参见本场景下的推荐模型列表(路径:/zh/use-cases/debugging/)。
本页聚焦 调试排错 场景,介绍该场景的核心需求、推荐模型以及评估标准。
参见本场景下的推荐模型列表(路径:/zh/use-cases/debugging/)。