Open LLM Leaderboard

5天前发布 6 00

Hugging Face推出的开源大模型排行榜单

语言:
zh
收录时间:
2026-09-07
Open LLM LeaderboardOpen LLM Leaderboard

Open LLM Leaderboard:开源大模型评测排行榜

Open LLM Leaderboard是Hugging Face推出的开源大语言模型排行榜,基于EleutherAI语言模型评估框架,从指令遵循、复杂推理、数学解题和专业知识等维度比较模型能力,帮助开发者和研究人员筛选、分析和验证开源模型。

主要功能

  • 支持IFEval、BBH、MATH、GPQA、MuSR和MMLU-Pro等多项基准测试
  • 覆盖预训练、持续预训练、微调及聊天模型
  • 展示详细评分、输入输出样例和模型信息
  • 支持按模型类型和评测指标筛选比较
  • 提供评测代码和工具,支持结果复现
  • 支持社区标记、讨论和模型提交

使用方式

访问排行榜后,可查看模型排名和具体评测结果,点击模型名称了解详情。研究人员也可以使用开源评估框架,在本地运行指定任务并复现模型成绩。

适用场景

适合模型选型、学术研究、性能对比、技术验证、开源社区协作和大模型教学。

数据统计

相关导航

暂无评论

none
暂无评论...