
新SuperCLUE
中文通用大模型综合性测评基准
Open LLM Leaderboard是Hugging Face推出的开源大语言模型排行榜,基于EleutherAI语言模型评估框架,从指令遵循、复杂推理、数学解题和专业知识等维度比较模型能力,帮助开发者和研究人员筛选、分析和验证开源模型。
访问排行榜后,可查看模型排名和具体评测结果,点击模型名称了解详情。研究人员也可以使用开源评估框架,在本地运行指定任务并复现模型成绩。
适合模型选型、学术研究、性能对比、技术验证、开源社区协作和大模型教学。







