OpenCompass

5天前发布 13 00

上海人工智能实验室推出的大模型开放评测体系

语言:
zh
收录时间:
2026-09-07
OpenCompassOpenCompass

OpenCompass:开源大模型评测体系

OpenCompass是上海人工智能实验室推出的开放、可复现的大模型评测体系,支持大语言模型和多模态模型的一站式评估。平台从语言、知识、推理等八大能力维度进行测试,提供零样本、少样本等评测方式,推动大模型评估标准化。

主要功能

  • CompassKit:提供评测工具、基准和模型模板
  • CompassHub:支持评测基准发布、共享和社区协作
  • CompassRank:提供模型评分、排名和能力对比
  • 支持Hugging Face模型、API模型及多模态模型
  • 支持分布式评估、实验管理和报告生成
  • 支持自定义扩展评测任务和数据集

使用方式

用户可浏览CompassRank查看榜单,或使用CompassKit安装环境、配置模型和数据集后执行本地评测,也可以在CompassHub提交和共享自定义评测基准。

适用场景

适合模型性能评估、算法优化、学术研究、企业模型选型、AI应用开发和评测社区共建。

数据统计

相关导航

暂无评论

none
暂无评论...