AI大模型评测社区
AGI-Eval是由上海交通大学、同济大学、华东师范大学、DataWhale等高校和机构合作建设的大模型评测社区,专注于评估基础模型在人类认知、语言理解和问题解决任务中的通用能力,推动建立公正、透明、可信的AI评测生态。
适合模型性能评估、NLP算法开发、语言能力测试、科研实验、模型选型和AI评测数据集建设。