AI模型评估平台
LMArena是加州大学伯克利分校推出的AI模型比较与评估平台,通过匿名模型对战和用户投票衡量不同模型的实际表现。用户输入同一问题后,可比较两个模型的回答并选择更优结果,投票数据将用于生成公开排行榜。
访问LMArena后输入问题或提示词,阅读两个匿名模型的回答并选择更满意的结果。投票完成后可查看模型身份及排行榜表现,也可以继续与模型进行聊天。
适合AI模型选型、产品测试、模型优化、学术基准研究和AI教学。