CMMLU – 综合性中文大模型评估基准与多学科知识推理测试 CMMLU是专注于评估大模型中文知识与推理能力的综合性基准,涵盖67个学科主题,包含大量中国特定知识题目。 00 AI模型评测# AI模型评测# CMMLU# GitHub