奇链
首页
AI 模型
AI 视频
产品
教程
文章
圈子
登录
首页
/
产品
/
模型评测与基准
/
MMLU
MMLU
开发框架/库
MMLU提供覆盖57个学科的多任务语言理解基准测试,用于评估和对比大模型在广泛知识领域的综合表现,是衡量模型泛化能力的重要参考标准。
访问官网
分享
概览
文章
评价
功能清单
FAQ
添加关联
产品简介
MMLU提供覆盖57个学科的多任务语言理解基准测试,用于评估和对比大模型在广泛知识领域的综合表现,是衡量模型泛化能力的重要参考标准。
用户评价
还没有评价
这款产品刚收录,成为第一个评价的人
写第一条评价