关闭导航

包含标签"本科数学"的内容

魔搭ModelScope发布UGMathBench动态基准数据集 助力评估语言模型本科数学推理能力
AI妹 1 个月前 9 0

近日,魔搭ModelScope社區宣佈發佈一項名爲UGMathBench的動態基準測試數據集,旨在全面評估語言模型在本科數學廣泛科目中的數學推理能力。這一數據集的問世,填補了當前在本科數學領域評估