推荐
  • 资讯
  • 专题
  • 视频
2025-03-04 周二 11:45:18
豆包大模型团队开源基准测试集SuperGPQA
金十数据3月4日讯,据豆包大模型团队官微消息,近日,豆包大模型团队开源SuperGPQA,一个领域全面且具备高区分度的知识推理基准测试。据介绍,该数据集构建了覆盖285个研究生级学科、包含26529道专业问题的评估体系,不仅涵盖主流学科,更将轻工业、农业、服务科学等长尾学科纳入其中,展现出全面学科的覆盖广度,填补了长尾知识评估领域的空白。

JIN10.COM I 一个交易工具

金十数据