中国移动、电子标准院及16家重点央企发布《通用大模型评测标准》
创始人
2024-10-12 16:01:55

IT之家 10 月 12 日消息,IT之家从中国移动官方获悉,在今天召开的 2024 中国移动全球合作伙伴大会期间,中国移动联合电子标准院及 16 家重点央企共同开展大模型评测体系建设工作,并发布《通用大模型评测标准》。

据介绍,该标准是大模型评测体系建设的重要成果,为产业界遴选优质大模型提供重要参考依据。第一阶段将围绕通用领域和 4 个重点行业领域,从评测标准制定、评测基地建设、评测试点应用等方面开展工作。

通用大模型评测标准基于“2-4-6”框架如下:

  • “2”:两类评测视角,以重点行业实际使用需求为导向,与国标对模型能力要求拉齐,将评测任务划分为理解和生成两类视角。
  • “4”:四类评测要素,从评测全生命周期中提取出评测工具、评测数据、评测方式和评测指标四类关键要素,确保评测工作可实施性。
  • “6”:六大评测维度,综合考虑大模型应用过程中的核心能力,设定功能性、准确性、可靠性、安全性、交互性和应用性六大维度。

相关内容

热门资讯

狼队清清赛后感慨,决赛是延续职... 狼队夺冠后,清清在赛后采访的这番发言非常真诚,他说决赛是他延续职业生涯的一场比赛。输给AG之后,每一...
停服跑路的“国产之光”,在全球... 2024年6月,动荡不安的柳叶刀工作室,终于还是发布了一则关于《边境》的停服公告。 《边境》是柳叶...
《刺客信条:黑旗》重制版新增过... IT之家 5 月 24 日消息,育碧在《刺客信条:黑旗》重制版的制作上可谓处处用心。游戏画面迎来精美...
吕布西施体系成狼队夺冠秘诀,为... 这篇文章我们来聊一下狼队最后一局选出来的这一套阵容,也是最后一锤定音的关键,这套阵容其实非常妙,打破...
三种方法轻松延缓大脑衰老 参考消息网5月23日报道据英国广播公司网站5月11日报道,如果摆在面前的是一项简单任务和一项复杂任务...