12月27日消息,据中国国家市场监管总局消息公布,近日,《人工智能大模型》系列国家标准正式实施。
作为首部聚焦通用大模型的国家标准,该系列填补了技术评价体系空白,明确性能、安全与服务能力要求,配套评测能力已获中国合格评定国家认可委员会认可。
基于此构建的“求索”-LMBench评测基准,整合方法、数据集与自动化平台,成为行业公认的“能力标尺”。评测体系已形成主流大模型白名单,为央企、国企选型提供依据,并支撑中国石化、南方电网等建设行业大模型,完成对华为盘古、讯飞星火、中国移动“九天”等模型的场景验证。
截至目前,标准工具完成千余项评测任务,调用大模型超95万次,精准识别幻觉控制、内容安全等共性问题,助力近30家厂商技术迭代,推动形成“研发—评测—应用—升级”闭环。
值得一提的是,标准国际化也同步推进。面向东盟编制英语、老挝语、高棉语版本,填补了区域空白;中国开源模型架构已被新加坡等国项目采用。
文章来源:
快科技
版权声明:本文内容由互联网用户自发贡献,该文观点仅代表作者本人。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如发现本站有涉嫌抄袭侵权/违法违规的内容, 请发送邮件至23467321@qq.com举报,一经查实,本站将立刻删除;如已特别标注为本站原创文章的,转载时请以链接形式注明文章出处,谢谢!