南开新闻网讯(通讯员 葛路)近日,国家标准化管理委员会正式发布国家标准《人工智能 大模型 第7部分:语音大模型》(GB/Z 45288.7-2026)。该标准是我国人工智能大模型标准体系的重要组成部分,南开大学作为主要起草单位之一,深度参与了该标准的研制工作,是学校服务国家重大战略需求、推动产学研深度融合的重要成果。
该标准由全国信息技术标准化技术委员会(TC28)归口,其人工智能分委会(TC28SC42)执行,主管部门为国家标准化管理委员会。该标准确立了语音大模型的参考框架,从理解能力(含语音识别、语音分类、情感识别、说话人识别、语音鉴伪)、生成能力(含语音合成、语音翻译、声音克隆、音色转换、语音增强、语音分离)及语音对话三大维度,系统规定了技术要求和实现路径,适用于语音大模型的设计、开发、测试、部署和应用,为我国语音大模型产业的规范化发展提供统一的技术依据。
该标准主要起草单位包括中国电子技术标准化研究院、中国移动、科大讯飞、火山引擎、中国电信、中国联通、思必驰等科研机构与企业。南开大学计算机学院、密码与网络空间安全学院教授秦勇作为主要起草人,代表学校参与标准的技术研讨与文本编制工作,为标准的科学性、先进性贡献了南开智慧。
秦勇表示,在标准制定过程中,得到了南开大学计算机学院、密码与网络空间安全学院、人类语言技术实验室(HLT Lab)全体师生及学院领导的大力支持,特别感谢博士生周家名、王卉等在标准调研与验证工作中的积极贡献。未来,南开大学计算机学院和密码与网络空间安全学院将继续深耕人工智能基础理论与关键技术,为我国新一代人工智能产业发展与标准化建设贡献更多力量。
|