GB/T47478.1—2026公共安全声纹识别应用考试试卷(含答案)
考试说明:本试卷满分100分,考试内容严格依据《GB/T47478.1—2026 公共安全 声纹识别应用 第1部分:采集 识别建库技术要求》原文编制,题型分为选择题(单选+多选)、判断题,所有题目答案均可在原文中精准溯源,侧重细节参数、差异化规范、特殊技术要求等高难度考点。
一、单项选择题(共15题,每题3分,共45分)
每题只有一个正确答案,多选、错选、不选均不得分
1、根据GB/T47478.1—2026规定,声纹身份库的声纹语音文件来源必须为()
A、间接获取 B、直接获取 C、直接获取或间接获取 D、第三方数据导入
2、声纹身份库采集语音时,规定的标准采样频率为()
A、8000Hz或16000Hz B、16000Hz或32000Hz C、8000Hz D、16000Hz
3、声纹数据质量等级3要求语音段信噪比最低值为()
A、15dB B、20dB C、25dB D、30dB
4、声纹数据质量等级2中,存在质量问题的音频段时长总和不得超过音频总时长的()
A、5% B、10% C、15% D、20%
5、等级3声纹数据要求下限截止频率不高于()
A、500Hz B、300Hz C、200Hz D、100Hz
6、声纹身份库语音文件强制要求的存储格式为()
A、压缩MP3格式 B、标准无压缩WAV格式 C、FLAC无损格式 D、自定义音频格式
7、声纹身份库固定短文本采集时,音节数量要求为()
A、≥3个音节 B、≥6个音节 C、≥9个音节 D、≥12个音节
8、声纹身份库纯数字串语音内容采集时,数字出现总数量要求为()
A、≥20个 B、≥30个 C、≥40个 D、≥50个
9、通用声纹算法测试库要求目标说话人与非目标说话人总数最低为()
A、5000人 B、8000人 C、10000人 D、20000人
10、通用声纹算法测试库中,单个目标说话人识别用语音文件数量至少为()
A、3个 B、5个 C、8个 D、10个
11、通用声纹算法测试库18岁~60岁说话人占比标准为()
A、70±5% B、60±5% C、80±5% D、90±5%
12、通用声纹算法测试库普通话语音占比标准为()
A、70% B、80% C、90% D、95%
13、声纹数据质量等级2最低有效语音时长要求为()
A、>5s B、≥10s C、≥20s D、≥30s
14、声纹数据质量等级3最低有效语音时长要求为()
A、>5s B、≥10s C、≥20s D、≥30s
15、声纹语音质量检测信噪比计算公式的依据标准是()
A、GB/T41786—2022 B、GB/T21023—2007 C、GB/T41807—2022 D、GA/T1587—2019
二、多项选择题(共10题,每题4分,共40分)
每题有两个及以上正确答案,少选、多选、错选均不得分
1、声纹语音样本采集时需综合考虑的核心因素包含()
A、采集环境与采集设备 B、采集参数与采集约束 C、采集内容 D、被采集人年龄、情绪、口音等特征
2、声纹身份库语音采集的硬性要求包括()
A、采集前核实被采集人身份信息 B、采集现场无明显噪声、设备无电噪声与回声 C、关闭设备自动降噪功能 D、被采集人可刻意调整声线保证音质
3、声纹语音质量检测的必备检测内容有()
A、上下限截止频率 B、截幅与波形畸变现象 C、喷麦、语音混杂、突发噪声 D、信噪比与有效时长
4、GB/T47478《公共安全 声纹识别应用》标准体系包含的部分有()
A、采集识别建库技术要求 B、数据交换格式与接口规范 C、远程声纹识别系统要求 D、声纹数据安全分级规范
5、声纹数据库按用途分类包含()
A、声纹算法测试库 B、声纹身份库 C、声纹特定应用库 D、声纹通用基础库
6、声纹语音文件建库通用要求包含()
A、入库前完成语音质量检测,满足对应质量标准 B、注册语音文件仅含单人语音,无多余非人声音频 C、定期维护更新数据库说明文档 D、所有信息项必须完整填报,不得空缺
7、声纹建库数据安全需遵循的要求与措施包括()
A、符合GB/T41807—2022标准 B、采用数据加密、逻辑或物理隔离手段 C、保障数据存储与传输的机密性、完整性 D、文件名中不得包含可识别说话人的信息
8、通用声纹算法测试库语音文件分布需考量的因素有()
A、语速、情绪分布 B、采集时间间隔 C、口音、语种分布 D、说话人年龄、性别分布
9、声纹身份库语音内容合规要求包含()
A、长文本需兼顾语音音素覆盖度与均衡性 B、固定短文本≥6个音节且至少3个音节发音不同 C、纯数字串≥40个数字,每个数字出现≥4次 D、多文件入库时,单文件需独立满足全部内容要求
10、声纹特定应用库建库需重点考量的因素有()
A、数据来源与处理方式合规性 B、声纹数据质量等级、有效语音时长 C、语种方言、语音内容、编码方式 D、说话人标识信息完整性
三、判断题(共5题,每题3分,共15分)
正确选对,错误选错
1、声纹数据质量等级1对音频信噪比、有效时长无强制要求。()
2、声纹算法测试库语音文件来源仅可采用间接获取方式。()
3、声纹身份库语音采集时,允许被采集人在轻微身体不适状态下完成采集。()
4、声纹语音质量检测过程中,严禁篡改、修改被检测的原始声纹数据。()
5、声纹身份库语音数据质量仅需满足等级2要求,等级3为可选高标准要求。()
四、参考答案(原文溯源标注)
(一)单项选择题答案
1、B 【原文4.2.2】声纹身份库的声纹语音文件来源应为直接获取
2、A 【原文4.2.2d】采用8000Hz或者16000Hz采样频率,量化精度16bit
3、C 【原文5.3.4】等级3声纹数据语音段信噪比大于或等于25dB
4、B 【原文5.3.3】等级2存在质量问题的音频段时长总和小于或等于音频总时长的10%
5、C 【原文5.3.4】等级3声纹数据下限截止频率小于或等于200Hz
6、B 【原文6.4.2b】声纹身份库语音文件采用标准无压缩的WAV格式
7、B 【原文6.4.2e】固定短文本应大于或等于6个音节,且至少有3个音节发音不同
8、C 【原文6.4.2e】纯数字串应大于或等于40个数字,每个数字出现大于或等于4次
9、C 【原文6.3.2a】通用算法测试库目标与非目标说话人总数大于或等于10000人
10、B 【原文6.3.2b】单个目标说话人识别用语音文件大于或等于5个
11、A 【原文6.3.2c】18岁~60岁说话人占比70±5%
12、B 【原文6.3.2c】汉语普通话语音占比80%,方言口音语音占20%
13、A 【原文表1】等级2有效时长>5s
14、D 【原文表1】等级3有效时长≥30s
15、B 【原文5.2f】信噪比按GB/T21023—2007中4.6公式检测
(二)多项选择题答案
1、ABCD 【原文4.2.1】采集需考虑环境、设备、参数、约束、内容、被采集人特征等因素
2、ABC 【原文4.2.2】采集禁止被采集人刻意变声、调整声线,D选项错误
3、ABCD 【原文5.2】明确规定七大检测内容,包含题干全部选项
4、ABC 【原文引言】标准体系包含三部分,无D选项规范
5、ABC 【原文6.1】数据库分为算法测试库、身份库、特定应用库三类
6、ABC 【原文6.2.2】部分信息项为选填,无需全部填报,D选项错误
7、ABCD 【原文6.2.3】明确数据安全合规标准、技术措施、文件名规范
8、ABCD 【原文6.3.1、6.3.2】算法测试库需覆盖人员、语音、环境等多维度分布
9、ABC 【原文6.4.2e】多文件可合并满足要求,无需单文件独立达标,D选项错误
10、ABCD 【原文6.5.2】明确特定应用库建库全部考量因素
(三)判断题答案
1、√ 【原文表1】等级1信噪比、有效时长标注NA(无要求)
2、× 【原文6.1a】算法测试库主要为间接获取,并非唯一来源
3、× 【原文4.2.2f】禁止在被采集人身体明显不适状态下采集
4、√ 【原文5.1.3】质量检测过程不得改变原始声纹数据
5、× 【原文6.4.2c】身份库语音质量需达到等级2或等级3,二者均为合规强制要求
夜雨聆风