软件开发岗(音频链路方向)2811开发测试族
北京市、深圳市招聘1人
工作职责
1.负责智能语音产品音频全链路的设计、研发与持续优化,覆盖麦克风采集、音频预处理、编码传输、语音识别输入及交互输出等环节。
2.负责麦克风采集链路、语音前处理及ASR输入质量优化,开展音频质量分析与效果调优,提升系统在远距离、噪声及复杂声学环境下的识别效果和用户体验。
3.负责语音交互工程能力建设,包括语音检测、语音状态管理、交互流程优化、语音输入输出体验优化及音频服务模块开发,推动语音能力在实际业务场景中稳定落地。4.负责音频算法模块的开发、集成与优化,包括回声消除(AEC)、噪声抑制(NS)、自动增益控制(AGC)、波束形成、去混响、音频增强及音质优化,并对开源或商业算法方案进行效果调优。
5.参与音频SDK及跨平台基础能力建设,负责Android、iOS、Linux等终端的音频模块开发和适配,保障语音能力在不同设备及运行环境下的稳定性和一致性。
6.参与实时音视频与通信链路研发,围绕WebRTC、FFmpeg、GStreamer、RTP/RTCP及Opus/AAC等技术开展弱网对抗、编解码、传输稳定性和端到端时延优化。
7.协同算法团队开展ASR效果分析、语音数据分析、问题案例定位、模型输入优化及端到端性能优化,推动语音技术从算法验证走向产品化和规模化应用。
任职要求
1.硕士及以上学历,计算机、人工智能、电子信息、通信工程、信号处理、声学等相关专业。
2.具有三年以上音频、语音、实时通信或智能硬件相关研发经验,并具有实际音频产品的研发、上线和落地经验。
3.熟悉从麦克风采集、音频处理、编码传输、语音识别到音频输出的完整链路,能够定位和解决识别效果下降、环境噪声、回声、音频延迟及音质异常等问题。
4.熟悉VAD、AEC、NS、AGC、波束形成、去混响或音频增强中的一个或多个方向,具有算法调试、参数优化或工程集成经验。
5.熟悉WebRTC、FFmpeg、GStreamer、RTP/RTCP以及Opus、AAC等音视频框架、实时通信协议和音频编解码技术,了解实时音频传输机制。
6.熟练掌握C/C++、Python等开发语言,熟悉Linux开发环境,具备多线程、网络通信、性能优化和良好的代码工程能力。
7.熟悉Android、iOS或Linux平台的音频系统及开发机制,具有音频SDK、跨平台音频模块或实时语音服务开发经验。
8.具有智能语音助手、手机端音频、智能座舱、智能家居、IoT、RTC、在线会议、直播、游戏音频或ASR/TTS系统工程化经验者优先。
夜雨聆风