语音算法工程师
广州
硕士及以上
电子信息类·计算机类
使用简历深度优化功能,快速提升简历质量
职位介绍
1、教育背景:***硕士及以上学历,计算机科学、人工智能、信号与信息处理、电子信息、通信工程等相关专业;
2、扎实的算法基础:熟练掌握Python及PyTorch等深度学习框架,熟悉数字信号处理、语音特征提取及CNN、RNN、Transformer、Conformer等模型架构;
3、熟悉语音识别与语音增强技术,掌握语音活动检测(VAD)、降噪、人声增强、回声消除、声源分离等算法,具备复杂噪声或远场语音处理经验者优先;
4、熟悉主流ASR模型及开源框架,如Whisper、FunASR、Kaldi等,了解流式识别、热词增强、领域词表适配、语言模型融合及识别结果纠错;
5、在以下至少一个方向具有实际项目或研究经验:语音增强、端到端ASR训练或微调、说话人识别与分离、专业术语及设备编号识别、流式语音识别与低延迟部署;
6、具备一定的自然语言处理能力,熟悉文本纠错、实体识别、语义解析、文本相似度等技术,能够支持唱票与复诵内容的一致性校核、漏读和跳步识别;
7、具备较强的工程实现能力,熟悉Linux、Docker、音频流处理及算法服务化部署,有ONNX Runtime、TensorRT或GPU推理优化经验者优先;
8、具有清晰的目标意识,能够主动理解业务需求,针对现场噪声、术语误识别、设备编号混淆等问题开展分析与优化,推动任务高质量交付。

