微信-语音识别算法工程师
Tencent Technology (Shenzhen) Co., Ltd.
北京Posted Aug 11, 2026via generic-json
1.负责语音识别模型的研发与优化,重点建设低延迟、高准确率的流式语音识别能力,支持实时对话、按住说话、语音助手等场景;
2.负责流式 ASR 模型架构、训练和解码策略优化,包括 Streaming Conformer、CTC、Transducer、Attention 等技术方向;
3.负责语音理解模型研发,提升模型对语义上下文、用户意图、实体、热词及多轮对话信息的理解和利用能力;
4.负责热词和上下文增强能力建设,包括通讯录、人名、地名、应用名称、业务词汇及动态热词召回;
5.负责中英混说、方言、口音、噪声、远场、重叠语音、轻声及非标准表达等复杂场景的识别优化;
6.负责端点检测、流式上屏、结果稳定、标点预测、文本规整及上下文纠错等链路优化;
7.负责大规模语音数据清洗、伪标注、难例挖掘和数据配比,持续提升模型泛化能力;
8.建立语音识别与语音理解评测体系,推动模型训练、推理优化和产品上线。
Source URL: http://careers.tencent.com/jobdesc.html?postId=2064981110395420672