logo of tencent

腾讯腾讯云--- 音频语音识别/理解算法高级工程师

社招全职3年以上CSIG技术地点:深圳状态:招聘

任职要求


1.硕士及以上学历,声学、信号处理等其他相关专业;
2.对于音频处理领域与背景有深刻理解,具备一定声学信号处理数学建模能力,对于大模型llm量化与训练经验、特定人声增强、端到端多语种语音识别、轻量级端侧高效语音识别、个性化声纹情绪等语音合成有实际项目,且参加过相关比赛的同学优先;
3.在W…
登录查看完整任职要求
微信扫码,1秒登录

工作职责


1.负责语音识别ASR应用涉及的效果调优与实现,比如多语种语音识别与翻译(中/英/法/日/韩/东南亚/中东等)、端侧超级轻量级高效ASR的落地实现、解决目标说话人增强的ASR相关技术的落地、声学/语意vad等;
2.负责语音识别asr-llm大模型与前沿技术调研与落地,比如更合理的语音与文本对齐、适用于多语种的模型方案、更高效的弱监督数据筛选流程等;
3.负责跟踪并复现业界最前沿的音频处理方案,并能融合优化当前效果。
包括英文材料
学历+
大模型+
语音识别+
语音合成+
还有更多 •••
相关职位

logo of papergames
社招3年以上音频类

1、负责项目组内语音模块管线,主导游戏台本的配音方向及整体语音效果。 2、负责与配音导演、文案、策划、本地化翻译、引擎工具组等进行语音管线的需求对接。 3、负责组织语音模块的整体设计、录音安排、外包审核校对与最终效果落地。 4、负责语音的后期处理、引擎内集成和debug。 5、负责角色的语音表现设计。

更新于 2026-02-05上海
logo of kuaishou
社招3-5年J0011

1、负责语音、音频和音乐相关算法的研究与开发,包括但不限于语音识别与合成、语音降噪/分离、音频分类、音乐识别等方向; 2、负责跟进行业前沿技术发展趋势,跟踪国际最新技术发展方向; 3、探索语音/音频/音乐技术落地新玩法,在音频AI理解和生成等方向进行业务创新。

更新于 2026-06-09北京|深圳
logo of xiaohongshu
社招3-5年基础后端

工作职责 1. 负责小红书端侧音频采集与前处理模块的设计与开发,解决启动耗时、首包延迟、音质一致性等问题 2. 负责端侧音频数据的实时/准实时流式传输方案设计,与后端、算法团队协作完成低延迟语音输入链路 3. 定位并解决复杂场景下的音频问题,如多 App 竞争音频焦点、系统限制、机型差异、异常场景恢复等

更新于 2026-04-08北京|上海|广州
logo of tongyi
社招3年以上技术类-算法

1.参与前沿语音生成大模型的研发,涵盖数据体系设计、模型架构设计、训练优化等。 2.探索语音合成、声学建模、自然语言处理等多模态融合技术,提升模型在语音质量、自然度及逻辑推理能力上的表现。 3.针对实际应用场景(音色克隆、情感控制等)优化模型效果和性能,解决复杂技术难题。

更新于 2026-07-29北京|杭州