腾讯腾讯云--- 音频语音识别/理解算法高级工程师
社招全职3年以上CSIG技术地点:深圳状态:招聘
任职要求
1.硕士及以上学历,声学、信号处理等其他相关专业; 2.对于音频处理领域与背景有深刻理解,具备一定声学信号处理数学建模能力,对于大模型llm量化与训练经验、特定人声增强、端到端多语种语音识别、轻量级端侧高效语音识别、个性化声纹情绪等语音合成有实际项目,且参加过相关比赛的同学优先; 3.在W…
登录查看完整任职要求
微信扫码,1秒登录
工作职责
1.负责语音识别ASR应用涉及的效果调优与实现,比如多语种语音识别与翻译(中/英/法/日/韩/东南亚/中东等)、端侧超级轻量级高效ASR的落地实现、解决目标说话人增强的ASR相关技术的落地、声学/语意vad等; 2.负责语音识别asr-llm大模型与前沿技术调研与落地,比如更合理的语音与文本对齐、适用于多语种的模型方案、更高效的弱监督数据筛选流程等; 3.负责跟踪并复现业界最前沿的音频处理方案,并能融合优化当前效果。
包括英文材料
学历+
大模型+
https://www.youtube.com/watch?v=xZDB1naRUlk
You will build projects with LLMs that will enable you to create dynamic interfaces, interact with vast amounts of text data, and even empower LLMs with the capability to browse the internet for research papers.
https://www.youtube.com/watch?v=zjkBMFhNj_g
语音识别+
https://developer.nvidia.com/blog/essential-guide-to-automatic-speech-recognition-technology/
Over the past decade, AI-powered speech recognition systems have slowly become part of our everyday lives, from voice search to virtual assistants in contact centers, cars, hospitals, and restaurants.
语音合成+
https://www.ibm.com/think/topics/text-to-speech
Text to speech (TTS) is a type of technology that converts text on a digital interface into natural-sounding audio.
还有更多 •••
相关职位

社招3年以上音频类
1、负责项目组内语音模块管线,主导游戏台本的配音方向及整体语音效果。 2、负责与配音导演、文案、策划、本地化翻译、引擎工具组等进行语音管线的需求对接。 3、负责组织语音模块的整体设计、录音安排、外包审核校对与最终效果落地。 4、负责语音的后期处理、引擎内集成和debug。 5、负责角色的语音表现设计。
更新于 2026-02-05上海
社招3-5年J0011
1、负责语音、音频和音乐相关算法的研究与开发,包括但不限于语音识别与合成、语音降噪/分离、音频分类、音乐识别等方向; 2、负责跟进行业前沿技术发展趋势,跟踪国际最新技术发展方向; 3、探索语音/音频/音乐技术落地新玩法,在音频AI理解和生成等方向进行业务创新。
更新于 2026-06-09北京|深圳
社招3-5年基础后端
工作职责 1. 负责小红书端侧音频采集与前处理模块的设计与开发,解决启动耗时、首包延迟、音质一致性等问题 2. 负责端侧音频数据的实时/准实时流式传输方案设计,与后端、算法团队协作完成低延迟语音输入链路 3. 定位并解决复杂场景下的音频问题,如多 App 竞争音频焦点、系统限制、机型差异、异常场景恢复等
更新于 2026-04-08北京|上海|广州