百度AI语音算法工程师(J84569)
任职要求
-计算机科学、电子工程、信号处理或相关专业本科及以上学历,具有扎实的数学基础和编程能力 -熟悉语音信号处理、语音识别、语音合成等基本原理和算法 -熟练掌握C/C++、Python等编程语言,熟悉Linux操作系统和常用开发工具; -了解常用的语音算法库和工具,如K…
工作职责
-负责语音信号处理算法的研究、设计、开发和优化,包括但不限于特征提取、降噪、回声消除等 -参与语音识别算法的研发,提高识别准确率和识别速度 -负责语音合成算法的开发,优化语音生成的音质和流畅度 -跟踪语音技术领域的最新动态,研究新技术和新算法,为公司技术储备提供支持 -与其他技术栈紧密合作,确保语音算法在公司产品中的有效应用 -编写相关技术文档,包括算法设计文档、测试报告、使用说明等
-负责语音信号处理算法的研究、设计、开发和优化,包括但不限于特征提取、降噪、回声消除等 -参与语音识别算法的研发,提高识别准确率和识别速度 -负责语音合成算法的开发,优化语音生成的音质和流畅度 -跟踪语音技术领域的最新动态,研究新技术和新算法,为公司技术储备提供支持 -与其他技术栈紧密合作,确保语音算法在公司产品中的有效应用 -编写相关技术文档,包括算法设计文档、测试报告、使用说明等
团队介绍: 高德语音技术部,是负责高德全栈语音技术的综合性团队。团队核心技术能力包括:自研TTS基座大模型、端侧模型、多语种、RTC流式语音、语音内容生成、语音识别、跨模态模型、模型服务与推理。业务支撑面向高德全部核心场景,包括语音导航、AI领航员、IP语音定制、国际化、AI语音助手、智能外呼、内容生成等。 团队定位是通过前沿语音技术的研究和落地,赋能下一代AI产品创新。近期部分技术(https://arxiv.org/abs/2507.12197)和产品进展介绍(https://mp.weixin.qq.com/s/cCeHbNW0jbC_LNVPZlGeHg) 具体职责包括但不限于: 1、语音识别、唤醒、语音与大模型融合等语音模块的研发,独立研究并完成业务落地; 2、结合高德出行导航、语音交互等业务场景,不断完善提升复杂业务场景下的语音理解能力。 3、与产品、工程架构团队一起完成技术方案的部署上线与性能优化,实现价值闭环。 4、持续追踪跟进业界前沿先进语音技术,结合业务需求开展技术创新与预研。
岗位描述: 1、负责语音增强相关算法的研究、仿真和开发工作,包括但不限于麦克风阵列、回声消除、噪声抑制、端点检测等; 2、负责语音增强深度学习方向的技术研究及落地,结合传统信号处理优化复杂场景下的语音增强效果,提升AI语音产品的交互质量及用户体验; 3、负责将语音增强算法应用到手机终端,优化算法效果、计算性能、内存、功耗等指标; 4、探索语音增强技术前沿领域知识,跟进国际顶级学术界成果和工业界项目。