京东语音交互基础大模型算法专家
任职要求
1.人工智能、计算机、电子信息、自动化等相关专业硕士、博士学位;
2.在语音交互大模型的一个或多个子方向上具备出色的算法研究能力;
3…工作职责
负责语音交互大模型算法研究(包括不限于语音音频理解大模型、语音生成大模型、语音交互大模型、音视频交互大模型),确保基础大模型在技术指标、应用能力上的行业领先。 1.语音理解、生成、交互等基础大模型的算法跟踪、研究创新; 2.围绕语音交互大模型的配套算法,包括不限于语音音频信号处理、语音降噪增强、音乐歌唱、音效生成、语音唤醒、麦克风阵列等; 3.与文本、视觉大模型等兄弟团队紧密合作,研究原生多模态大模型。
1. 深度参与雷火各旗舰游戏,实时语音交互、语音内容生产、语音创新玩法等场景研发和落地,为玩家创造崭新的互动娱乐体验; 2. 跟踪语音前沿技术,将最新的语音生成大模型、端到端语音大模型等先进技术落地至业务中; 3. 参与语音算法方案的整个生命周期,包括方案设计、算法实现、数据工程、线上服务等全流程。

工作职责: 1.负责 端侧语音交互系统开发,包括语音唤醒、语音识别、语音合成及对话管理模块。 2-参与 座舱系统、小型机器人、IoT 交互设备 的语音服务及场景化交互方案研发。 3-设计并实现 语音服务框架,支持多场景、多模态的交互能力。 4-设计 对话管理引擎(Dialog Manager) 或 多轮对话。 5-与产品、算法、UI/UX 团队紧密协作,实现高效、自然的人机语音交互体验。 6-跟踪行业发展,探索 端云协同语音架构 及 轻量化语音模型 在不同硬件平台的落地应用。 团队沟通能力,能够推动语音交互功能从方案到产品落地。
1、紧跟全球语音交互技术前沿(语音识别ASR、语音合成TTS、自然语言理解NLU、声纹识别等),牵头解决语音交互领域的关键技术难题,如复杂场景下的远场识别、低资源语种适配、情感语音合成、多轮对话意图理解等,突破技术瓶颈,打造行业领先的语音交互技术体系。 2、主导重大语音交互技术研发项目,从需求分析、方案设计、研发实施到测试上线全流程把控,制定项目风险预案,解决项目推进中的关键问题。 3、 推动技术专利布局与学术成果输出,提升公司在行业内的技术影响力,牵头参与行业标准制定,引领语音交互技术发展方向。 4、评估技术商业化潜力,推动技术成果向产品转化,跟踪项目落地后的技术效果与用户反馈,持续迭代优化技术方案,提升语音交互产品的用户体验与市场竞争 5、 对接行业顶尖科研机构、高校及技术合作伙伴,开展产学研合作,引入前沿技术与创新理念;参与行业技术交流与峰会,建立良好的行业技术合作生态。