百度语音唤醒算法工程师(J69541)
任职要求
-熟悉深度学习,有唤醒和语音识别经验加分 -编程能力强,至少熟练…
工作职责
-跟踪kws前沿相关技术 -负责定制唤醒、自定义唤醒等技术研发和业务支持 -负责声源定位技术的研发和业务支持 -负责AEC技术的研发和业务支持
各类小米智能硬件上“小爱同学”的语音唤醒体验 -线上数据捞取/分析,提炼出关键算法问题并跟进优化 -关注用户体验,基于用户反馈和其他渠道,关注真实场景/行为等因素分析,聚焦语音唤醒体验的提升 -行业竞品的调研和分析 1、唤醒业务线上数据运营及分析,协助产研暴露用户侧问题; 2、跟进各渠道体验问题,形成量化结论反馈; 3、关注语音行业发展,竞品动态,深入研究竞品,产出分析报告;
ByteIntern:面向2027届毕业生(2026年9月-2027年8月期间毕业),为符合岗位要求的同学提供转正机会。 团队介绍:Data语音团队致力于语音/音频/音乐相关的AI核心技术研发和产品创新。部门支撑音频和多模态内容从生产、编辑到消费的全流程,赋能内容创作和互动,并以中台形式支持集团多个业务,提供业界前沿的技术能力与解决方案。 1、负责字节跳动豆包语音大模型能力的原子能力后端开发,确保在豆包、剪映、抖音等落地; 2、推进语音、多模态交互大模型最新技术的工程优化和应用落地; 3、大模型分布式推理的架构和优化,在模型高速迭代的过程中,保证架构可扩展、高可用、合理资源利用率; 4、建设输出创新能力提升豆包、剪映、抖音等产品语音交互和智能创作体验。

第四范式是中国智能决策市场的最大参与者。公司致力于实现企业级人工智能快速规模化落地,为企业提供以“决策型AI”、“生成式AI”为核心的技术、产品及解决方案,推动传统企业的数字化转型进程。2023年2月发布自研的多模态大模型产品“式说(4Paradigm SageGPT)”,已积累了数家国内最早的AIGC产业应用。目前已上市,有机会争取股票激励。•负责语音方向的设计和研发,模型的效果优化,包括不限于:参与语音识别、语音合成、声纹识别、语音评测等方向•将语音领域的算法应用于实际场景,解决真实业务问题•将实践中的创新点以Github Repo/Paper/Tech Report等形式开源