
商汤语音交互开发工程师
社招全职3年以上技术开发类地点:上海状态:招聘
任职要求
岗位要求: 1.计算机、电子、自动化、通信等相关专业,本科及以上学历,3 年以上语音/音频相关开发经验。 2.熟悉 对话管理、语音服务框架设计,具备实际项目经验。 3.精通 音频采集与播放链路,熟悉 ALSA、AudioFlinger、AudioTrack、OpenSL ES 等音频框架。 4.熟悉 端侧 ASR/TTS 引擎部署(如 Kaldi、WeNet…
登录查看完整任职要求
微信扫码,1秒登录
工作职责
工作职责: 1.负责 端侧语音交互系统开发,包括语音唤醒、语音识别、语音合成及对话管理模块。 2-参与 座舱系统、小型机器人、IoT 交互设备 的语音服务及场景化交互方案研发。 3-设计并实现 语音服务框架,支持多场景、多模态的交互能力。 4-设计 对话管理引擎(Dialog Manager) 或 多轮对话。 5-与产品、算法、UI/UX 团队紧密协作,实现高效、自然的人机语音交互体验。 6-跟踪行业发展,探索 端云协同语音架构 及 轻量化语音模型 在不同硬件平台的落地应用。 团队沟通能力,能够推动语音交互功能从方案到产品落地。
包括英文材料
学历+
ElasticSearch+
https://www.youtube.com/watch?v=a4HBKEda_F8
Learn about Elasticsearch with this comprehensive course designed for beginners, featuring both theoretical concepts and hands-on applications using Python (though applicable to any programming language). The course is structured in two parts: first covering essential Elasticsearch fundamentals including index management, document storage, text analysis, pipeline creation, search functionality, and advanced features like semantic search and embeddings; followed by a practical section where you'll build a real-world website using Elasticsearch as a search engine, working with the Astronomy Picture of the Day (APOD) dataset to implement features such as data cleaning pipelines, tokenization, pagination, and aggregations.
语音识别+
https://developer.nvidia.com/blog/essential-guide-to-automatic-speech-recognition-technology/
Over the past decade, AI-powered speech recognition systems have slowly become part of our everyday lives, from voice search to virtual assistants in contact centers, cars, hospitals, and restaurants.
语音合成+
https://www.ibm.com/think/topics/text-to-speech
Text to speech (TTS) is a type of technology that converts text on a digital interface into natural-sounding audio.
系统设计+
https://roadmap.sh/system-design
Everything you need to know about designing large scale systems.
https://www.youtube.com/watch?v=F2FmTdLtb_4
This complete system design tutorial covers scalability, reliability, data handling, and high-level architecture with clear explanations, real-world examples, and practical strategies.
大模型+
https://www.youtube.com/watch?v=xZDB1naRUlk
You will build projects with LLMs that will enable you to create dynamic interfaces, interact with vast amounts of text data, and even empower LLMs with the capability to browse the internet for research papers.
https://www.youtube.com/watch?v=zjkBMFhNj_g
还有更多 •••
相关职位
实习人工智能
1. 深度参与雷火各旗舰游戏,实时语音交互、语音内容生产、语音创新玩法等场景研发和落地,为玩家创造崭新的互动娱乐体验; 2. 跟踪语音前沿技术,将最新的语音生成大模型、端到端语音大模型等先进技术落地至业务中; 3. 参与语音算法方案的整个生命周期,包括方案设计、算法实现、数据工程、线上服务等全流程。
杭州
社招算法开发岗
负责语音交互大模型算法研究(包括不限于语音音频理解大模型、语音生成大模型、语音交互大模型、音视频交互大模型),确保基础大模型在技术指标、应用能力上的行业领先。 1.语音理解、生成、交互等基础大模型的算法跟踪、研究创新; 2.围绕语音交互大模型的配套算法,包括不限于语音音频信号处理、语音降噪增强、音乐歌唱、音效生成、语音唤醒、麦克风阵列等; 3.与文本、视觉大模型等兄弟团队紧密合作,研究原生多模态大模型。
更新于 2025-12-11北京
社招10年以上研发类
1、紧跟全球语音交互技术前沿(语音识别ASR、语音合成TTS、自然语言理解NLU、声纹识别等),牵头解决语音交互领域的关键技术难题,如复杂场景下的远场识别、低资源语种适配、情感语音合成、多轮对话意图理解等,突破技术瓶颈,打造行业领先的语音交互技术体系。 2、主导重大语音交互技术研发项目,从需求分析、方案设计、研发实施到测试上线全流程把控,制定项目风险预案,解决项目推进中的关键问题。 3、 推动技术专利布局与学术成果输出,提升公司在行业内的技术影响力,牵头参与行业标准制定,引领语音交互技术发展方向。 4、评估技术商业化潜力,推动技术成果向产品转化,跟踪项目落地后的技术效果与用户反馈,持续迭代优化技术方案,提升语音交互产品的用户体验与市场竞争 5、 对接行业顶尖科研机构、高校及技术合作伙伴,开展产学研合作,引入前沿技术与创新理念;参与行业技术交流与峰会,建立良好的行业技术合作生态。
更新于 2026-01-09南京|上海