logo of aligenie

智能互联通义实验室-语音合成与音频生成大模型算法专家-通义百聆

社招全职3年以上技术类-算法地点:北京 | 杭州状态:招聘

任职要求


1.计算机科学、人工智能、电子工程、应用数学等相关专业硕士及以上学历。
2.具备扎实的机器学习深度学习理论基础,精通语音生成相关技术。
3.熟练至少一种大模型训练框架(Deepspeed, Megatron),有大模型训练经验。
4.…
登录查看完整任职要求
微信扫码,1秒登录

工作职责


1.参与前沿语音生成大模型的研发,涵盖数据体系设计、模型架构设计、训练优化等。
2.探索语音合成、声学建模、自然语言处理等多模态融合技术,提升模型在语音质量、自然度及逻辑推理能力上的表现。
3.针对实际应用场景(音色克隆、情感控制等)优化模型效果和性能,解决复杂技术难题。
包括英文材料
学历+
机器学习+
深度学习+
大模型+
DeepSpeed+
还有更多 •••
相关职位

logo of tongyi
社招3年以上技术类-算法

1.参与前沿语音生成大模型的研发,涵盖数据体系设计、模型架构设计、训练优化等。 2.探索语音合成、声学建模、自然语言处理等多模态融合技术,提升模型在语音质量、自然度及逻辑推理能力上的表现。 3.针对实际应用场景(音色克隆、情感控制等)优化模型效果和性能,解决复杂技术难题。

更新于 2026-04-02北京|杭州
logo of tongyi
社招2年以上技术类-算法

1. 负责语音识别和语音对话大模型的算法研发与优化,包括声学模型、LLM模型和解码器等,探索新的算法架构,建设高效率、低时延的语音应用系统。 2. 结合业务需求,持续改进现有模型的性能,确保其在不同应用场景下的准确性和鲁棒性,提升语音助手和语音智能体用户体验。 3. 构建和管理大规模语音识别和语音对话语料库,用于训练、验证和测试模型。 4. 跟踪前沿技术和研究动态,提出新颖的算法思路和解决方案。

更新于 2026-01-19北京|杭州
logo of tongyi
社招3年以上技术类-算法

1. 负责语音合成、语音识别、端到端语音交互大模型算法的基础研究和应用落地。 2. 参与语音合成与识别技术在业务场景落地,解决落地过程中的前沿问题,持续优化语音合成与识别核心技术效果。 3. 深入调研和关注音频/NLP/多模态/全模态等方向的前沿技术,持续探索语音技术的新能力和新应用。

更新于 2026-02-11北京|杭州
logo of tongyi
社招3年以上技术类-算法

1. 负责通义实验室语音团队的语音处理算法研发,通过深入理解全链路技术挑战和推动语音前后端协作,不限于语音增强、回声消除、麦克风阵列(波束形成、声源定位等)、语音唤醒、多模检测、轻量化ASR/TTS/LLM等任务,打造行业领先的语音处理算法。 2. 持续关注行业前沿动态,通过专利申请、论文和技术报告等形式提升团队的技术影响力。

更新于 2025-12-05北京|杭州