快手音频美学专家-【可灵AI专项】
社招全职3-5年J0012地点:北京状态:招聘
工作描述
任职要求
1、优先条件,有音频生成、语音合成等相关大模型数据构建与处理经验者优先,在多模态大模型音频相关数据工作方面有实践经验者优先,了解音视频生成模型产品(如Seedance、Kling等),对产品功能与生成效果有一定认知,能将产品视角纳入标准制定与质量评估者优先;
2、专业背景,本科及以上学历,声学、声音设计、音乐制作、影视声音设计等相关专业背景,声学及声音设计方向优先,具备扎实的理论功底,对音频技术体系有系统性认知;
3、专业技能,对音频美学、声音风格有敏锐的洞察力和深刻的理解,熟悉不同类型声音作品的设计手法,具备深厚且可阐释的音频审美能力,能够以客观、结构化、量化的方式描述音频质量的好坏,可精准区分音乐曲风、音效类型、声音设计手法及人声音色特征,不依赖模糊的感性判断,了解AI音频处理相关技术,熟悉数据标注流程和工具;
4…登录查看完整工作描述
微信扫码,1秒登录
包括英文材料
语音合成+
https://www.ibm.com/think/topics/text-to-speech
Text to speech (TTS) is a type of technology that converts text on a digital interface into natural-sounding audio.
还有更多 •••
相关职位
实习艺术/设计
我们希望你具备以下条件: 1、热爱游戏,关注游戏音频,对声音敏锐; 2、具备良好的声学与数字音频理论知识,了解常见效果器的基本原理; 3、掌握数字录音工艺与相关设备操作; 4、精通一款音频工作站,熟练
杭州
社招3-5年多媒体算法
1、3年以上音频编解码领域工作经验,计算机、电子信息、通信、声学等相关专业 2、熟悉AAC/Opus等主流音频编码器内核原理,有编码器深度改造或系统性调优经验 3、在语音编解码(实时低码率/AEC/降
更新于 2026-06-09北京|深圳|上海
社招3年以上引擎
1、本科及以上学历,计算机/信号处理/声学/电子信息等相关专业,3年及以上音频算法研发经验; 2、精通音频信号处理理论,有音效算法实际研发经验;有直播连麦音频算法经验者优先; 3、熟练掌握 Tenso
更新于 2026-06-09北京|上海