
智能互联AI创新事业部-语音大模型数据评测专家-未来生活实验室
任职要求
1、本科及以上学历,3年以上互联网产品/运营或大模型数据运营、模型评测经验(语音经验优先),语言类&计算机交叉类专业优先(例如:计算语言学、语言智能、数字语言学); 2、对大模型、数据、评测有深刻的理解和认知,具备独立构建评测标准和评测题…
工作职责
1、搭建具有通用性和可拓展性的语音大模型数据标注和模型评测框架(NLP、TTS、ASR等方向),与算法团队对齐标准、撰写相关培训方案,根据模型迭代方向提供高质量数据,对自动化链路搭建、数据质量评估及外部资源管理负责; 2、结合行业趋势及业务应用场景,迭代更新评测标准、构建评测题库,负责语音大模型效果评测,定期反馈评估结果,产出评估报告,确保大模型评估结果置信; 3、通过PE、代码、Workflow、Agent完成数据预处理、分析和清洗,按照训练需求进行标注、分析和验证调优,提升模型效果; 4、与产品算法团队协同,积极探索自动化数据生产/模型评估、数据合成等方法,提高数据标注/评测效率,持续跟踪大模型技术进展,持续探索智能高效的数据生产模式。
1、搭建具有通用性和可拓展性的语音大模型数据标注和模型评测框架(NLP、TTS、ASR等方向),与算法团队对齐标准、撰写相关培训方案,根据模型迭代方向提供高质量数据,对自动化链路搭建、数据质量评估及外部资源管理负责; 2、结合行业趋势及业务应用场景,迭代更新评测标准、构建评测题库,负责语音大模型效果评测,定期反馈评估结果,产出评估报告,确保大模型评估结果置信; 3、通过PE、代码、Workflow、Agent完成数据预处理、分析和清洗,按照训练需求进行标注、分析和验证调优,提升模型效果; 4、与产品算法团队协同,积极探索自动化数据生产/模型评估、数据合成等方法,提高数据标注/评测效率,持续跟踪大模型技术进展,持续探索智能高效的数据生产模式。
1、搭建具有通用性和可拓展性的语音大模型数据标注和模型评测框架(NLP、TTS、ASR等方向),与算法团队对齐标准、撰写相关培训方案,根据模型迭代方向提供高质量数据,对自动化链路搭建、数据质量评估及外部资源管理负责; 2、结合行业趋势及业务应用场景,迭代更新评测标准、构建评测题库,负责语音大模型效果评测,定期反馈评估结果,产出评估报告,确保大模型评估结果置信; 3、通过PE、代码、Workflow、Agent完成数据预处理、分析和清洗,按照训练需求进行标注、分析和验证调优,提升模型效果; 4、与产品算法团队协同,积极探索自动化数据生产/模型评估、数据合成等方法,提高数据标注/评测效率,持续跟踪大模型技术进展,持续探索智能高效的数据生产模式。
1. 多模态理解:负责图文/视频/音频理解相关的算法研发,提升模型对复杂多模态场景的语义分析和推理能力。 2. 多模态生成:开发基于 Diffusion Model 或 Autoregressive 架构的生成算法(如 Text-to-Image, Text-to-Video),优化生成的质量、多样性与可控性。 3. 统一架构:设计并研发多模态大模型理解和生成的统一架构,通过高效Transformer结构、位置编码优化等,实现对图像、视频、文本的深度语义理解与高保真内容生成。
我们是一个专注于AI Coding方向的充满活力和创业精神的创新业务团队,致力于通过智能化代码生成和开发工具重新定义软件开发体验。随着AI Agent技术的快速发展,我们正在寻找优秀的AI Agent研发工程师加入团队,共同构建下一代智能编程助手和自主代码开发系统,一起在AI驱动的编程革命中创造历史! 1、参与设计、开发和实现AI Agent,构建具备代码理解、生成、调试和优化能力的自主编程代理系统,并能适应特定用例和环境; 2、从事AI领域相关算法研究及算法的工程化实现,以提升Agent能力(推理、规划、记忆、工具使用); 3、设计和实现高效的AI算法,为代码自动生成、智能补全、bug检测等场景提供技术支撑; 4、参与设计多智能体协作架构,实现复杂编程任务拆解与分布式执行,提升AI Coding的质量及效率; 5、持续跟踪AI Agent、大模型、代码生成等前沿技术发展,推动团队技术水平提升。