logo of aligenie

智能互联AI创新事业部-多模态大模型数据评测专家-未来生活实验室

社招全职3年以上技术类-综合地点:北京 | 杭州状态:招聘

任职要求


1、本科及以上学历,影视、编导、美学设计等相关专业优先;
2、具有2年及以上大模型项目经验,作为多模态大模型的深度用户,对文生图,文生视频大模型有丰富的实际操作经验,能提供对应的AIGC生图/生视频的作品优先;
3、有较好的美学…
登录查看完整任职要求
微信扫码,1秒登录

工作职责


评测体系建设
深入理解公司 AI 产品业务场景,结合多模态大模型技术发展趋势,设计并持续完善模型评测体系,包括评测维度、指标定义、评测流程与方法论,确保评测结果能够客观反映模型能力变化与关键问题。

数据与评测标准建设
负责多模态大模型训练与评测数据的质量体系建设,包括数据标注规范制定、评测标准设计及数据集构建与优化,沉淀高质量数据资产,为模型训练与评测提供可靠基础。

模型评测与效果分析
联合产品与算法团队开展离线评测、场景评测及对比评测,系统分析模型表现与能力边界,输出结构化评测报告,支持模型迭代与产品优化。

评测场景与Benchmark构建
围绕核心业务场景构建评测任务与Benchmark体系,持续扩展评测覆盖范围,确保评测体系能够真实反映用户场景与模型能力。

数据驱动的优化闭环与行业对标
与算法、产品和数据团队协作,通过评测定位模型问题并推动数据补充与模型优化,建立“评测—分析—优化—复评”的迭代闭环,同时持续跟踪行业评测方法与Benchmark,优化内部评测框架。
包括英文材料
学历+
大模型+
AIGC+
还有更多 •••
相关职位

logo of alibaba
社招3年以上技术类-综合

1、评测体系建设 深入理解公司 AI 产品业务场景,结合多模态大模型技术发展趋势,设计并持续完善模型评测体系,包括评测维度、指标定义、评测流程与方法论,确保评测结果能够客观反映模型能力变化与关键问题。 2、数据与评测标准建设 负责多模态大模型训练与评测数据的质量体系建设,包括数据标注规范制定、评测标准设计及数据集构建与优化,沉淀高质量数据资产,为模型训练与评测提供可靠基础。 3、模型评测与效果分析 联合产品与算法团队开展离线评测、场景评测及对比评测,系统分析模型表现与能力边界,输出结构化评测报告,支持模型迭代与产品优化。 4、评测场景与Benchmark构建 围绕核心业务场景构建评测任务与Benchmark体系,持续扩展评测覆盖范围,确保评测体系能够真实反映用户场景与模型能力。 5、数据驱动的优化闭环与行业对标 与算法、产品和数据团队协作,通过评测定位模型问题并推动数据补充与模型优化,建立“评测—分析—优化—复评”的迭代闭环,同时持续跟踪行业评测方法与Benchmark,优化内部评测框架。

更新于 2026-06-02北京|杭州
logo of tongyi
社招3年以上技术类-综合

1、评测体系建设 深入理解公司 AI 产品业务场景,结合多模态大模型技术发展趋势,设计并持续完善模型评测体系,包括评测维度、指标定义、评测流程与方法论,确保评测结果能够客观反映模型能力变化与关键问题。 2、数据与评测标准建设 负责多模态大模型训练与评测数据的质量体系建设,包括数据标注规范制定、评测标准设计及数据集构建与优化,沉淀高质量数据资产,为模型训练与评测提供可靠基础。 3、模型评测与效果分析 联合产品与算法团队开展离线评测、场景评测及对比评测,系统分析模型表现与能力边界,输出结构化评测报告,支持模型迭代与产品优化。 4、评测场景与Benchmark构建 围绕核心业务场景构建评测任务与Benchmark体系,持续扩展评测覆盖范围,确保评测体系能够真实反映用户场景与模型能力。 5、数据驱动的优化闭环与行业对标 与算法、产品和数据团队协作,通过评测定位模型问题并推动数据补充与模型优化,建立“评测—分析—优化—复评”的迭代闭环,同时持续跟踪行业评测方法与Benchmark,优化内部评测框架。

更新于 2026-07-03北京|杭州
logo of alibaba
社招3年以上技术类-算法

1. 负责音频生成大模型研发(文生音频、音频编辑、音色克隆、音效合成等),产出高保真、可控的生成方案并推动落地; 2. 研发音频理解大模型,构建跨模态(文本、图像、视频与音频联合)的细粒度音频内容描述体系; 3. 搭建大规模多源通用音频数据集(音乐、语音、环境声等),支撑模型持续迭代; 4. 推动音频大模型在业务场景中落地,解决推理效率、可控性、实时性等工程问题; 5. 跟进行业前沿,保持团队在通用音频大模型领域的技术领先。

更新于 2026-06-15北京|杭州
logo of tongyi
社招3年以上技术类-算法

1. 多模态理解:负责图文/视频/音频理解相关的算法研发,提升模型对复杂多模态场景的语义分析和推理能力。 2. 多模态生成:开发基于 Diffusion Model 或 Autoregressive 架构的生成算法(如 Text-to-Image, Text-to-Video),优化生成的质量、多样性与可控性。 3. 统一架构:设计并研发多模态大模型理解和生成的统一架构,通过高效Transformer结构、位置编码优化等,实现对图像、视频、文本的深度语义理解与高保真内容生成。

更新于 2026-06-23北京|杭州