
智能互联AI创新事业部-多模态算法专家/高级专家(理解与生成)-未来生活实验室
任职要求
1. 自然语言处理、机器学习、数据挖掘、人工智能等相关专业的硕士生/博士生; 2. 熟练掌握Tensorflow、Pytorch等深度学习框架,扎实的编程基础,具备独立的算法实现能力; 3. 有LLM实操经验,参与过大模型…
工作职责
1. 多模态理解:负责图文/视频/音频理解相关的算法研发,提升模型对复杂多模态场景的语义分析和推理能力。 2. 多模态生成:开发基于 Diffusion Model 或 Autoregressive 架构的生成算法(如 Text-to-Image, Text-to-Video),优化生成的质量、多样性与可控性。 3. 统一架构:设计并研发多模态大模型理解和生成的统一架构,通过高效Transformer结构、位置编码优化等,实现对图像、视频、文本的深度语义理解与高保真内容生成。
1. 多模态理解:负责图文/视频/音频理解相关的算法研发,提升模型对复杂多模态场景的语义分析和推理能力。 2. 多模态生成:开发基于 Diffusion Model 或 Autoregressive 架构的生成算法(如 Text-to-Image, Text-to-Video),优化生成的质量、多样性与可控性。 3. 统一架构:设计并研发多模态大模型理解和生成的统一架构,通过高效Transformer结构、位置编码优化等,实现对图像、视频、文本的深度语义理解与高保真内容生成。
1. 多模态理解:负责图文/视频/音频理解相关的算法研发,提升模型对复杂多模态场景的语义分析和推理能力。 2. 多模态生成:开发基于 Diffusion Model 或 Autoregressive 架构的生成算法(如 Text-to-Image, Text-to-Video),优化生成的质量、多样性与可控性。 3. 统一架构:设计并研发多模态大模型理解和生成的统一架构,通过高效Transformer结构、位置编码优化等,实现对图像、视频、文本的深度语义理解与高保真内容生成。

1. 大模型数据体系建设:负责多模态(图/影/文)全链路数据工程,涵盖接入、清洗过滤、模态对齐、采样配比及版本管理。 2. 自动化流水线:设计并落地高并发数据处理 Pipeline,提升数据产出效率、稳定性与实验可复现性。 3. 质量评估与监控:建立多维度数据质量指标(如时序一致性、模态对齐度、噪声率等),构建自动化 QA 与健康度监控看板。 4. 数据策略优化:针对模型训练目标制定数据策略,包括难例挖掘、长尾补齐、负样本构造及数据混配,通过实验驱动模型收益。 5. 闭环迭代:协同模型与业务团队,针对 Bad Case 定位数据问题,打通“数据-训练-评估-回流”的闭环迭代。