logo of quark

千问算法实习生-AIGC多模态生成大模型(研究型)

实习兼职日常实习生地点:杭州 | 上海状态:招聘

任职要求


1. 计算机科学、人工智能、机器学习或相关专业,硕士及以上学历优先;
2. 精通Python编程,熟悉Linux开发环境,具备PyTorch等框架的底层优化经验,能高效实现论文复现及模型改进;
加分项:
1. 在以下领域有系统性研究经验:扩散模型、视频生成模型、多模态对齐技术,熟悉HuggingFa…
登录查看完整任职要求
微信扫码,1秒登录

工作职责


1. 主导或参与图像/视频生成大模型的核心算法研发,聚焦扩散模型及VAE的前沿架构创新优化,完成大规模分布式训练、数据流水线构建及算法工程化部署;
2. 推动视觉生成技术在夸克多产品线的场景化落地,解决实际工程问题,实现从算法原型到工业级系统的端到端优化;
3. 开展前沿算法研究,探索多模态后训练、可控生成及推理加速等方向,保持算法的领先性。
包括英文材料
机器学习+
学历+
Python+
Linux+
PyTorch+
还有更多 •••
相关职位

logo of alibaba
实习阿里巴巴日常实习

我们是国内使用量最大的电商AIGC平台之一。 你将参与到:构建以评测驱动的多模态数据高效处理与迭代机制,融合多模态理解、合成增强等关键技术,打造适用于AI电商场景的高质量融合数据,最终实现“数据-模型-场景”的高效协同闭环,推动新一代AI数据体系的建设。

更新于 2026-03-26杭州
logo of youku
实习虎鲸文娱实习生招

岗位职责: 1. 基于不同的多模态大模型或者视觉生成模型来解决业务所面临的挑战,包括但不限于视频主观质量评价,图像视频超分等。 2. 深入调研和关注视觉模型等方向的前沿技术,将前沿技术在业务上落地。 3. 在视觉感知/视频质量评价/图像视频超分领域做出单点研究突破,发表高质量论文。

更新于 2026-01-21北京
logo of baidu
实习MEG

1. 协助团队进行多模态大模型相关研究,包括高效微调、多模态理解对齐、幻觉消除、强化学习、数据治理部署优化等相关工作 2. 参与项目的算法验证和优化,确保算法的效率和准确性 3. 协助进行文献调研,总结最新的技术趋势和研究进展 4. 参与团队内部的技术交流和分享会议

更新于 2026-03-25北京
logo of transsion
实习

涵盖以下三个子方向: 图像/视频生成方向 1、参与图像生成、视频生成、多模态生成等相关算法研发; 2、跟踪前沿生成式模型,包括但不限于Stable diffusion、DiT、FLUX、Qwen-Image、WAN、Z-Image等算法模型; 3、探索大模型在图像与视频内容生成中的应用与优化方案; 4、参与高质量数据构建、训练策略设计及模型效果优化。 图像/视频编辑方向 1、参与图像编辑、视频编辑、可控生成、指令编辑等相关算法研究; 2、包括但不限于Inpainting、Outpainting、风格迁移、局部编辑、人像美化、多图融合等任务; 3、探索基于多模态大模型(MLLM)的prompt改写方案; 4、优化编辑模型在实际业务场景中的稳定性与泛化能力。 图像/视频复原方向 1、参与图像/视频的增强与复原相关算法研发,包括超分辨率、去噪、去雨、去雪、去模糊、去反光、去阴影、低光增强等任务; 2、研究生成式方法在图像复原中的应用; 3、负责模型训练、调优及实际落地效果提升; 4、推动算法在移动端及工程系统中的部署优化。

更新于 2026-05-27深圳|上海