千问千问事业部-千问-多模态内容理解算法专家-杭州
任职要求
1. 计算机/数学/统计等相关专业硕士及以上学历,3年以上相关工作经验。 2. 熟练掌握以 Python 为主的算法研发技术栈,具备良好的工程化落地能力;熟悉主流深度学习与大模型开发工具链(如 PyTorch、Transformers 生态、分布式训练/推理与部署 等)。 3. 具备多模态大模型实践经验(如…
工作职责
参与千问统一内容库与多模态内容理解能力建设,沉淀可复用的内容资产,支撑多场景内容供给与使用,包括但不限于: 1. 参与建设面向多个业务场景的视频/笔记库,打通内容同步与分发链路,保障数据一致性与时效性。 2. 基于多模态大模型构建内容理解与打标能力,完善多维度标签体系,覆盖关键词/hashtag/话题/品类/兴趣点/创作者特征等。 3. 建设线索驱动的数据发现收录、圈选与下发能力,支撑跨场景复用,持续扩充优质供给并提升覆盖。 4. 建立内容质量评估与治理机制(低质/重复等),持续提升数据质量与可用性。

参与千问统一内容库与多模态内容理解能力建设,沉淀可复用的内容资产,支撑多场景内容供给与使用,包括但不限于: 1. 参与建设面向多个业务场景的视频/笔记库,打通内容同步与分发链路,保障数据一致性与时效性。 2. 基于多模态大模型构建内容理解与打标能力,完善多维度标签体系,覆盖关键词/hashtag/话题/品类/兴趣点/创作者特征等。 3. 建设线索驱动的数据发现收录、圈选与下发能力,支撑跨场景复用,持续扩充优质供给并提升覆盖。 4. 建立内容质量评估与治理机制(低质/重复等),持续提升数据质量与可用性。
千问多模态推理算法致力于使用AI在Agentic、stem等方向的效果提升。在这里您将与我们一起挑战前沿的产品技术问题,并收获服务千万级用户的成就感和影响力。 1. 负责面向推理的多模态大模型研发,包括图文、视频、音频等多个模态的预训练,探索多模态的数据质量评估和清洗方法; 2. 负责对模型的训练数据、训练策略、模型结构等进行深入分析。 3. 负责强化学习算法研发、提升训练稳定性、采样效率、训练效果。 4. 负责跟踪和研究多模态大模型前沿技术调研、落地、对业务进行优化; 5. 负责对各业务场景下相关技术问题进行分析、算法设计、研发以及推动上线,提升业务效果;

千问多模态推理算法致力于使用AI在Agentic、stem等方向的效果提升。在这里您将与我们一起挑战前沿的产品技术问题,并收获服务千万级用户的成就感和影响力。 1. 负责面向推理的多模态大模型研发,包括图文、视频、音频等多个模态的预训练,探索多模态的数据质量评估和清洗方法; 2. 负责对模型的训练数据、训练策略、模型结构等进行深入分析。 3. 负责强化学习算法研发、提升训练稳定性、采样效率、训练效果。 4. 负责跟踪和研究多模态大模型前沿技术调研、落地、对业务进行优化; 5. 负责对各业务场景下相关技术问题进行分析、算法设计、研发以及推动上线,提升业务效果;

团队亮点: 1、技术前沿性:主导下一代多模态搜索技术体系构建,探索大模型与搜索的深度融合 2、业务影响力:直接服务亿级用户,优化夸克、千问APP、AI眼镜等核心产品的搜索体验 3、数据与场景优势:基于百亿级图文/视频库及海量用户真实场景需求,攻克多模态对齐与检索难题 核心职责: 您将负责构建面向千问APP、夸克APP、AI眼镜等产品的统一多模态搜索技术体系,覆盖全网图文检索、图视检索、图图检索等核心能力,支撑全网搜索、智能拍搜、多模态RAG等关键场景 1、构建多模态内容理解-语义检索-语义匹配全链路技术方案,涵盖在线侧多模态query理解、embedding模型、Rerank模型,以及离线侧图片/视频/商品等内容理解和图文对齐能力建设 2、依托海量用户query和百亿图片/视频库,大模型驱动的建模范式持续创新,持续优化提升检索性能 3、核心技术攻坚:在细粒度检索、指令化检索、海量图文对齐、视频语义对齐等难点任务上的能力突破