logo of quark

夸克千问C端事业群-大模型post training应用算法(AI眼镜)-北京/杭州

社招全职1年以上技术类-算法地点:北京 | 杭州状态:招聘

任职要求


1、计算机科学、人工智能、数学、电子信息工程或相关专业硕士及以上学历。
2、具备扎实的深度学习理论基础,熟练使用Python、PyTorch等工具,熟悉业界前沿模型架构与…
登录查看完整任职要求
微信扫码,1秒登录

工作职责


负责AI眼镜背后的整体云端算法解决方案,包括语音助手、拍照问答、全模态live交互等核心能力。持续推动大模型(LLM/VLM)在逻辑推理、问答、复杂上下文理解、指令遵循、Agent智能体及多模态交互等核心方向取得突破性进展,打造行业领先的智能体验。具体职责包括:
1、LLM/VLM后训练技术研发与落地: 探索并应用SFT、RLHF、DPO、RLVR等训练范式及模型蒸馏等对齐策略,持续提升模型在RAG、行业知识掌握、用户偏好理解、指令遵循能力及抑制幻觉等方面的表现。
2、多模态统一模型构建: 规划并实施文本、语音、视觉等多模态信息的统一建模方案,确保模型在文本问答、图文百科、视频实时对话等复杂场景下具备精准的理解能力和高效的输出能力。
3、眼镜场景算法闭环迭代: 构建基于线上日志的数据飞轮,体系化建设眼镜场景专属训练数据集,并推动模型持续迭代更新。聚焦业务痛点,解决实际问题,构建坚实的技术壁垒。
包括英文材料
学历+
深度学习+
还有更多 •••
相关职位

logo of quark
社招3年以上技术类-算法

岗位描述: 全面负责夸克大模型在 Post-Training 能力进化和上限突破、持续推进模型能力边界和商业价值的不断延伸。通过对前沿算法的极致探索和高效能工程体系的构建,驱动模型在逻辑推理、问答、复杂多轮上下文、指令遵循、Agent 智能体、多模态交互等关键领域实现突破性进展,打造世界一流的模型效果,并定义其在未来 AI 应用中的核心价值。 工作职责: ● 【战略规划与技术引领】 制定并执行大模型 Post-training 的中长期技术路线图,预判并布局下一代对齐技术、能力增强及对齐方案。主导核心算法的战略方向,确保技术路径与公司业务战略高度协同。 ● 【核心能力与壁垒构建】 领导团队进行体系化的数据驱动实验,不仅局限于日常迭代,更要建立可规模化的能力提升范式。您将攻坚并解决模型在复杂指令遵循、通用问答、RAG、深度逻辑推理、内容创作、Tool-Using 等方面的瓶颈问题,构建技术壁垒。 ● 【前沿算法研究与创新】 深入探索并推动 Post-training 领域的前沿算法创新,包括但不限于 RLHF/RLAIF 的新范式、模型融合 (Model Fusion/Merge) 、模型蒸馏及 MoE 模型的高效对齐策略。您的目标是显著降低模型幻觉、提升推理的效果、加强模型复杂指令的遵循能力。 ● 【多模态与未来探索】 从统一多模态模型的战略视角出发,您将指导并规划多模态统一大模型的 Post-training 技术融合。探索并落地高效的多模态 SFT 数据构建、跨模态能力协同训练及对齐策略,确保模型在图文问答、视频对话 等复杂场景下实现无缝、精准的理解与生成。 ● 【团队领导与效能提升】 负责 Post-training 算法团队的组建、培养与管理,打造一支具备高效执行力和持续创新能力的顶尖团队。您将指导并优化从研究、实验、评测到部署的全链路工具链与工程框架,实现研发效能的倍增。

更新于 2026-01-20北京|杭州
logo of quark
社招2年以上技术类-算法

我们正在构建世界级医疗垂直大模型,致力于通过AGI技术革新健康咨询与辅助诊疗场景,让精准医疗普惠每个家庭。如果你渴望在万卡算力集群上实现算法突破,用技术改变14亿人的生命质量,这是你不可错过的技术圣战。加入我们,定义医疗大模型的未来。 1. 负责后训练(Post-training)相关研发工作,提升模型在推理、Planning、RAG、指令跟随、工具调用等方面的能力; 2. 优化和迭代大模型的对齐训练策略,包括 SFT、RLHF、Self-play RL、Agent 优化等; 3. 对齐人类偏好、安全性,提升奖励信号的质量和多样性,解决 Reward Hacking 和奖励融合问题 4. 参与数据飞轮、数据合成、基准集合建设、评测工具的开发与发布等。

更新于 2026-01-15杭州
logo of quark
社招5年以上运营类-内容运营

1、高效承接大模型文本、图片、视频等数据标注业务需求,独立承担标注策略制定、项目管理、流程优化、质量把控等工作; 2、对优质内容有一定的判断力和敏感度,能够基于业务数据,进行模型效果监控、评估、分析、反馈,并推动模型优化链路迭代,打造数据飞轮,对模型进行内容改进策略建议; 3、与上下游产品技术通力合作,制定有效的数据策略,推进大模型效果提升和产品化目标达成; 4、同时统筹多个标注/评测项目的管理工作,负责外包、众包人员的组织与协调,推动项目成功交付; 5、 熟悉AI产品,对大模型行业发展及产品动态有充分认知,并能有效应用到实际业务。

更新于 2025-12-30北京|杭州
logo of quark
社招3年以上技术类-开发

1、参与境内外互联网网页、文档、代码等文本数据的发现、采集、处理及标注工作,完善相应平台和架构能力; 2、为文本大模型训练供给语料数据,为AI toC应用供给领域优质内容数据; 3、评估并提升训练数据的质量、多样性及标注准确性; 4、通过AI能力来赋能数据建设,提升数据效果及生产效率; 5、与模型及业务研发团队紧密协作,根据训练效果和业务指标反馈持续迭代数据策略。

更新于 2025-12-26北京|杭州