logo of amap

高德地图高德-高级生成式大模型算法工程师/专家-视觉技术中心

社招全职3年以上技术类-算法地点:北京状态:招聘

任职要求


具备其中任一模块能力即可
1、熟悉生成模型理论,熟悉AIGC算法,包括但不限于基于扩散模型的文生视频、视频增强等。掌握 VAE / Diffusion / AR 等至少一种生成算法方案,有论文或成熟项目落地经验;
2、有大规模分布式机器学习系统研发背景,具备分布式训练(DeepSpeed/Megatron-LM/Horovod 等)实践经验;
3、精通 SFTRLHF(PPO/奖励模型等)技术,能在大模型后训练阶段…
登录查看完整任职要求
微信扫码,1秒登录

工作职责


1、负责基于扩散模型的世界生成、视频生成等相关场景的算法研发工作,结合实际应用场景攻克技术难题,包括世界生成过程中的可控性、时空一致性、实时性等问题;
2、参与并主导生成式大模型核心算法研发,包括 Diffusion、Autoregressive(AR)、VAE、Transformer 等架构。研发时空视频编码、压缩与生成算法,优化模型在生成任务中的一致性与时序表现。设计并实现从预训练到后训练(SFT、RLHF)的全流程模型优化方案,提升生成质量、可控性和效率;
3、负责生成式大模型的总体技术架构设计,探索多模态融合、跨任务迁移等创新方向,跟踪前沿研究进展,进行技术评估与落地转化,推动团队在行业/学术上的技术领先。
包括英文材料
AIGC+
算法+
机器学习+
DeepSpeed+
Megatron+
SFT+
RLHF+
还有更多 •••
相关职位

logo of dingtalk
社招3年以上技术类-算法

钉钉正在全面拥抱多模态AI,正在致力于将视觉大模型、边缘智能与实时视频分析深度融合,赋能智能零售、智慧工厂、智能交通等多个行业。我们拥有强大的工程化能力和创新研发氛围,期待志同道合的技术精英加入,共同推动视觉AI落地千行百业。 我们正在寻找在视觉AI领域具备真正工程化落地经验的技术人才,你将参与公司核心视觉AI系统的研发与优化,负责从算法设计、模型训练到高性能部署、大规模流式处理的全链路技术实现。具体职责包括: 1. 视觉大模型与算法开发 ○ 负责视觉大模型的后训练(Post-training)优化,包括微调、蒸馏、量化、剪枝等,提升模型在实际场景中的泛化能力与效率。 ○ 开发端侧视觉大模型,针对边缘设备进行轻量化设计与部署。 ○ 设计并实现传统CV算法(如目标检测、跟踪、姿态估计、图像增强等)与深度学习模型的融合方案。 ○ 构建视觉嵌入生成与特征提取模型,支持跨模态检索、相似性匹配等应用。 ○ 能根据实时性、性能、成本等多维约束,设计合理的算法组合与技术路线,实现最优落地效果。 ○ 在行业专家的指导下完成高质量的数据清洗和标注,建立多行业多场景的视觉AI评估框架 2. 高性能推理部署与优化 ○ 基于不同算法特性,选择并实施高并发、大吞吐的推理部署方案,熟练使用以下技术栈: ■ 推理框架:Triton Inference Server、ONNX Runtime、TensorRT ■ 部署平台:KServe + Triton / KServe + vLLM ○ 实现模型的动态批处理、自适应推理、低延迟响应,优化端到端服务性能。 ○ 负责模型格式转换、算子优化、硬件适配(GPU/TPU/NPU)及性能调优。 3. 分布式视频流处理系统构建是加分项 ○ 构建高可用、可扩展的分布式视频流处理 pipeline,支持多路视频流的实时接入与处理。 ○ 基于 Kafka + Flink 实现视频帧的流式消费、分发与状态管理。 ○ 完成视频数据的实时AI推理、结果聚合、元数据落盘,并与下游系统无缝集成。 ○ 保障系统在高负载下的稳定性、容错性与可监控性。 4. 跨团队协作与技术沉淀 ○ 与产品、业务、后端及硬件团队紧密协作,推动AI能力在真实业务场景中的落地。 ○ 输出技术文档、最佳实践,参与构建公司级AI工程化平台与工具链。

更新于 2025-12-05杭州
logo of quark
社招1年以上技术类-算法

致力于构建高质量的大规模视觉训练数据集,支持图像、视频等多模态模型的研发。主导数据基础设施的设计与优化,确保数据具备良好的质量、多样性与可扩展性。 1. 开发并维护可扩展的数据基础设施,支持大规模图像和视频数据的采集、存储与管理; 2. 应用并部署机器学习模型用于数据清洗、预处理与格式标准化; 3. 实现可扩展且高效的工具,用于可视化、聚类以及深度理解数据; 4. 优化和并行化数据处理流程,以高效处理上亿级别的数据集; 5. 评估并提升训练数据的质量、多样性及标注准确性(包括但不限于caption生成); 6. 将来自用户偏好的数据来源转化为可用于训练的格式; 7. 与模型研发团队紧密协作,根据训练效果和模型反馈持续迭代数据策略。

更新于 2025-07-31北京|杭州
logo of alibaba
社招3年以上技术类-算法

所在团队负责阿里国际贸易平台上的所有推荐产品,包括猜你喜欢、详情页推荐、个性化楼层等。团队通过大数据和深度学习建模,帮助平台上买卖家快速达成生意。来到这里,你将有机会深度接触到业界的计算平台和深度学习算法,并将算法技术转化为商业价值。具体地,你将有机会负责: 1. 用户画像、召回、排序和策略等模块的技术规划和算法设计,通过技术创新提升买卖家匹配效率。 2. 通过大规模深度学习和图学习,在面对数据稀疏和多国家多行业的情况下对用户实时兴趣、CTR预估、询盘和交易转化预估等问题建模。 3. 通过多样性和发现性策略,拓展用户需求,提升兴趣发现能力,进一步完善和提升推荐侧的产品价值。 4. 探索大语言模型+搜推的创新应用方向,LLM在推荐领域下的全链路建设,包括但不限于大规模的预训练、SFT、LoRA和RLHFL等技术,落地大语言模型+搜推的新的应用落地场景(如生成式推荐等)。

更新于 2025-09-23杭州
logo of quark
社招3年以上技术类-算法

1.负责夸克亿万用户的 query 推荐效果(sug、猜你想搜、相关推荐)与资源卡片的搜索/排序效果,持续提升核心指标(如 CTR、CVR、覆盖率 等)。 2.构建与优化 NLP 相关模块:query 分类、意图识别、实体短语挖掘、语义匹配、query 重写/扩展、文本相似度与聚类等。 3.参与设计与落地排序系统的技术升级(召回-排序-重排全链路); 4.跨团队协作:与产品、工程、运营共同定义目标与策略,沉淀算法策略。

更新于 2025-11-20北京