logo of dingtalk

钉钉钉钉-视觉AI高级工程师 / 资深算法工程师(工程落地方向)-杭州

社招全职3年以上技术类-算法地点:杭州状态:招聘

任职要求


学历背景:计算机、人工智能、模式识别、自动化等相关专业硕士及以上学历。
● 经验要求:3年以上计算机视觉或AI工程化相关经验,至少主导过2个以上视觉AI项目从算法到上线的完整落地过程。
● 技术能力:

    ○ 熟练掌握传统深度学习模型如目标检测和识别、MoT、人脸识别、ReID 、步态识别模型的微调和训练
    ○ 深入掌握视觉大模型如Qwen3-vl、GPT-4V、ViT等的微调、蒸馏、量化
    ○ 深入理解各种嵌入模型的微调和使用以及图文检索和图图检索等
    ○ 熟练掌握 ONNXTensorRTTriton Inference Server、vLLM、sgLang等推理部署框架和平台,具备高并发服务部署能力。
    ○ 有 Kafka + Flink 流式处理开发经验,能构建实时视频处理系统。
● 工程素养:代码规范、…
登录查看完整任职要求
微信扫码,1秒登录

工作职责


钉钉正在全面拥抱多模态AI,正在致力于将视觉大模型、边缘智能与实时视频分析深度融合,赋能智能零售、智慧工厂、智能交通等多个行业。我们拥有强大的工程化能力和创新研发氛围,期待志同道合的技术精英加入,共同推动视觉AI落地千行百业。

我们正在寻找在视觉AI领域具备真正工程化落地经验的技术人才,你将参与公司核心视觉AI系统的研发与优化,负责从算法设计、模型训练到高性能部署、大规模流式处理的全链路技术实现。具体职责包括:
1. 视觉大模型与算法开发
    ○ 负责视觉大模型的后训练(Post-training)优化,包括微调、蒸馏、量化、剪枝等,提升模型在实际场景中的泛化能力与效率。
    ○ 开发端侧视觉大模型,针对边缘设备进行轻量化设计与部署。
    ○ 设计并实现传统CV算法(如目标检测、跟踪、姿态估计、图像增强等)与深度学习模型的融合方案。
    ○ 构建视觉嵌入生成与特征提取模型,支持跨模态检索、相似性匹配等应用。
    ○ 能根据实时性、性能、成本等多维约束,设计合理的算法组合与技术路线,实现最优落地效果。
    ○ 在行业专家的指导下完成高质量的数据清洗和标注,建立多行业多场景的视觉AI评估框架
2. 高性能推理部署与优化
    ○ 基于不同算法特性,选择并实施高并发、大吞吐的推理部署方案,熟练使用以下技术栈:

        ■ 推理框架:Triton Inference Server、ONNX Runtime、TensorRT
        ■ 部署平台:KServe + Triton / KServe + vLLM
    ○ 实现模型的动态批处理、自适应推理、低延迟响应,优化端到端服务性能。
    ○ 负责模型格式转换、算子优化、硬件适配(GPU/TPU/NPU)及性能调优。
3. 分布式视频流处理系统构建是加分项
    ○ 构建高可用、可扩展的分布式视频流处理 pipeline,支持多路视频流的实时接入与处理。
    ○ 基于 Kafka + Flink 实现视频帧的流式消费、分发与状态管理。
    ○ 完成视频数据的实时AI推理、结果聚合、元数据落盘,并与下游系统无缝集成。
    ○ 保障系统在高负载下的稳定性、容错性与可监控性。
4. 跨团队协作与技术沉淀
    ○ 与产品、业务、后端及硬件团队紧密协作,推动AI能力在真实业务场景中的落地。
    ○ 输出技术文档、最佳实践,参与构建公司级AI工程化平台与工具链。
包括英文材料
学历+
模式识别+
OpenCV+
算法+
深度学习+
大模型+
GPT+
ONNX+
TensorRT+
Triton Inference Server+
还有更多 •••
相关职位

logo of shein
社招2年以上职能管理类

1.熟练使用各类 AI 生图工具,独立完成服饰 AI 建模、AI 模特图、场景图、产品细节图制作,保质达成月度 SKC 出图指标; 2.运用 PS、AI 软件对 AI 出图进行精修、调色、瑕疵优化,统一图片视觉标准; 3.对接设计师、买手拆解视觉需求,评估需求并输出、迭代视觉方案,落地业务诉求; 4.对接外部摄影公司输出拍摄标准指导,跟进实拍进度,协调解决拍摄各类异常; 5.沉淀品牌视觉规范,开展培训、一对一带教,赋能合作摄影机构提升交付质量; 6.定期复盘图片数据、拆解视觉趋势,输出优化策略,持续提升商品点击率

更新于 2026-07-06广州
logo of jd
社招1-3年产品经理岗

岗位职责 1、负责智能硬件端视觉相关产品及AI模型应用的需求挖掘与梳理,结合硬件场景(如智能家居、可穿戴设备、物联网终端等)明确产品定位、核心功能及落地路径; 2、主导视觉类产品的全生命周期管理,包括需求调研、PRD撰写、原型设计、项目推进、上线验收及迭代优化,确保产品符合用户需求及商业目标; 3、协同算法团队、研发团队、设计团队及硬件团队,推进视觉AI模型(如图像识别、目标检测、场景分割、视觉交互等)在智能硬件上的适配与落地,解决跨团队协作中的需求对齐、进度跟进及问题协调; 4、跟踪视觉技术及智能硬件行业动态,分析竞品优势与不足,结合自身产品规划,提出具有创新性的视觉功能及应用方案; 5、负责产品上线后的数据分析,收集用户反馈,持续优化产品体验,提升视觉功能的可用性、稳定性及用户满意度; 6、输出清晰的产品需求文档、产品 roadmap 及项目进度报告,保障项目高效推进。

更新于 2026-01-11北京
logo of dingtalk
社招3年以上技术类-算法

钉钉正在全面拥抱多模态AI,正在致力于将视觉大模型、边缘智能与实时视频分析深度融合,赋能智能零售、智慧餐饮、明厨亮灶、智慧工厂、智能交通等多个行业。我们拥有强大的工程化能力和创新研发氛围,期待志同道合的技术精英加入,共同推动视觉AI落地千行百业。 我们正在寻找在视觉AI领域具备真正工程化落地经验的技术人才,你将参与视觉AI系统的研发与优化,特别是边缘端视频AI服务的全链路技术实现。具体职责包括: 1. 边缘端视觉模型开发 ○ 负责面向边缘算力受限环境的视觉算法设计与实现,包括目标检测、识别、跟踪、行为分析等任务 ○ 能根据业务场景(如高位摄像头、远端小目标、低光/遮挡等)设计合理的模型结构与任务拆分方案 ○ 熟悉模型精度与算力、延迟、功耗之间的权衡,能够在业务约束下做出工程取舍 ○ 参与模型训练数据方案设计,包括数据采样、增强策略、场景覆盖与泛化评估 2. 边缘端部署与优化 ○ 负责视觉模型在边缘设备上的部署,包括但不限于 ONNX / TensorRT / OpenVINO / TFLite 等推理框架 ○ 针对边缘端场景进行模型优化,如量化(INT8/INT4)、裁剪、蒸馏、Batch/流水线优化 ○ 能结合实际硬件(x86 / ARM / GPU / NPU)进行性能调优,明确性能瓶颈来源(算子 / IO / 调度) ○ 对模型推理的 吞吐、P95/P99 延迟、资源占用 有明确认知,并能通过实验验证优化效果 3. 边缘端视频流处理 ○ 负责边缘端视频流处理链路的设计与实现,包括解码、抽帧、预处理、推理、后处理等模块 ○ 熟悉常见视频协议与格式(RTSP / HLS / RTMP / H.264 / H.265),能处理真实复杂视频流问题 ○ 能设计稳定、可控的多路视频并发处理架构,合理处理丢帧、抖动、延迟累积等问题 ○ 对“视频帧率 × 分辨率 × 并发路数”对系统资源的影响有清晰工程认知 4. 边缘端模型管理与云边协同 ○ 参与或主导边缘端模型生命周期管理,包括模型加载、版本切换、回滚与异常处理 ○ 实现或对接云端模型下发与更新机制,支持 灰度发布、版本兼容、断点恢复 等能力 ○ 能在边缘端系统中处理模型升级过程中的不中断服务或可控中断问题 ○ 具备云边协同思维,理解边缘端与云端在算力、带宽、可靠性上的职责划分

更新于 2026-03-18杭州
logo of dingtalk
社招3年以上产品类-商业型

1. 产品规划与定义:负责面向商业综合体、零售门店等场景的端边云一体化客流分析产品的规划与定义,主导从硬件选型到AI算法的整体解决方案设计; 2. 技术方案设计:主导设计软硬一体产品的技术架构。负责定义前端摄像头的选型与部署方案、边缘设备的算力与算法承载要求,并探索利用多模态大模型进行更深层的客群属性、行为与动线分析; 3. 产品落地与优化:管理产品从POC验证、试点部署到规模化量产的全流程,确保前端硬件采集、边缘AI推理与云端数据服务的稳定、准确与高效。对客流统计精度、系统延迟等核心指标负责; 4. 商业价值挖掘:深入业务场景,将客流数据与商业运营(如铺位规划、营销效果评估、运营效率提升)紧密结合,驱动产品迭代,并形成可衡量的商业价值闭环。

更新于 2025-12-29杭州