logo of sensetime

商汤CV算法研究实习生

实习兼职技术族-实习地点:北京 | 上海 | 深圳状态:招聘

任职要求


任职资格:
1、扎实的计算机视觉和工程技能基础
2、独立分析和解决问题的能力,良好的沟通能力
3、基本的算法设计和实现能力,熟悉Python/C++/CUDA编程,掌握PyTorch/…
登录查看完整任职要求
微信扫码,1秒登录

工作职责


1. 辅助开展计算机视觉和深度学习算法的开发与性能提升,研究的问题包括但不限于:2D/3D物体检测与跟踪、物体6D姿态估计、人体姿态估计、物体人体在线重建、人体运动捕捉、语义分割、动态场景重建、视觉定位与导航等。
2. 紧跟学术前沿,开展高水平和创新性的研究,保持算法在工业界和学术界的领先,参与顶会论文投稿及专利申请。
3. 负责开发管理研究所需要的工具以及基础设施。
岗位优势:
1. 介于工业界与学术界之间,用前沿研究解决实际问题
2. 拥有丰富的数据与计算资源
3. 与科研和工程经验丰富的同事共事,有机会得到合作教授的科研指导
包括英文材料
OpenCV+
算法+
Python+
C+++
还有更多 •••
相关职位

logo of transsion
实习

涵盖以下三个子方向: 图像/视频生成方向 1、参与图像生成、视频生成、多模态生成等相关算法研发; 2、跟踪前沿生成式模型,包括但不限于Stable diffusion、DiT、FLUX、Qwen-Image、WAN、Z-Image等算法模型; 3、探索大模型在图像与视频内容生成中的应用与优化方案; 4、参与高质量数据构建、训练策略设计及模型效果优化。 图像/视频编辑方向 1、参与图像编辑、视频编辑、可控生成、指令编辑等相关算法研究; 2、包括但不限于Inpainting、Outpainting、风格迁移、局部编辑、人像美化、多图融合等任务; 3、探索基于多模态大模型(MLLM)的prompt改写方案; 4、优化编辑模型在实际业务场景中的稳定性与泛化能力。 图像/视频复原方向 1、参与图像/视频的增强与复原相关算法研发,包括超分辨率、去噪、去雨、去雪、去模糊、去反光、去阴影、低光增强等任务; 2、研究生成式方法在图像复原中的应用; 3、负责模型训练、调优及实际落地效果提升; 4、推动算法在移动端及工程系统中的部署优化。

更新于 2026-05-27深圳|上海
logo of oppo
社招1-5年SOFTWARE

我们正在寻找一位在多模态大模型(VLM)与智能体(Agent)领域具备深厚技术积淀的算法工程师。你将作为智能相册 Agent 的核心共创者,深度参与构建端云协同的下一代手机智能体生态。你将利用最前沿的深度推理(Deep Reasoning)、工具链学习(Tool Learning)以及图像/视频理解技术,打破传统相册的工具属性,赋予其主动规划、记忆反思、私有知识图谱检索以及跨应用协同的 Agent 能力。 岗位职责 1. 深度推理、意图识别与任务编排(Core Agentic Workflow) 负责端云协同相册 Agent 的架构设计与算法实现,攻坚多轮对话中的复杂长文本上下文管理、记忆提取(Memory Storage & Retrieval)与反思(Self-Reflection)机制。研究并优化 Agent 的任务拆解(Sub-goal Decomposition)与自主规划(Planning)能力,设计在端侧算力环境下的高可靠性路由决策机制。 2. 模型定制微调与推理效能优化(Fine-Tuning & Infra Optimization) 针对相册专属场景,负责大语言模型(LLM)与多模态模型(VLM)的指令微调(SFT)与强化学习,优化模型在 Tool-use 和结构化输出(JSON 强约束)上的准确率。基于开源的高吞吐推理引擎,针对高并发/端侧低算力环境进行模型的剪枝、量化以及分布式并行训练优化。 3. 数据飞轮与评测闭环 负责搭建完整的 Agent 评测基准(Benchmark)与数据飞轮工程,通过用户行为埋点形成自主对齐闭环,驱动算法模型的持续迭代。

更新于 2026-07-19北京|深圳
logo of oppo
实习SOFTWARE

1、参与视觉空间理解、计算与推理相关算法的辅助研发、调试与优化工作; 2、负责相关任务的高质量数据构建(如:设计/搭建并优化数据pipeline),保障数据质量适配模型训练与效果达成; 3、基于VLA技术完成相应的任务。包括但不局限于:研究影像与成像参数的关联机制。 4、配合团队完成技术文档撰写、实验数据整理等相关工作,产出高质量论文或学术报告。

更新于 2026-07-07上海
logo of oppo
社招8-12年SOFTWARE

1. 负责研究和开发视觉理解与生成类算法,以实现高效、高质量的扩散模型(diffusion)和多模态理解大模型,为图文创作、图片编辑等产品提供能力。 2. 与团队成员合作,带头攻关项目中遇到的技术难题。 3. 跟踪最新的CV技术发展,洞察前沿技术发展趋势。

更新于 2026-07-27深圳