飞猪旅行飞猪-算法高级工程师/专家-多模态理解与生成
社招全职1年以上地点:杭州状态:招聘
任职要求
1. 计算机、数学或统计学相关专业硕士及以上学历,具有2年以上多模态大模型研发、智能体研发、RAG或强化学习等相关经验; 2. 熟练使用pytorch/tensorflow等至少一种主流深度学习框架,能够独立实现前…
登录查看完整任职要求
微信扫码,1秒登录
工作职责
1. 从事多模态大模型的训练,包括预训练、指令微调与对齐,强化学习/RLHF后训练,提升模型在复杂场景下的泛化与生成能力。 2.从事高效多模态数据管线。 3. 将多模态大模型应用于内容生产,拍照讲解,多模态对话等多个旅行行业场景落地。 4.跟踪并实践多模态生成大模型前沿技术,引入新的算法技术及理念,推动业务落地及技术优化。
包括英文材料
学历+
大模型+
https://www.youtube.com/watch?v=xZDB1naRUlk
You will build projects with LLMs that will enable you to create dynamic interfaces, interact with vast amounts of text data, and even empower LLMs with the capability to browse the internet for research papers.
https://www.youtube.com/watch?v=zjkBMFhNj_g
智能体+
https://learn.microsoft.com/en-us/shows/ai-agents-for-beginners/
In this 10-lesson course we take you from concept to code while covering the fundamentals of building AI agents.
https://www.ibm.com/think/ai-agents
Your one-stop resource for gaining in-depth knowledge and hands-on applications of AI agents.
RAG+
https://www.youtube.com/watch?v=sVcwVQRHIc8
Learn how to implement RAG (Retrieval Augmented Generation) from scratch, straight from a LangChain software engineer.
强化学习+
https://cloud.google.com/discover/what-is-reinforcement-learning?hl=en
Reinforcement learning (RL) is a type of machine learning where an "agent" learns optimal behavior through interaction with its environment.
https://huggingface.co/learn/deep-rl-course/unit0/introduction
This course will teach you about Deep Reinforcement Learning from beginner to expert. It’s completely free and open-source!
https://www.kaggle.com/learn/intro-to-game-ai-and-reinforcement-learning
Build your own video game bots, using classic and cutting-edge algorithms.
还有更多 •••
相关职位

社招1年以上
1. 从事多模态大模型的训练,包括预训练、指令微调与对齐,强化学习/RLHF后训练,提升模型在复杂场景下的泛化与生成能力。 2.从事高效多模态数据管线。 3. 将多模态大模型应用于内容生产,拍照讲解,多模态对话等多个旅行行业场景落地。 4.跟踪并实践多模态生成大模型前沿技术,引入新的算法技术及理念,推动业务落地及技术优化。
更新于 2026-03-30杭州
社招1年以上技术类-算法
● 参与⻋道级导航业务,打造下⼀代导航产品。作为核⼼算法模块负责⼈,负责⻋道级视觉定位能⼒的建设。根据业务需求和问题,设计技术架构和问题解决⽅案,与上下游配合,完成技术在实际业务落地,保障产品交付效果。
更新于 2026-07-06北京
社招A120425
1、分析员工行为、设备、权限和资源访问数据; 2、设计用户行为、时序、资源关系和风险特征; 3、训练分类、异常检测、序列预测等模型,解决样本不平衡、标签质量和模型误报问题,分析模型误报和漏报,持续优化检测效果; 4、为告警提供可解释的风险原因和证据; 5、配合工程团队完成模型上线和监控。
更新于 2026-06-30杭州