腾讯金融科技-文本大模型算法工程师
社招全职3年以上微信支付-基础平台技术地点:深圳状态:招聘
任职要求
1.熟练掌握PyTorch、Swift、Verl等一种或多种大模型训练框架,具备文本大模型(如代码大模型、对话模型)及大模型智能体(Agent)系统的开发与调优经验; 2.熟悉大模型训练范式,包括增量预训练(CPT)、有监督微调(SFT)、强化学习(RL)等,具备分布式训练经验; 3.熟悉RLVR(可验证奖励强化学习)或者Agentic-RL的流程,有文本任务强化学习、代码生成或智…
登录查看完整任职要求
微信扫码,1秒登录
工作职责
1.负责文本大模型在AI编程垂直领域(如代码生成、工具调用、接口测试)的数据构造、Post-Training与评估全流程; 2.深入代码大模型与文本推理方向,进行模型调优与能力创新,覆盖代码补全、流水线自动化、测试用例生成等场景;开展大模型智能体(Agent)的开发与设计,包括智能体工作流编排、工具调用规划、复杂任务分解与执行等; 3.负责文本上下文压缩技术的研究,并在代码检索、知识库问答领域的落地,包括Embedding压缩、长上下文(Long-context)优化、结构化文本处理等; 4.负责基于大模型的知识检索问答(如RAG)系统的研发与优化,包括领域知识库构建、检索增强生成技术应用、问答准确性提升等; 5.跟踪文本大模型、程序语言处理及智能体技术领域的技术进展,评估其在研发效能提升方面的应用潜力。
包括英文材料
PyTorch+
https://datawhalechina.github.io/thorough-pytorch/
PyTorch是利用深度学习进行数据科学研究的重要工具,在灵活性、可读性和性能上都具备相当的优势,近年来已成为学术界实现深度学习算法最常用的框架。
https://www.youtube.com/watch?v=V_xro1bcAuA
Learn PyTorch for deep learning in this comprehensive course for beginners. PyTorch is a machine learning framework written in Python.
Swift+
[英文] A Swift Tour
https://docs.swift.org/swift-book/documentation/the-swift-programming-language/guidedtour/
Explore the features and syntax of Swift.
https://www.hackingwithswift.com/learn
Free Swift and iOS tutorials
https://www.youtube.com/watch?v=8Xg7E9shq0U
Learn the Swift programming language in this full tutorial for beginners.
大模型+
https://www.youtube.com/watch?v=xZDB1naRUlk
You will build projects with LLMs that will enable you to create dynamic interfaces, interact with vast amounts of text data, and even empower LLMs with the capability to browse the internet for research papers.
https://www.youtube.com/watch?v=zjkBMFhNj_g
智能体+
https://learn.microsoft.com/en-us/shows/ai-agents-for-beginners/
In this 10-lesson course we take you from concept to code while covering the fundamentals of building AI agents.
https://www.ibm.com/think/ai-agents
Your one-stop resource for gaining in-depth knowledge and hands-on applications of AI agents.
AI agent+
https://www.ibm.com/think/ai-agents
Your one-stop resource for gaining in-depth knowledge and hands-on applications of AI agents.
SFT+
https://cameronrwolfe.substack.com/p/understanding-and-using-supervised
Understanding how SFT works from the idea to a working implementation...
强化学习+
https://cloud.google.com/discover/what-is-reinforcement-learning?hl=en
Reinforcement learning (RL) is a type of machine learning where an "agent" learns optimal behavior through interaction with its environment.
https://huggingface.co/learn/deep-rl-course/unit0/introduction
This course will teach you about Deep Reinforcement Learning from beginner to expert. It’s completely free and open-source!
https://www.kaggle.com/learn/intro-to-game-ai-and-reinforcement-learning
Build your own video game bots, using classic and cutting-edge algorithms.
还有更多 •••
相关职位
社招5年以上理财通技术
1.主导腾讯金融科技大模型在智能投顾、智能运营、智能客服、搜索推荐等金融核心场景的落地与迭代,带领团队解决链路中的关键技术瓶颈,构建可规模化复用的解决方案; 2.持续跟踪大模型前沿技术(Agent流程编排、Skill、RAG、架构优化、对齐技术、推理加速等),结合金融场景沉淀方法论,推动规范化复用并内化为团队标准。
更新于 2026-07-01深圳
社招5年以上反洗钱与风控公共
1.作为财付通具体跨境产品的风险管理负责人(风控1号位),全面负责该业务的风险合规管理框架建设、风险识别及防控工作; 2.主导跨境业务(外汇/跨境人民币)的合规及风险管理体系搭建; 3.对跨境新业务进行风险评估与监测,结合监管要求制定并指导落地有效的风险管理方案; 4.定期评估跨境业务合规性,针对合规问题制定整改方案并推动执行; 5.整合内外部资源,建立并优化跨境业务风险控制体系、标准及流程。
更新于 2026-06-29深圳
社招5年以上反洗钱与风控公共
1.负责金融风控场景中AI Agent方向的架构升级,提升大模型逻辑推理和任务规划能力,构建具备自主决策、协作与工具调用能力的多智能体系统(Multi-Agent System),推动大模型从“对话式AI”向“任务执行体”演进,解决复杂场景下的自动化问题; 2.深入研究并应用LLM的复杂推理技术(如思维链CoT、思维树ToT),并熟悉应用Prompt Cache,多工具并发调度,上下文隔离,长短期记忆管理,权限与安全收敛等Agent工程化和治理技术,赋予Agent独立探索与解决问题的能力; 3.跟进LLM相关的算法最新技术方向,运用指令微调、强化学习等方法,提升大模型规划、推理与遵循指令的能力,从而提升模型知识边界探索和抗干扰的能力。
更新于 2026-06-29深圳