招聘城市:上海
…框架开发与优化:负责强化学习、模型精调、知识蒸馏等核心模块的设计与开发,提升框架的训练效率与易用性;
2.分布式训练支持:基于Megatron-LM、DeepSpeed等工具,优化大模型分布式训练策略(数据并行/张量并行/流水并行/专家并行等),解决显存、通信与计算瓶颈;
3.工具链构建:参与开发轻量化训练框架(如LLama-Factory、swift),支持快速模型微调、部署及多硬件平台适配;
4.前沿技术探索:跟踪学术动态(如RLHF、MoE架构、FlashMLA、EPLB、DualPipe等),将最新研究成果转化为框架功能,提升产品竞争力;
5.协作与文档:与产品团队紧密配合,提供框架级解决方案;编写技术文档与案例,赋能公有云客户。
岗位要求:
1.计算机科学、数学、电子工程等相关专业硕士及以上…
招聘城市:北京
…框架开发与优化:负责强化学习、模型精调、知识蒸馏等核心模块的设计与开发,提升框架的训练效率与易用性;
2.分布式训练支持:基于Megatron-LM、DeepSpeed等工具,优化大模型分布式训练策略(数据并行/张量并行/流水并行/专家并行等),解决显存、通信与计算瓶颈;
3.工具链构建:参与开发轻量化训练框架(如LLama-Factory、swift),支持快速模型微调、部署及多硬件平台适配;
4.前沿技术探索:跟踪学术动态(如RLHF、MoE架构、FlashMLA、EPLB、DualPipe等),将最新研究成果转化为框架功能,提升产品竞争力;
5.协作与文档:与产品团队紧密配合,提供框架级解决方案;编写技术文档与案例,赋能公有云客户。
岗位要求:
1.计算机科学、数学、电子工程等相关专业硕士及以上…
招聘城市:杭州
…框架开发与优化:负责强化学习、模型精调、知识蒸馏等核心模块的设计与开发,提升框架的训练效率与易用性;
2.分布式训练支持:基于Megatron-LM、DeepSpeed等工具,优化大模型分布式训练策略(数据并行/张量并行/流水并行/专家并行等),解决显存、通信与计算瓶颈;
3.工具链构建:参与开发轻量化训练框架(如LLama-Factory、swift),支持快速模型微调、部署及多硬件平台适配;
4.前沿技术探索:跟踪学术动态(如RLHF、MoE架构、FlashMLA、EPLB、DualPipe等),将最新研究成果转化为框架功能,提升产品竞争力;
5.协作与文档:与产品团队紧密配合,提供框架级解决方案;编写技术文档与案例,赋能公有云客户。
岗位要求:
1.计算机科学、数学、电子工程等相关专业硕士及以上…
招聘城市:深圳
…框架开发与优化:负责强化学习、模型精调、知识蒸馏等核心模块的设计与开发,提升框架的训练效率与易用性;
2.分布式训练支持:基于Megatron-LM、DeepSpeed等工具,优化大模型分布式训练策略(数据并行/张量并行/流水并行/专家并行等),解决显存、通信与计算瓶颈;
3.工具链构建:参与开发轻量化训练框架(如LLama-Factory、swift),支持快速模型微调、部署及多硬件平台适配;
4.前沿技术探索:跟踪学术动态(如RLHF、MoE架构、FlashMLA、EPLB、DualPipe等),将最新研究成果转化为框架功能,提升产品竞争力;
5.协作与文档:与产品团队紧密配合,提供框架级解决方案;编写技术文档与案例,赋能公有云客户。
岗位要求:
1.计算机科学、数学、电子工程等相关专业硕士及以上…
招聘城市:上海
…研发行业算法策略,包括但不限于设计和实现广告起量策略、分行业模型校准、行业EE算法等,进行召回/粗排/精排全链路优化,提升行业效果和收入;
5.负责腾讯广告业务场景的落地,紧贴业务需求出发的技术突破升级;
6.积极跟进AI学术界和业界的最新动态,优化内部技术方案,不断推进广告算法设计升级。
岗位要求:
1.有机器学习算法优化理论的研究经验,熟悉Tensorfow或者PyTorch机器学习框架,并有实际的模型训练、调优的项目经验;
2.优秀的编码能力,熟悉C++/Python/Java/Scala,扎实的数据结构和算法功底;
3.优秀的分析和解决问题能力,良好的团队合作精神;
4.有CV/NLP大模型应用优化经验,或推荐大模型优化经验者…
招聘城市:深圳
…和生成相关的技术研究,提升大模型的代码基础能力;
2.跟进大模型代码领域的前沿技术,将其应用于研发生产中,持续提升大模型的代码能力;
3.负责大模型的代码相关的数据构建、训练调优及评测迭代,推进大模型技术在代码补全,Text2SQL,代码问答,代码Agent等业务场景落地。
岗位要求:
1.自然语言处理/机器学习/模式识别/人工智能/计算机等相关专业硕士以上学历;
2.在NLP、LLM、深度学习、强化学习方面有一定研究基础,熟悉主流模型和算法,并有一定的实践经验;
3.较强的工程实现能力,熟练掌握C/C++,Python等至少一种语言,有实际编程项目经验,熟悉DeepSpeed、Megatron等分布式训练框架,熟练使用至少一种深度学习框架(如tensorflow…
招聘城市:北京
…与跨团队协作,包括产品、工程和数据科学团队,确保算法方案与业务需求高效对齐并快速迭代。
岗位要求:
1.计算机、人工智能、自动化等相关专业硕士及以上学历,3年以上相关工作经验;
2.精通Transformer、BERT、GPT等主流深度学习模型架构,具备扎实的深度学习理论基础;
3.有Qwen、Hunyuan等视觉-语言大模型(VLM)的微调与部署经验,熟悉其训练与推理流程。
加分项:
1.有COT方向微调或推理优化相关项目经验者优先;
2.有强化学习、多任务学习或自监督学习训练经验者优先;
3.具有数学建模竞赛获奖经历、顶会论文发表(如CVPR、ICML、NeurIPS、ICCV等)或专利成果者优先;
4.有自动驾驶、高精地图、地理信息处理等相关领域经验者优先…
招聘城市:北京
…与跨团队协作,包括产品、工程和数据科学团队,确保算法方案与业务需求高效对齐并快速迭代。
岗位要求:
1.计算机、人工智能、自动化等相关专业硕士及以上学历,3年以上相关工作经验;
2.精通Transformer、BERT、GPT等主流深度学习模型架构,具备扎实的深度学习理论基础;
3.有Qwen、Hunyuan等视觉-语言大模型(VLM)的微调与部署经验,熟悉其训练与推理流程。
加分项:
1.有COT方向微调或推理优化相关项目经验者优先;
2.有强化学习、多任务学习或自监督学习训练经验者优先;
3.具有数学建模竞赛获奖经历、顶会论文发表(如CVPR、ICML、NeurIPS、ICCV等)或专利成果者优先;
4.有自动驾驶、高精地图、地理信息处理等相关领域经验者优先…
…算法 - 多模态方向等;社招岗位涵盖大模型深度LTV - 算法工程师等。最低学历要求本科及以上,招聘人数若干。工作涉及技术、产品、营销等领域,有先进的技术、实用的产品和创新的营销方法。网申流程为点击下方岗位名称,一键投递。欢迎符合条件的人士加入我们。
招聘公告: 了解腾讯营销腾讯营销(原腾讯广告)是腾讯面向企业的统一商业服务平台,依托腾讯技术实力与全域生态,整合微信、QQ等海量用户场景,构建超十亿用户流量矩阵,连接用户与品牌,并为广告主提供全经营链路数字化营销解决方案,帮助广告主实现数字化经营与生意增长。这里有技术: 毫秒级处理海量广告请求,算法、大模型、强化学习、AIGC创意生成,工业级难题…
…4.参与大模型与智能体开发工作,研究大模型和智能体领域前沿技术(如多智能体协同、思维链、反馈优化与自适应机制)的跟踪,推动技术创新和落地。
- 岗位要求 - 1.熟悉大模型全流程并具备相关技术能力,包括预训练、指令微调(SFT)、强化学习对齐(RLHF/DPO)等。
2.设计、开发和优化人工智能算法,包括但不限于机器学习、深度学习、自然语言处理、计算机视觉,多模态大模型等领域,以解决实际业务问题。
3.分析和处理大规模数据,提取有价值的信息,并建立可靠的数据处理流程。
4.研究和探索新的人工智能技术,将最新的研究成果应用到公司的项目中。
5.与产品经理、软件工程师等合作,将算法转化为可用的…
招聘城市:上海,北京
…DirectLLM 大模型 API 服务、QuickSilver 大模型生产部署平台等核心产品,持续赋能社区、商业、交易、安全、数平、研效等多个核心业务,实现 AI 技术高效落地!
1、参与设计实现支持RLHF/DPO等对齐技术的高效训练框架,优化强化学习阶段的Rollout、Reward Model集成、多阶段训练 Pipline;
2、研发支持多机多卡 RL 的分布式训练框架,开发TP/PP/ZeRO-3与RL流程的动态协同机制,解决 RL 算法在超长时序下的显存/通信瓶刭
3、构建端到端后训练工具链,主导框架与 MLOps 平台集成,提供训练可视化、自动超参搜索等生产级能力
4、与公司各算法部门深度合作,参与大语言模型LLM、多模态大模型 MLLM等业务在 SFT/RL领域的…
招聘城市:深圳
岗位职责:
1.负责混元多模态大模型的RL后训练框架研发;
2.设计和开发高效的框架和算子,以支持各种硬件加速器;
3.参与强化学习算法的优化和实现,提高训练和推理性能;
4.跨团队协作,与算法、软件、硬件团队密切合作,提高框架性能和稳定性。
岗位要求:
1.熟悉常用的大模型训练推理框架,如PyTorch/Megatron/VLLM/Verl,有相关开发经验;
2.熟悉Docker、Kubernetes等容器和容器编排技术;
3.熟悉编译器相关技术,了解MLIR/XLA/TVM等AI编译器者优先考虑;
4.熟悉CPU/GPU硬件架构,有扎实的CUDA/OpenMP编程基础;
5.良好的团队协作能力和沟通能力,具有较强的自我驱动能力。
招聘城市:北京
…Agent框架的研发与维护,支持强化学习、数据生成及自动化评估等业务需求;
2.负责优化框架的易用性与稳定性,解决实际运行中的性能瓶颈,保障实验流程的高效执行;
3.支持各类外部Agent策略及评估逻辑的接入,维护相关接口与组件,确保系统的兼容性与扩展性;
4.结合大模型训练视角,配合算法团队进行新Agent范式的工程化落地与探索。
岗位要求:
1.具备扎实的Python编程能力,熟悉异步编程(Asyncio)及并发处理的最佳实践,有良好的代码规范意识;
2.熟悉大模型与Agent相关应用技术,熟练使用AI编程工具并理解其工作原理;
3.熟悉K8S及容器化技术,具备相关环境下的开发或部署经验;
4.了解大模型训练全…
招聘城市:深圳
…主流框架研发经验;
3.熟悉大模型后训练与对齐技术(PPO、GRPO、DPO等),熟悉 Verl、ROLL,AReal 等强化学习/分布式计算框架,可以理解并解决 RL过程中的工程痛点;
4.熟悉主流生成模型的原理,在AIGC相关领域具备实际项目经验;
5.具备极强的技术好奇心与自驱力,面对业界无先例的技术难题,能独立思考并推动解决。
加分项:
1.有大规模 RL 训练平台(支持千级 GPU 集群、亿级样本回放)搭建经验;
2.熟悉智能体强化学习(Agentic RL)训练的基础设施优化方案;
3.有 GPU 显存 / 算力优化、网络传输优化(如 NCCL 调优)的实际案例;
4.开源项目贡献者(RL 框架、分布式训练工具等相关项目)。
岗位介绍:
在腾讯,后台开发工程师…
招聘城市:上海
…主流框架研发经验;
3.熟悉大模型后训练与对齐技术(PPO、GRPO、DPO等),熟悉 Verl、ROLL,AReal 等强化学习/分布式计算框架,可以理解并解决 RL过程中的工程痛点;
4.熟悉主流生成模型的原理,在AIGC相关领域具备实际项目经验;
5.具备极强的技术好奇心与自驱力,面对业界无先例的技术难题,能独立思考并推动解决。
加分项:
1.有大规模 RL 训练平台(支持千级 GPU 集群、亿级样本回放)搭建经验;
2.熟悉智能体强化学习(Agentic RL)训练的基础设施优化方案;
3.有 GPU 显存 / 算力优化、网络传输优化(如 NCCL 调优)的实际案例;
4.开源项目贡献者(RL 框架、分布式训练工具等相关项目)。
岗位介绍:
在腾讯,后台开发工程师…
招聘城市:北京
…主流框架研发经验;
3.熟悉大模型后训练与对齐技术(PPO、GRPO、DPO等),熟悉 Verl、ROLL,AReal 等强化学习/分布式计算框架,可以理解并解决 RL过程中的工程痛点;
4.熟悉主流生成模型的原理,在AIGC相关领域具备实际项目经验;
5.具备极强的技术好奇心与自驱力,面对业界无先例的技术难题,能独立思考并推动解决。
加分项:
1.有大规模 RL 训练平台(支持千级 GPU 集群、亿级样本回放)搭建经验;
2.熟悉智能体强化学习(Agentic RL)训练的基础设施优化方案;
3.有 GPU 显存 / 算力优化、网络传输优化(如 NCCL 调优)的实际案例;
4.开源项目贡献者(RL 框架、分布式训练工具等相关项目)。
岗位介绍:
在腾讯,后台开发工程师…
招聘城市:杭州
…主流框架研发经验;
3.熟悉大模型后训练与对齐技术(PPO、GRPO、DPO等),熟悉 Verl、ROLL,AReal 等强化学习/分布式计算框架,可以理解并解决 RL过程中的工程痛点;
4.熟悉主流生成模型的原理,在AIGC相关领域具备实际项目经验;
5.具备极强的技术好奇心与自驱力,面对业界无先例的技术难题,能独立思考并推动解决。
加分项:
1.有大规模 RL 训练平台(支持千级 GPU 集群、亿级样本回放)搭建经验;
2.熟悉智能体强化学习(Agentic RL)训练的基础设施优化方案;
3.有 GPU 显存 / 算力优化、网络传输优化(如 NCCL 调优)的实际案例;
4.开源项目贡献者(RL 框架、分布式训练工具等相关项目)。
岗位介绍:
在腾讯,后台开发工程师…
招聘城市:深圳
…熟悉PyTorch、Megatron等框架,掌握3D并行、ZeRO机制、Flash-Attn等的原理、使用场景、优劣势以及可优化方向;
2.熟悉使用主流推理框架,如vLLM、SGLang,掌握kvcache、量化、投机采样、算子优化等推理优化方法;
3.熟悉常见RL训练算法,如DPO、GRPO、PPO等,理解不同算法的差别和使用场景;
4.熟悉Ray框架,有Ray框架优化经验者优先;
5.熟练掌握CUDA性能优化手段,有算子编写优化项目经验者优先;
6.对大模型、强化学习前沿技术比较敏锐者优先;
7.有实际大模型RL训练,性能和效果优化经验的优先;
8.良好的沟通能力、解决问题能力。
岗位介绍:
在腾讯,后台开发工程师不仅是“又快又稳”的问题解决专家,更是生态共创者。你将与技术团队一同沉淀…
招聘城市:北京
…Megatron, DeepSpeed 等大规模训练框架使用经验者优先;
5.对RL/RLHF、偏好学习、奖励建模有实践经验者优先;
6.具备扎实的工程实现能力与代码规范意识,熟悉CUDA优化、参数并行、流水线并行等技术;
7.具备良好的团队协作与沟通能力,热爱探索与创新。
加分项:
1.在 GitHub 等平台持续参与主流大模型 / 分布式训练 / RLHF 等项目的开发维护,有高质量 PR 被核心项目合并,或担任 maintainer / reviewer;
2.主导或深度参与自研预训练 / 后训练框架、长上下文训练工具链等开源项目,具备清晰的技术文档与使用教程,拥有一定 Star / Fork 规模和社区用户;
3.在 Hugging Face 社区、技术博客或开发者论坛上定期分享工程实践(如长上下文训练、MoE…
招聘城市:成都
…定制训练方案并评估验证模型;
4.负责模型训练和推理所需的IaaS基础设施的规划、迭代与框架维护,致力于提供一致性、可扩展、高可靠的平台技术底座。
岗位要求:
1.计算机科学、数学、统计学、自动化等相关专业本科及以上学历,3年以上相关领域工作经验;
2.熟悉Post-Training流程,深入了解RL领域,包括但不限于RM、PPO、DPO、GRPO等算法;
3.具备大模型训练框架开发能力,包括pytorch、megatron等;
4.具备强化学习框架开发能力,包括openRLHF、verl等;
5.具备一线的C++/Python工程能力,精通数据结构和常用算法,掌握各种编译、调试、性能分析工具,熟悉并行编;(CUDA/Triton等)优先;
6.该岗位支持base成都、广州、北京。
岗位介绍:
在腾讯,后台开发工程师不仅…