招聘城市:杭州
…语言学等相关专业硕士及以上学历;
2.精通一种或多种主流深度学习框架(PyTorch、JAX、TensorFlow),具备大规模分布式训练经验;
3.熟悉LLM/DiT等模型的训练流程,有 Megatron、DeepSpeed、FSDP等大规模训练框架使用经验者优先;
4.具备扎实的工程实现能力与代码规范意识,熟悉CUDA优化、参数并行、流水线并行等技术。
加分项:
1.有超大规模集群训练优化经验和成功案例;
2.参与过知名开源项目的开发维护,包括深度学习框架、分布式训练框架等方向;
3.熟悉大规模训练的可观测建设、诊断分析、故障解决,有稳定性治理经验。
岗位介绍:
在腾讯,后台开发工程师不仅是“又快又稳”的问题解决专家,更是生态共创者。你将与技术团队一同沉淀优质代码…
招聘城市:深圳
…语言学等相关专业硕士及以上学历;
2.精通一种或多种主流深度学习框架(PyTorch、JAX、TensorFlow),具备大规模分布式训练经验;
3.熟悉LLM/DiT等模型的训练流程,有 Megatron、DeepSpeed、FSDP等大规模训练框架使用经验者优先;
4.具备扎实的工程实现能力与代码规范意识,熟悉CUDA优化、参数并行、流水线并行等技术。
加分项:
1.有超大规模集群训练优化经验和成功案例;
2.参与过知名开源项目的开发维护,包括深度学习框架、分布式训练框架等方向;
3.熟悉大规模训练的可观测建设、诊断分析、故障解决,有稳定性治理经验。
岗位介绍:
在腾讯,后台开发工程师不仅是“又快又稳”的问题解决专家,更是生态共创者。你将与技术团队一同沉淀优质代码…
招聘城市:上海
…语言学等相关专业硕士及以上学历;
2.精通一种或多种主流深度学习框架(PyTorch、JAX、TensorFlow),具备大规模分布式训练经验;
3.熟悉LLM/DiT等模型的训练流程,有 Megatron、DeepSpeed、FSDP等大规模训练框架使用经验者优先;
4.具备扎实的工程实现能力与代码规范意识,熟悉CUDA优化、参数并行、流水线并行等技术。
加分项:
1.有超大规模集群训练优化经验和成功案例;
2.参与过知名开源项目的开发维护,包括深度学习框架、分布式训练框架等方向;
3.熟悉大规模训练的可观测建设、诊断分析、故障解决,有稳定性治理经验。
岗位介绍:
在腾讯,后台开发工程师不仅是“又快又稳”的问题解决专家,更是生态共创者。你将与技术团队一同沉淀优质代码…
招聘城市:深圳
…主流框架研发经验;
3.熟悉大模型后训练与对齐技术(PPO、GRPO、DPO等),熟悉 Verl、ROLL,AReal 等强化学习/分布式计算框架,可以理解并解决 RL过程中的工程痛点;
4.熟悉主流生成模型的原理,在AIGC相关领域具备实际项目经验;
5.具备极强的技术好奇心与自驱力,面对业界无先例的技术难题,能独立思考并推动解决。
加分项:
1.有大规模 RL 训练平台(支持千级 GPU 集群、亿级样本回放)搭建经验;
2.熟悉智能体强化学习(Agentic RL)训练的基础设施优化方案;
3.有 GPU 显存 / 算力优化、网络传输优化(如 NCCL 调优)的实际案例;
4.开源项目贡献者(RL 框架、分布式训练工具等相关项目)。
岗位介绍:
在腾讯,后台开发工程师…
招聘城市:上海
…主流框架研发经验;
3.熟悉大模型后训练与对齐技术(PPO、GRPO、DPO等),熟悉 Verl、ROLL,AReal 等强化学习/分布式计算框架,可以理解并解决 RL过程中的工程痛点;
4.熟悉主流生成模型的原理,在AIGC相关领域具备实际项目经验;
5.具备极强的技术好奇心与自驱力,面对业界无先例的技术难题,能独立思考并推动解决。
加分项:
1.有大规模 RL 训练平台(支持千级 GPU 集群、亿级样本回放)搭建经验;
2.熟悉智能体强化学习(Agentic RL)训练的基础设施优化方案;
3.有 GPU 显存 / 算力优化、网络传输优化(如 NCCL 调优)的实际案例;
4.开源项目贡献者(RL 框架、分布式训练工具等相关项目)。
岗位介绍:
在腾讯,后台开发工程师…
招聘城市:北京
…主流框架研发经验;
3.熟悉大模型后训练与对齐技术(PPO、GRPO、DPO等),熟悉 Verl、ROLL,AReal 等强化学习/分布式计算框架,可以理解并解决 RL过程中的工程痛点;
4.熟悉主流生成模型的原理,在AIGC相关领域具备实际项目经验;
5.具备极强的技术好奇心与自驱力,面对业界无先例的技术难题,能独立思考并推动解决。
加分项:
1.有大规模 RL 训练平台(支持千级 GPU 集群、亿级样本回放)搭建经验;
2.熟悉智能体强化学习(Agentic RL)训练的基础设施优化方案;
3.有 GPU 显存 / 算力优化、网络传输优化(如 NCCL 调优)的实际案例;
4.开源项目贡献者(RL 框架、分布式训练工具等相关项目)。
岗位介绍:
在腾讯,后台开发工程师…
招聘城市:杭州
…主流框架研发经验;
3.熟悉大模型后训练与对齐技术(PPO、GRPO、DPO等),熟悉 Verl、ROLL,AReal 等强化学习/分布式计算框架,可以理解并解决 RL过程中的工程痛点;
4.熟悉主流生成模型的原理,在AIGC相关领域具备实际项目经验;
5.具备极强的技术好奇心与自驱力,面对业界无先例的技术难题,能独立思考并推动解决。
加分项:
1.有大规模 RL 训练平台(支持千级 GPU 集群、亿级样本回放)搭建经验;
2.熟悉智能体强化学习(Agentic RL)训练的基础设施优化方案;
3.有 GPU 显存 / 算力优化、网络传输优化(如 NCCL 调优)的实际案例;
4.开源项目贡献者(RL 框架、分布式训练工具等相关项目)。
岗位介绍:
在腾讯,后台开发工程师…
招聘城市:深圳
…腾讯“开悟”平台的AIGC及LLM的训练/推理支持,参与基于GPU的高性能计算(HPC)项目设计与开发,负责GPU芯片(NVIDIA/AMD等)的底层性能优化与调优;
2.针对大模型推理、训练等场景,优化和扩展vLLM、SGLang等框架的核心模块,提升计算效率与资源利用率;
3.深入分析GPU硬件架构特性(如Tensor Core、显存带宽、通信机制等),设计并实现高性能算子与算法;
4.探索前沿技术方向(如混合专家模型MoE、动态计算图优化等),推动AI工程化落地的效率提升。
岗位要求:
1.熟悉NVIDIA CUDA/AMD ROCm编程,具备GPU内核优化经验(如PTX指令调优、显存带宽优化);
2.精通Megatron-LM、DeepSpeedI等分布式训练框架,有千亿参数模型并行训练实战经验;
3.熟悉大…
招聘城市:深圳
…腾讯“开悟”平台的AIGC及LLM的训练/推理支持,参与基于GPU的高性能计算(HPC)项目设计与开发,负责GPU芯片(NVIDIA/AMD等)的底层性能优化与调优;
2.针对大模型推理、训练等场景,优化和扩展vLLM、SGLang等框架的核心模块,提升计算效率与资源利用率;
3.深入分析GPU硬件架构特性(如Tensor Core、显存带宽、通信机制等),设计并实现高性能算子与算法;
4.探索前沿技术方向(如混合专家模型MoE、动态计算图优化等),推动AI工程化落地的效率提升。
岗位要求:
1.熟悉NVIDIA CUDA/AMD ROCm编程,具备GPU内核优化经验(如PTX指令调优、显存带宽优化);
2.精通Megatron-LM、DeepSpeedI等分布式训练框架,有千亿参数模型并行训练实战经验;
3.熟悉大…
招聘城市:深圳
…框架的核心模块,提升计算效率与资源利用率;
3.深入分析GPU硬件架构特性(如Tensor Core、显存带宽、通信机制等),设计并实现高性能算子与算法;
4.探索前沿技术方向(如混合专家模型MoE、动态计算图优化等),推动AI工程化落地的效率提升。
岗位要求:
1.熟悉NVIDIA CUDA/AMD ROCm编程,具备GPU内核优化经验(如PTX指令调优、显存带宽优化);
2.精通Megatron-LM、DeepSpeedI等分布式训练框架,有千亿参数模型并行训练实战经验;
3.熟悉大模型训练全流程优化(数据加载、梯度累积、通信压缩等),能通过Profiling工具定位性能瓶颈;
4.优先条件,有DeepSeek系列模型优化经验(如DualPipe调度、MLA注意力优化)或参与过相关开源项目贡献。
岗位介绍:
在腾讯,后台开发工程师…
招聘城市:深圳
…框架的核心模块,提升计算效率与资源利用率;
3.深入分析GPU硬件架构特性(如Tensor Core、显存带宽、通信机制等),设计并实现高性能算子与算法;
4.探索前沿技术方向(如混合专家模型MoE、动态计算图优化等),推动AI工程化落地的效率提升。
岗位要求:
1.熟悉NVIDIA CUDA/AMD ROCm编程,具备GPU内核优化经验(如PTX指令调优、显存带宽优化);
2.精通Megatron-LM、DeepSpeedI等分布式训练框架,有千亿参数模型并行训练实战经验;
3.熟悉大模型训练全流程优化(数据加载、梯度累积、通信压缩等),能通过Profiling工具定位性能瓶颈;
4.优先条件,有DeepSeek系列模型优化经验(如DualPipe调度、MLA注意力优化)或参与过相关开源项目贡献。
岗位介绍:
在腾讯,后台开发工程师…
招聘城市:上海
…后台开发工程师不仅是“又快又稳”的问题解决专家,更是生态共创者。你将与技术团队一同沉淀优质代码,让它成为我们共有的宝贵资产。在不同的业务场景和技术发展阶段,你的架构思维也将帮助更多协作团队拓展新的思考。我们也珍视你的挑战精神,同时欢迎你一起参与团队愿景、文化和产品方向的探讨。
部门介绍:
机器学习平台部负责腾讯“太极”机器学习平台的建设,构建面向搜索、广告、推荐的稀疏大模型、大语言模型及稠密大模型和通用机器学习的平台能力,为腾讯广告,微信搜索、社交、游戏、金融、云等多个业务提供易用、高效的一站式机器学习平台服务。我们的技术包括但不限于预训练大模型框架…
招聘城市:深圳
…并解决复杂的系统问题;
8.具备出色的沟通协调能力与团队管理能力,能够有效推动跨团队协作,带领团队攻克复杂技术难题。
加分项:
1.有游戏行业从业经验,熟悉游戏开发全流程与游戏服务器架构;
2.有 Agent 框架、工作流引擎、低代码平台开发经验;
3.有大规模 GPU 集群管理与调度经验;
4.有开源项目维护经验,在 GitHub 上有高星项目;
5.对 Harness 工程、MLOps 有深入理解与实践经验;
6.熟悉游戏资产处理技术,有 3D 模型、纹理、动画处理经验。
岗位介绍:
在腾讯,后台开发工程师不仅是“又快又稳”的问题解决专家,更是生态共创者。你将与技术团队一同沉淀优质代码,让它成为我们共有的宝贵资产。在不同的业务场景和…
招聘城市:北京
…DiT模型训练性能优化经验者优先;
4.熟练掌握CUDA性能优化手段,有算子编写优化项目经验者优先;
5.对大模型前沿技术比较敏锐者优先;
6.有实际大模型的训练调参和效果评测项目经验的优先;
7.良好的沟通能力、解决问题能力。
部门介绍:
机器学习平台部负责腾讯“太极”机器学习平台的建设,构建面向搜索、广告、推荐的稀疏大模型、大语言模型及稠密大模型和通用机器学习的平台能力,为腾讯广告,微信搜索、社交、游戏、金融、云等多个业务提供易用、高效的一站式机器学习平台服务。我们的技术包括但不限于预训练大模型框架、高性能参数服务器、CPU/GPU 训练和推理加速、图神经网络、NLP自然语言处理、搜索工程与…
招聘城市:深圳
…Debug 能力;
2.训练框架经验: 深入理解大模型分布式训练原理,具备 Megatron-LM、DeepSpeed 或 PyTorch FSDP 等主流框架的实际源码级开发与定制经验;
3.RL 与 RL Infra 储备: 熟悉大模型后训练与对齐技术(PPO、GRPO、DPO等),熟悉 Verl、ROLL,AReal 等强化学习/分布式计算框架,可以理解并解决 RL过程中的工程痛点;
4.综合素质: 具备极强的技术好奇心与自驱力,面对业界无先例的技术难题,能独立思考并推动解决。
岗位介绍:
渴望为世界带来新意的人,早已对描绘未来的“热词”不陌生——人工智能、机器学习、数据科学等等。腾讯始终在业界前沿不断探索,积极布局,并为优秀的你提供无限广阔的舞台。我们坚信科技的不断革新,最终能带来…
招聘城市:深圳
…在CV、多模态有相应的技术研发,了解LLM、多模态融合等相关技术;熟悉一个或多个模态领域的主流模型和算法,如CLIP、LLAVA、VALL-E等;
3.熟悉深度学习框架,如TensorFlow或Pytorch;了解分布式训练框架,如Deepspeed和Meatron-LM等,并有一定的多机多卡分布式训练经验;
4.较强的工程实现能力,熟练掌握C/C++, JAVA,Python等至少一种语言;
5.在顶级学术会议上发表论文者优先,包括而不限于NIPS/ICML/CVPR/ICCV/ECCV。
岗位介绍:
渴望为世界带来新意的人,早已对描绘未来的“热词”不陌生——人工智能、机器学习、数据科学等等。腾讯始终在业界前沿不断探索,积极布局,并为优秀的你提供无限广阔的舞台。我们坚信科技的…
招聘城市:深圳
…负责语音/音频大模型研发,包括语音对话(语音交互/音视频对话)、音频理解(ASR/音频caption)、音频生成(TTS/视频配音)等模型研发;
2.负责语音/音频大模型的预训练、后训练、强化学习(文本和音频强化)相关的数据和算法工作;
3.负责语音对话/音频理解/音频生成的模型开源以及产品落地(比如语音对话产品全链路端到端优化、音频理解在噪音/口音/远场/音效音乐场景的优化、语音合成在播报/闲聊/游戏/社交等场景的优化)。
岗位要求:
1.有语音对话、语音合成、语音识别、音视频多模态、大语言模型(预训练、微调、强化学习)等相关经验者优先;
2.优秀的代码能力、数据结构和算法功底,熟练掌握Python或C/C++,熟悉Pytorch/Megatron/DeepSpeed等模型训练框架,有ACM…
招聘城市:深圳
…基座,持续提升大模型的推理能力。
岗位要求:
1.有过大模型代码/数学/reasoning方向的研发经历;
2.在post-training方向有一定研究基础,熟悉SFT/DPO/PPO/Reward Model等pipeline;
3.较强的工程实现能力,熟练使用Python语言,有实际编程项目经验,熟悉DeepSpeed、Megatron等分布式训练框架,熟练使用pytorch深度学习框架;
4.计算机科学、机器学习、统计学、应用数学等相关专业在校硕士、博士生;
5.在高水平国际会议和学术期刊发表过相关论文,或有高水平竞赛获奖经历优先。
部门介绍:
机器学习平台部负责腾讯“太极”机器学习平台的建设,构建面向搜索、广告、推荐的稀疏大模型、大语言模型及稠密大模型和通用机器学习的平台能力,为腾讯广告,微信搜索、社交、游戏…
招聘城市:深圳
…模块算子设计、KV Cache等核心加速方向的算法研发;
3.负责将加速算法应用于多模态生成大模型,确保模型在推理延迟、显存占用等指标达到行业领先的技术水平;
4.跟进业界前沿的大模型训练与加速技术,快速迭代并落地创新加速方案,保障多模态生成大模型的工程化落地和商业化竞争力。
岗位要求:
1.计算机科学、人工智能或相关专业硕士及以上学历;
2.精通大规模模型训练范式,包括预训练(Pretraining)、监督微调(SFT)、多任务联合训练、蒸馏训练、后训练(如 RLHF/DPO 等),理解训练稳定性及效率优化方法,熟悉模型推理优化技术,有一定的实践经验;
3.具备优秀的编程能力,精通Python,熟练掌握PyTorch/TensorFlow等深度学习框架及常用工具链;…
招聘城市:上海
…环境,熟悉Python和数据库相关语言,熟悉PyTorch训练框架;
5.擅长从数据角度进行深入挖掘研究,对数据敏感,具备较强的逻辑思维和数据分析能力;
6.有良好的团队合作精神和沟通能力,对体育品类产品玩法及各系统模块具有一定了解者优先。
加分项:
1.有大型游戏项目数据体系建设经验;
2.在Kaggle等平台有竞赛获奖经历,或发表过数据科学相关论文/专利;
3.掌握实时计算框架(如Flink)和大数据处理工具(如Spark);
4.熟悉游戏研发流程,对数值策划、战斗系统等业务模块有深入理解。
岗位介绍:
渴望为世界带来新意的人,早已对描绘未来的“热词”不陌生——人工智能、机器学习、数据科学等等。腾讯始终在业界前沿不断探索,积极布局…