招聘城市:北京
…稳定的模型训练平台,支持大模型场景下的训练效率与稳定性;
3.参与大模型场景下的推理性能优化,包括模型量化策略设计与实现、推理引擎优化加速,以及高稳定性推理服务开发;
4.分析Transformer等结构在搜索业务场景下的性能瓶颈,支持高性能Kernel实现、不同加速卡的适配优化,以及软硬件协同调优。
岗位要求:
1.本科及以上学历,计算机相关专业;
2.优秀的C++编程能力,熟练掌握常用数据结构与算法,具备良好的软件工程能力、逻辑思维与快速学习能力;
3.良好的团队合作意识与沟通能力;
4.熟悉常见的深度学习训练框架(如Megatron-LM/Verl)及推理框架(如TensorRT、sglang等)。
岗位介绍:
在腾讯,后台开发工程师不仅是“又快又稳…
招聘城市:北京
…2.参与微信输入法核心功能设计、开发及维护,包括但不限于服务性能调优、技术难点攻坚、指标自动化监控、异构大模型调度等;
3.参与维护后台服务,保证线上稳定性,以及搭建自动化分析系统,提升工程效率;
4.参与新技术调研以及探索,以及项目特定方向的重点、难点开发工作。
岗位要求:
1.本科及以上学历,计算机相关专业;
2.有1年及以上的工程开发经验;
3.熟悉C++/Golang/Python等一种或多种编程语言;扎实的系统开发和数据结构功底;掌握后台或数据分析技术,参与工具、后台模块的开发(例如AB实验/指标自动化监控等);
4.具备大模型部署和加速相关经验者优先;
5.具有良好的工程素养,包括但不限于文档撰写…
招聘城市:广州
…职责:
1.负责大模型训练框架的开发和优化,支撑高效稳定的大规模训练任务;
2.参与大模型应用层面的开发,包含 Agent 应用、RAG 实现与调优、数据合成、自动化测评等。
岗位要求:
1.熟练掌握 C/C++/Python 等至少一门编程语言,具备扎实的数据结构和算法功底;
2.有海量服务开发经验,熟悉分布式系统设计与优化,具备良好的工程素养;
3.熟悉主流大模型训练框架 Megatron/DeepSpeed,熟悉分布式训练调优;
4.具备良好的数据处理能力,具备快速学习能力,有团队合作精神;
5.对于探索前沿技术有热情,具备独立探索前沿技术的能力。
加分项:
1.熟悉大模型相关算法,参与过百卡以上训练任务优先;
2.有大模型应用研发经验,熟悉 Agent 构建…
招聘城市:广州
…职责:
1.负责大模型训练框架的开发和优化,支撑高效稳定的大规模训练任务;
2.参与大模型应用层面的开发,包含 Agent 应用、RAG 实现与调优、数据合成、自动化测评等。
岗位要求:
1.熟练掌握 C/C++/Python 等至少一门编程语言,具备扎实的数据结构和算法功底;
2.有海量服务开发经验,熟悉分布式系统设计与优化,具备良好的工程素养;
3.熟悉主流大模型训练框架 Megatron/DeepSpeed,熟悉分布式训练调优;
4.具备良好的数据处理能力,具备快速学习能力,有团队合作精神;
5.对于探索前沿技术有热情,具备独立探索前沿技术的能力。
加分项:
1.熟悉大模型相关算法,参与过百卡以上训练任务优先;
2.有大模型应用研发经验,熟悉 Agent 构建…
招聘城市:北京
…的后台系统设计与开发、推理性能优化,确保系统高性能和高可用性;
3.大模型相关业务功能开发,基础框架与工具建设等;
4.跟踪前沿技术,推动研究成果在业务场景的落地。
岗位要求:
1.计算机相关专业,本科及以上学历;
2.熟悉 linux 开发环境,优秀的 C++ 编程经验,熟练掌握常用数据结构与算法,有一定的软件工程能力和良好的编程能力;
3.了解常见的深度学习训练框架(如 HuggingFace,Megatron,DeepSpeed,PyTorch) 以及推理框架(如 VLLM、SGLang、TRT);
4.具备良好的逻辑思维、快速学习能力、分析和解决问题的能力;
5.对于探索前沿技术有很好的热情,具备独立探索前沿技术的能力,有良好的团队协作和沟通能力。
加分项:
1.主导过基座大模型后…
招聘城市:广州
…
3.与搜索算法团队紧密合作,设计实现高性能的AI搜索大模型,加速最新的大模型技术在搜索场景的落地。
岗位要求:
1.具备较强的动手能力;熟悉 Python ,具备扎实的系统编程功底和优秀的复杂系统 Debug 能力;
2.深入理解大模型分布式训练原理,具备 Megatron-LM、DeepSpeed 或 PyTorch FSDP 等主流框架的开发和优化经验;
3.熟悉大模型后训练与对齐技术(PPO、GRPO、DPO等),熟悉 Verl、ROLL,AReal 等强化学习/分布式计算框架,有实际开发部署并解决相关问题的经验;
4.熟悉最新的大模型结构,熟悉各种软硬件架构,能够结合具体的模型结构和软硬件架构做训练过程的深度优化。
岗位介绍:
在腾讯,后台开发工程师不仅是“又快又稳”的…
招聘城市:北京
岗位职责:
1.负责微信生态内大模型智能应用的后端架构设计与核心系统开发;
2.设计和实现高性能、高可用的Agent系统、长上下文对话引擎及多模态交互管道,支撑亿级用户的高并发、低延迟访问;
3.探索和落地大模型领域的先进工程实践,包括但不限于智能体(Agent)工作流、模型微调、推理优化与成本管控,持续提升产品智能化水平与用户体验。
岗位要求:
1.对大型语言模型(LLM)及其应用开发(如RAG、Agent、Function Calling)有深入理解和实践经验;
2.具备优秀的C++语言编程能力和扎实的系统设计能力,熟悉主流Web后端框架与高可用架构;
3.了解LangChain、dify等LLM应用开发框架,并有实际生产项目经验;
4.熟悉…
招聘城市:北京
…自动化全量/灰度发布及故障自愈机制;
3.大模型推理加速: 负责微信输入法大模型(LLM)的后端服务部署,针对模型推理的端到端时延(Latency)、系统吞吐量(Throughput)及服务稳定性进行极致优化;
4.工程效率提升: 研发自动化数据分析系统与中台工具,通过工程化手段提升策略迭代与模型部署的效率;
5.前沿技术预研: 参与新技术调研以及探索,以及项目特定方向的重点、难点开发工作。
岗位要求:
1.基础扎实: 本科及以上学历,计算机相关专业,具备深厚的算法、数据结构及操作系统底蕴;
2.工程实战: 1 年及以上工业级项目开发经验,精通 C++ 或 Go(有高性能并发编程经验者优先),熟悉 Python 脚本语言;
3.技术广度: 熟悉 Linux 环境…
招聘城市:北京
…模型管理、推理引擎集成等工作;
3.负责推理加速方法的工程实现和落地,包括但不限于模型剪枝、模型量化、动态batch等方法;
4.调研前沿技术,推动稀疏化推理、异构推理、分布式推理等技术在业务中的集成应用。
岗位要求:
1.计算机、电子工程等相关专业,2年以上推理优化经验;
2.精通C++/Go/Python,熟悉CUDA/OpenCL高性能编程;
3.至少熟练掌握一种推理框架(TensorRT/Triton/vLLM/sglang),有二次开发经验;
4.熟悉量化、剪枝、动态Shape、算子融合等优化方法的基本原理和适用场景;
5.具备较强的团队合作和沟通能力,能够与团队成员、业务部门紧密协作,完成项目交付和技术创新。
岗位介绍:
在腾讯,后台开发工程师不仅是“又快又稳”的问题解决专家,更是…
招聘城市:北京
…
2.参与微信读书、微信输入法的 AI 应用的持续探索和落地;
3.参与长上下文任务的推理优化、索引构建、复杂语义理解以及内容理解的工程落地和优化,负责 AI 应用系统及其数据工程链路的构建和维护;
4.基于大模型,优化现有的开发和数据链路,提升研发效率;
5.参与新技术调研以及探索,包括大模型相关的工程算法的探索和逻辑,并且参与项目特定方向的重点、难点开发工作。
岗位要求:
1.熟悉 C++/Golang 等一种或多种编程语言;扎实的系统开发和数据结构功底;
2.对大模型(LLM、 LVM 等)、Agent 等技术以及大模型部署有基本的了解和认识;
3.对后台研发常用的开源组件,如 Mysql,Redis,Kafka 等,有一定应用…
招聘城市:北京
…但不限于GPU,RDMA,存储等硬件设备,RL/训练算法等技术方向。最终将硬件性能榨干,加速大语言模型落地;
2.一个人无法穷尽AI系统的各方面能力。只要有独特经验和独到观点,推进某一个维度优化系统即可;
3.同时希望您认同我们产品优先,乐于挑战的文化,推动微信AI产品落地过程中AI Infra加速工作。
岗位要求:
1.扎实的编程能力,技术风格以及责任心;
2.具有自我驱动的工作能力,能够持续改进系统不足,提出方案并推动实现。
加分项:
1.对主流开源软件有贡献。
岗位介绍:
在腾讯,后台开发工程师不仅是“又快又稳”的问题解决专家,更是生态共创者。你将与技术团队一同沉淀优质代码,让它成为我们共有的宝贵资产…
招聘城市:北京
…优化LLM,VLM等大模型的推理引擎,构建适合AI Search,智能 Agent相关领域大规落地应用中的推理基础架构;
2.紧跟 LLM Infra 领域的前沿技术演进突破,将合适成果落地于实际应用;
3.与搜索算法同学深度合作,联合优化,设计实现能够给大型搜索系统带来代际更迭的大模型。
岗位要求:
1.熟悉AI基础硬件设置,有真实的大规模推理系统的设计开发部署经验;
2.熟悉各种主流LLM/VLM的模型结构,具有 vllm/sglang/TRT-llm等推理引擎优化实践经验;
3.熟悉LLM 推理常用加速方法(算子融合、量化策略、动态批处理、分布式KV 缓存优化等);
4.有针对真实场景问题的LLM 模型结构和的设计优化经验。
岗位介绍:
在腾讯,后台开发工程师不仅是“又快又稳…
招聘城市:北京
…LLM,VLM等大模型的推理引擎,构建适合AI Search,智能 Agent相关领域大规落地应用中的推理基础架构;
3.紧跟 LLM Infra 领域的前沿技术演进突破,将合适成果落地于实际应用;
4.与搜索算法同学深度合作,联合优化,设计实现能够给大型搜索系统带来代际更迭的大模型。
岗位要求:
1.岗位要求:;
2.熟悉AI基础硬件设置,有真实的大规模推理系统的设计开发部署经验;
3.熟悉各种主流LLM/VLM的模型结构,具有 vllm/sglang/TRT-llm等推理引擎优化实践经验;
4.熟悉LLM 推理常用加速方法(算子融合、量化策略、动态批处理、分布式KV 缓存优化等);
5.有针对真实场景问题的LLM 模型结构和的设计优化经验。
岗位介绍:
在腾讯,后台开发工程师不仅是…
招聘城市:广州
…流式推理等核心链路;
2.负责大模型应用层工程建设,包括 Prompt 工程框架、Model Registry、LLM Tracing、模型网关对接与兼容层开发;
3.参与实时协作服务(基于 Yjs/CRDT + WebSocket)的架构演进与性能优化;
4.负责业务 API 服务(Go/Node.js)的设计与开发,涵盖认证鉴权、服务发现、数据持久化等基础能力;
5.参与分布式系统架构设计,包括多副本一致性、消息总线、调度系统等。
岗位要求:
1.本科及以上学历,计算机相关专业;
2.熟悉 Go 或 c++ 或者 Node.js/TypeScript,有服务端开发经验;
3.了解大模型(LLM)应用开发范式,熟悉 Function Calling / Agent / RAG 等常见模式,有实际落地经验者优先;
4.熟悉至少一种主流数据库(PostgreSQL / MySQL)及缓存系统(Redis),具备数据建模与查询优化…
招聘城市:广州
…AI 工程提效工具,如智能客服、智能运维等。
岗位要求:
1.本科及以上学历,计算机相关专业,一年以上后台开发经验;
2.熟练掌握至少一种后端语言(Go/Python/Java/C++),有高并发服务开发经验;
3.熟悉分布式系统设计原理,了解高并发设计、一致性协议、消息队列、事件驱动架构等;
4.有 LLM 应用落地经验,熟悉流式推理、多轮对话状态管理、Function Calling 等机制;
5.对性能优化与成本控制有实际经验,具备良好的工程抽象与问题解决能力。
加分项:
1.有 Agent 运行时(状态机、工具沙箱、会话管理)开发经验;
2.了解推理服务优化(vLLM/SGLang 等)或模型量化部署;
3.熟悉可观测性体系(Metrics/Tracing/Logging);
4.是微信读书深度用户,对阅读场景有…
招聘城市:北京
…熟悉cutlass等加速库是加分项;
3.熟悉主流大模型推理框架,如vllm,sglang,tensorrt-llm,FasterFransformer等;
4.熟悉各类深度学习网络和算子底层实现细节,训练和推理模型调试、调优有实操经验优先;
5.熟悉并行策略,如模型并行、流水线并行等,了解NVLINK、GPU通信者优先;
6.具备GPU、AI芯片体系结构知识,熟悉芯片特性,具备系统性能分析和调优经验优先;
7.加分项:;
8.机器学习或者体系结构相关顶会论文;
9.参与vllm、sglang等开源项目贡献者;
10.熟悉推理服务框架,具备服务部署经验者优先,有超大模型分布式部署经验优先。
岗位介绍:
在腾讯,后台开发工程师不仅是“又快又稳”的问题解决专家,更是生态共创者。你将与技术团队一同沉淀…
招聘城市:广州
…对模型服务性能做极致优化,保证需求的快速迭代和高质量稳定运行;
3.结合业务场景对模型进行管理调度以及针对性优化,提升业务的稳定性;
4.完成内部AI应用研效工具建设,帮助产品迅速落地想法,提升迭代效率。
岗位要求:
1.本科以上学历,计算机相关专业,有2年或以上服务端开发经验;
2.熟练掌握常见的编程语言(如 C++,Python、Java、Go 等),熟练掌握深度学习框架(如 TensorFlow、PyTorch);
3.有海量服务开发、网络通信优化、计算性能优化经验者优先;
4.有大模型应用经验,能够运用大语言模型(如 GPT、BERT)进行实际场景开发与优化,在学术界/工程界有落地的实践经验者优先;
5.强烈的自我驱动能力,独立推进技术研发并解决实际问题。
招聘城市:北京
…异构大模型调度等;
4.参与维护后台服务,保证线上稳定性,以及搭建自动化分析系统,提升工程效率;
5.参与新技术调研以及探索,以及项目特定方向的重点、难点开发工作。
岗位要求:
1.熟悉 C++/Golang 等一种或多种编程语言;扎实的系统开发和数据结构功底;
2.对语言大模型、多模态大模型、Agent 等技术以及大模型部署有基本的了解和认识;
3.对后台研发常用的开源组件,如 Mysql,Redis,Kafka 等,有一定应用经验;
4.具有良好的工程素养。包括但不限于文档撰写能力、单元测试能力、版本管理能力,以及良好的沟通表达能力、工作认真负责,能够保持开放、持续学习,善于发现问题,具备良好的团队合作精神等。
岗位介绍:
在腾讯,后台开发工程师…
招聘城市:上海
…1.熟悉主流大模型推理框架,如vllm,lightllm,tensorrt-llm,lmdeploy,faster transformer等;
2.熟悉CUDA,triton(https://openai.com/research/triton)、cutlass至少一种以上,精通者优先;
3.熟悉大模型结构,了解大模型性能瓶颈,熟练分析单机及分布式情况下不同性能热点和优化手段;
4.熟悉大模型量化算法,int8/fp8/混合精度量化,了解模型蒸馏、稀疏化、剪裁技术;
5.熟悉推理服务框架,具备服务部署经验者优先,了解k8s,容器化服务,Triton Inference Server (https://github.com/triton-inference-server/server)实现原理者优先;
6.熟悉分布式模型部署及并行策略,如模型并行、流水线并行等,了解NVLINK、GPU通信者优先;
7.熟练掌握Python及C++;
8.了解GPU体系结构者优先。
岗位介绍:
在腾讯,后台开发工程师不仅是“又…
招聘城市:深圳
…领先的大模型在线推理平台,构建支撑亿级日调用量的高性能、高可用、高扩展的服务体系,为公司AI业务提供坚实的推理能力基座;
2.负责设计高性能推理服务架构,结合推理引擎与底层硬件的核心特性,优化动态调度、资源管理等核心后台策略,实现服务性能与成本效益的最优化;
3.负责研发标准化的推理服务框架与配套工具链,打通从模型研发、性能优化到线上部署的全链路流程,提升推理服务工程化落地效率;
4.负责构建平台的高可用架构与可观测性体系,落地故障容灾、限流熔断等核心能力,为容量规划、应急响应提供数据与技术支撑,保障服务的可靠性。
岗位要求:
1.具备扎实的后端研发功底…