牛大妈在社招职位搜索高性能计算工程师-深圳or北京or 有 320 条结果

招聘城市:深圳
计算机相关专业本科及以上学历,2年以上高性计算相关工作经验;
2.熟练掌握C++/Python等编程语言,有大规模并行计算或分布式系统开发经验;
3.深入理解计算机体系结构、并行计算原理,熟悉Nvidia GPU/NPU加速技术;
4.具备Linux系统下的高性调优经验,熟悉常见性能分析工具和方法;
5.良好的团队协作能力和沟通能力,能够跨团队高效合作推动项目落地;
6.对技术有热情,具备较强的学习能力和创新意识。
加分项:
1.熟悉LLM推理场景下的高性计算优化,有开源框架的优化经验(如vLLM,SGLang,MindIE等);
2.在高性计算领域发表过相关论文或有开源项目贡献。
岗位介绍:
在腾讯,后台开发工程不仅是…
招聘城市:深圳
计算机相关专业本科及以上学历,2年以上高性计算相关工作经验;
2.熟练掌握C++/Python等编程语言,有大规模并行计算或分布式系统开发经验;
3.深入理解计算机体系结构、并行计算原理,熟悉Nvidia GPU/NPU加速技术;
4.具备Linux系统下的高性调优经验,熟悉常见性能分析工具和方法;
5.良好的团队协作能力和沟通能力,能够跨团队高效合作推动项目落地;
6.对技术有热情,具备较强的学习能力和创新意识。
加分项:
1.熟悉LLM推理场景下的高性计算优化,有开源框架的优化经验(如vLLM,SGLang,MindIE等);
2.在高性计算领域发表过相关论文或有开源项目贡献。
岗位介绍:
在腾讯,后台开发工程不仅是…
招聘城市:北京
…技术的创新。
岗位要求:
1.人工智能、计算机、数学等相关专业;
2.8年以上GPU研发或项目经验,有学术研究成果优先;
3.深入了解GPU硬件架构特性,具备算力诊断调优经验,场景覆盖训推程序的功能和性能异常,以及算力的性能异常;
4.熟悉NVIDIA CUDA/AMD ROCm编程,具备GPU内核虚拟化经验(如算力绝对抢占优化,kernel使用预测等);
5.熟悉深度学习框架(Pytorch, Tensorflow等),深度优化算力的运行效率;
6.有管理能力,对人工智能技术及行业有前瞻性思考。
岗位介绍:
在腾讯,后台开发工程不仅是“又快又稳”的问题解决专家,更是生态共创者。你将与技术团队一同沉淀优质代码,让它成为我们共有的宝贵资产。在不同的…
招聘城市:上海
…SASS, TVM)进行极致的算子级性能调优;
4.具备使用 CUDA/Triton 或国产 AI 芯片的底层编程语言(如 Ascend C)进行高性算子(如 Attention, GEMM)开发与优化的丰富实战经验;
5.熟悉 MLIR, LLVM 等编译器技术,对 NVIDIA/AMD/昇腾/海光/天数 等主流 AI 芯片的底层内核优化有体系化的知识和实践;
6.有千亿参数大模型成功部署和极致性能优化的平台化建设经验;
7.在 MLSys, NeurIPS, ICML, ICLR 等顶级会议发表过 AI 系统或推理优化相关论文,或拥有相关核心技术专利。
岗位介绍:
在腾讯,后台开发工程不仅是“又快又稳”的问题解决专家,更是生态共创者。你将与技术团队一同沉淀优质代码,让它成为我们共有的宝贵资产。在不同…
招聘城市:深圳
…SASS, TVM)进行极致的算子级性能调优;
4.具备使用 CUDA/Triton 或国产 AI 芯片的底层编程语言(如 Ascend C)进行高性算子(如 Attention, GEMM)开发与优化的丰富实战经验;
5.熟悉 MLIR, LLVM 等编译器技术,对 NVIDIA/AMD/昇腾/海光/天数 等主流 AI 芯片的底层内核优化有体系化的知识和实践;
6.有千亿参数大模型成功部署和极致性能优化的平台化建设经验;
7.在 MLSys, NeurIPS, ICML, ICLR 等顶级会议发表过 AI 系统或推理优化相关论文,或拥有相关核心技术专利。
岗位介绍:
在腾讯,后台开发工程不仅是“又快又稳”的问题解决专家,更是生态共创者。你将与技术团队一同沉淀优质代码,让它成为我们共有的宝贵资产。在不同…
招聘城市:深圳

1.本科及以上学历,计算机相关专业,三年以上相关项目研发工作经验;
2.精通C/C++开发,熟悉Shell, Python等脚本语言;
3.深刻理解二三层网络,熟悉TCP/IP协议栈;
4.了解云网络业务和主流虚拟网络技术架构;
5.熟悉tcpdump、perf、iperf、netstat等常见网络性能分析工具,并有实际排障经验;
6.有实际参与过lb、nat、vrouter、vswitch等网关系统研发或者性能优化者优先考虑;
7.有实际参与过smartswitch、smartnic等网络产品研发者优先考虑;
8.有多核平台下开发及性能调优经验,如DPDK、p4等优先考虑;
9.自驱、尽责,有良好的沟通表达和团队协作能力。
岗位介绍:
在腾讯,后台开发工程不仅是“又快又稳”的问题解决专家,更是生态共创…
招聘城市:深圳
…性;
4.与编译器、runtime及业务团队协作,推动模型在自研芯片上的端到端性能优化与落地。
岗位要求:
1.熟悉 Linux 开发环境,扎实掌握 C++/Python,具备良好的代码能力和工程能力;
2.熟悉异构计算高性计算基础,理解并行编程、向量化、线程/任务调度、访存优化等基本原理;
3.熟悉 PyTorch、TensorFlow 等主流深度学习框架;
4.具备性能瓶颈定位与调优能力,具备profile和debug工具使用经验。
加分项:
1.有GPU、DSA、DSP上的算子开发和性能优化经验者优先;
2.有 CUDA、ROCm生态开发经验者优先;
3.有 LLM 推理优化、融合算子开发、低精度计算或算子测试框架建设经验者优先;
4.熟悉线性代数、概率统计、数值计算或优化方法者优先。
招聘城市:深圳
岗位职责:
1.负责腾讯云底层网络数据转发(Virtual Switch)相关的开发工作;
2.排查、定位并解决网络相关的问题;
3.持续优化产品,提高可靠性与性能;
4.改善工作流程,提高开发、测试和运维效率。
岗位要求:
1.本科及以上学历,3年以上C/C++网络编程经验,数据结构和算法基础扎实;
2.熟悉TCP/IP等网络协议,有DPDK、Linux内核或者性能优化相关经验者优先;
3.思维严密,逻辑清晰,对工作精益求精;
4.具有良好的沟通、学习和分析解决问题能力;
5.责任心强,抗压能力强,有团队精神。
加分项:
1.在同等条件下,通过腾讯云认证或取得同等资格认证的候选人,我们会优先考虑。
招聘城市:北京
…性;
4.与编译器、runtime及业务团队协作,推动模型在自研芯片上的端到端性能优化与落地。
岗位要求:
1.熟悉 Linux 开发环境,扎实掌握 C++/Python,具备良好的代码能力和工程能力;
2.熟悉异构计算高性计算基础,理解并行编程、向量化、线程/任务调度、访存优化等基本原理;
3.熟悉 PyTorch、TensorFlow 等主流深度学习框架;
4.具备性能瓶颈定位与调优能力,具备profile和debug工具使用经验。
加分项:
1.有GPU、DSA、DSP上的算子开发和性能优化经验者优先;
2.有 CUDA、ROCm生态开发经验者优先;
3.有 LLM 推理优化、融合算子开发、低精度计算或算子测试框架建设经验者优先;
4.熟悉线性代数、概率统计、数值计算或优化方法者优先。
招聘城市:深圳
…领先业界的计算内核, 推进大数据业务的高效发展;
2.负责腾讯计算内核领域前沿技术调研,与开源社区保持交流,根据业务特性和需求,引入前沿技术。
岗位要求:
1.计算机相关专业硕士及以上学历为佳,具有扎实的数据库、分布式计算领域专业知识,关注学术和工业界的进展,关注新硬件,新架构,对某一细分方向有深入研究者更优;
2.熟悉主流大数据组件如spark、presto、flink、starrocks等,熟悉数据库/大数据标准模块、框架如substrait、calcite、arrow、velox、gluten等;
3.熟悉k8s、对云原生、混合多云有一定了解;
4.具有优秀的学习能力、创新能力、沟通能力、团队合作意识;强烈的责任心与主动性,对所负责工作有owner意识,并自我驱动成长…
招聘城市:深圳
…+、Python语言,有计算机体系结构背景或软件开发背景,熟悉系统性能调优的方式;
2.具备基础的GPU编程能力,包括但不限于Cuda、OpenCL,熟悉至少一种GPU加速库,如cublas、cudnn、cutlass等;
3.具备Tensorrt/FasterTransformer/Tensorrt-llm/vllm/sglang等推理引擎的使用和性能优化经验;
4.熟悉各类深度学习网络和算子底层实现细节,具备训推模型调试、调优实操经验优先;
5.熟悉CPU/GPU异构加速瓶颈分析方法,有服务器端 AI 芯片、GPU加速经验优先;
6.熟悉分布式推理常用加速方法,有超大模型分布式部署经验优先。
岗位介绍:
在腾讯,后台开发工程不仅是“又快又稳”的问题解决专家,更是生态共创者。你将与技术团队一同沉淀优质代码,让它成为我们…
招聘城市:深圳
…推理框架,如vllm,sglang,tensorrt-llm,FasterFransformer等优先;
6.熟悉并行策略,如模型并行、流水线并行等,了解NVLINK、GPU通信者优先;
7.具备GPU、AI芯片体系结构知识,熟悉芯片特性,具备系统性能分析和调优经验优先。
加分项:
1.机器学习或者体系结构相关顶会论文;
2.参与vllm、sglang等开源项目贡献者;
岗位介绍:
在腾讯,后台开发工程不仅是“又快又稳”的问题解决专家,更是生态共创者。你将与技术团队一同沉淀优质代码,让它成为我们共有的宝贵资产。在不同的业务场景和技术发展阶段,你的架构思维也将帮助更多协作团队拓展新的思考。我们也珍视你的挑战精神,同时欢迎你一起参与团队愿景、文化和产品方向的探讨。
招聘城市:北京
…Python/Java等一种或多种语言和调试工具,具有丰富的工程经验;
3.熟悉常用的算法和数据结构,具有良好的软件工程意识,有高并发、大规模后台服务开发经验优先;
4.了解业界常见的分布式存缓系统,比如Alluxio、3FS、CEPH、AWS-S3、JuiceFS等,对RDMA、FUSE、文件系统有实际经验者更优;
5.了解模型训练和推理的过程,对训练数据和模型加载、checkpoint、KVCache、GPU、训练和推理框架有了解者更优;
6.具有优秀的学习能力、分析和解决问题能力、沟通能力、团队合作意识,具有强烈的责任心与主动性,对所负责工作有owner意识;
7.有开源项目贡献,参与顶会发表论文等贡献者优先。
岗位介绍:
在腾讯,后台开发工程不仅是“又快又稳”的…
招聘城市:西安
…手段。​;
3.高性计算基础扎实​,深入理解并行计算原理,精通国产芯片的内存优化、通信优化等关键技术​;
4.熟练掌握 C/C++、Python,具备算子级代码优化能力,基于国产硬件特性设计高效算法,有自定义算子开发(如融合算子实现)经验者优先​;
5.2年以上国产芯片高性计算开发经验,至少深度参与过一款昇腾、寒武纪、海光或昆仑芯的 AI 项目优化,有大规模国产集群部署经验者优先。
加分项:
1.通过腾讯云从业资格证或同等资格认证的优先录取。
岗位介绍:
在腾讯,后台开发工程不仅是“又快又稳”的问题解决专家,更是生态共创者。你将与技术团队一同沉淀优质代码,让它成为我们共有的宝贵资产。在…
招聘城市:深圳
…Python/Java等一种或多种语言和调试工具,具有丰富的工程经验;
3.熟悉常用的算法和数据结构,具有良好的软件工程意识,有高并发、大规模后台服务开发经验优先;
4.了解业界常见的分布式存缓系统,比如Alluxio、3FS、CEPH、AWS-S3、JuiceFS等,对RDMA、FUSE、文件系统有实际经验者更优;
5.了解模型训练和推理的过程,对训练数据和模型加载、checkpoint、KVCache、GPU、训练和推理框架有了解者更优;
6.具有优秀的学习能力、分析和解决问题能力、沟通能力、团队合作意识,具有强烈的责任心与主动性,对所负责工作有owner意识;
7.有开源项目贡献,参与顶会发表论文等贡献者优先。
岗位介绍:
在腾讯,后台开发工程不仅是“又快又稳”的…
招聘城市:北京
标题: 【招聘】高级测试工程北京
招聘摘要: 【招聘】高级测试工程北京岗位职责:负责组内测试技术体系建设,提升整体测试效率(工具化 / 自动化 / 流程优化)主导重大项目测试方案设计与落地,保障金融/交易类系统高质量交付独立搭建并维护自动化测试框架(接口 / UI / 服务层)引入 AI 能力提升测试效率(用例生成、日志分析、回归优化等)在关键项目中承担技术支持与质量兜底职责任职要求:5年以上测试经验,具备扎实测试技术基础有复杂系统(金融 / 交易 / 支付 / 分布式)测试经验优先有独立搭建自动化测试框架经验熟悉接口 / 自动化测试,至少掌握一门开发语言(Java / Python / Go)理解系统级问题(幂等性、一致性、并发等)加分项:交易系统(撮合 / 行情…
招聘城市:深圳
岗位职责:
1.基于自研芯片,研发高性推理与训练框架,解决芯片落地过程中的全链路问题;
2.根据硬件特性和AI模型特点,不断迭代和完善框架性能和易用性、持续提升推理模型整网性能,和业务一起构建自研芯片软件生态。
岗位要求:
1.熟悉Linux开发环境,掌握Python/C++等语言,具备良好的编程基础以及系统设计能力;
2.熟悉GPU或SIMD编程体系架构,了解LLM、AIGC等模型结构,能够使用nvpro、nsys等profiler工具;
3.精通主流训练推理框架和加速技术,包括但不限于:Pytorch、Megatron、DeepSpeed、VLLM、Sglang等;
4.具有系统性分析模型性能瓶颈的能力,熟悉从算子调用,到模型训练推理,再到结果返回的功能定义和具体逻辑;
5.具备良好的…
招聘城市:北京
岗位职责:
1.基于自研芯片,研发高性推理与训练框架,解决芯片落地过程中的全链路问题;
2.根据硬件特性和AI模型特点,不断迭代和完善框架性能和易用性、持续提升推理模型整网性能,和业务一起构建自研芯片软件生态。
岗位要求:
1.熟悉Linux开发环境,掌握Python/C++等语言,具备良好的编程基础以及系统设计能力;
2.熟悉GPU或SIMD编程体系架构,了解LLM、AIGC等模型结构,能够使用nvpro、nsys等profiler工具;
3.精通主流训练推理框架和加速技术,包括但不限于:Pytorch、Megatron、DeepSpeed、VLLM、Sglang等;
4.具有系统性分析模型性能瓶颈的能力,熟悉从算子调用,到模型训练推理,再到结果返回的功能定义和具体逻辑;
5.具备良好的…
招聘城市:北京
…6.具备良好的问题定位与性能分析能力,熟练使用 Nsight、nvprof、perf 等性能分析工具进行瓶颈分析和优化。
加分项:
1.有大规模分布式训练实践经验(上百张 GPU 或更大规模),了解常见分布式训练框架与通信库(如 NCCL、Horovod、DeepSpeed、Megatron-LM 等);
2.对深度学习模型结构与训练算法有一定了解(如 Transformer、LLM 训练技巧、优化器、并行算法等),与算法同学就结构与算子设计进行深入讨论;
3.有参加过编程竞赛(如 ICPC、NOI/IOI、Codeforces、AtCoder 等)并取得优异成绩的经历,具备优秀的算法与代码实现能力;
4.有国产异构硬件(如昇腾、寒武纪等)算子开发经验。
岗位介绍:
在腾讯,后台开发工程不仅是“又快又稳”的问题解决专家…
招聘城市:深圳
…6.具备良好的问题定位与性能分析能力,熟练使用 Nsight、nvprof、perf 等性能分析工具进行瓶颈分析和优化。
加分项:
1.有大规模分布式训练实践经验(上百张 GPU 或更大规模),了解常见分布式训练框架与通信库(如 NCCL、Horovod、DeepSpeed、Megatron-LM 等);
2.对深度学习模型结构与训练算法有一定了解(如 Transformer、LLM 训练技巧、优化器、并行算法等),与算法同学就结构与算子设计进行深入讨论;
3.有参加过编程竞赛(如 ICPC、NOI/IOI、Codeforces、AtCoder 等)并取得优异成绩的经历,具备优秀的算法与代码实现能力;
4.有国产异构硬件(如昇腾、寒武纪等)算子开发经验。
岗位介绍:
在腾讯,后台开发工程不仅是“又快又稳”的问题解决专家…