招聘城市:上海
…的设计、改造和实现落地经验;
2.具有大规模YARN集群,或者其他分布式资源管理系统的设计、改造和实现落地经验。
岗位亮点
1.团队负责的系统支撑了美团点评每天数十万报表产出、千万次OLAP分析和几十万adhoc查询的需求,为业务决策提供了最直接的数据支持;
2.基础研发平台有国内优秀的集群和数据规模(万台服务器,百PB数据量),对各种分布式系统有深入的掌控和改造能力,向开源社区累计贡献数百个功能改进和bug修复,培养了多名PMC和committer,通过各种渠道多次输出实践经验;
3.在OLAP等领域有优秀的实践,能够经历自主探索、研发满足各种业务需求的新一代面向分析场景的分布式数据库系统。
招聘城市:北京
…的设计、改造和实现落地经验;
2.具有大规模YARN集群,或者其他分布式资源管理系统的设计、改造和实现落地经验。
岗位亮点
1.团队负责的系统支撑了美团点评每天数十万报表产出、千万次OLAP分析和几十万adhoc查询的需求,为业务决策提供了最直接的数据支持;
2.基础研发平台有国内优秀的集群和数据规模(万台服务器,百PB数据量),对各种分布式系统有深入的掌控和改造能力,向开源社区累计贡献数百个功能改进和bug修复,培养了多名PMC和committer,通过各种渠道多次输出实践经验;
3.在OLAP等领域有优秀的实践,能够经历自主探索、研发满足各种业务需求的新一代面向分析场景的分布式数据库系统。
招聘城市:上海,北京,杭州
…Web前端技术基础,熟悉HTML5, CSS3, JavaScript及现代前端框架(如React, Vue等)。
了解后端服务架构,熟悉RESTful API的设计与实现。
对数据库原理、存储引擎架构、分布式系统有所了解,特别是Redis,RocksDB。
良好的问题分析与解决能力,以及快速学习新技术的能力。
较强的责任心,良好的沟通能力和团队协作精神。
加分项:
有过分布式KV相关开源项目贡献经历者优先。
熟悉Python工作流引擎Airflow优先。
熟悉Docker容器技术和Kubernetes编排工具。
了解微服务架构设计原则。
对分布式系统理论有一定的理解和实践经验。
我们提供:
与行业专家共事的机会,加速个人成长。
实际参与到产品从构思到上线的全过程。
定期的技术分享会和个人发展计划的支持。
招聘城市:上海
…与分布式系统研究所操作系统研发工程师
本团队招收操作系统研发工程师
招聘岗位:操作系统研发工程师
招聘人数:1 名
聘用方式
项目聘用A
招聘条件
大学本科(简称“大学”)及以上学历,学士及以上学位 1、计算机、电子或自动化等相关专业,拥有相关操作系统开发经验,有linux内核开发经验者优先。 2、熟悉ARM体系架构,熟悉处理器微架构、缓存单元、内存控制器、PCIE、文件系统、异常处理等模块,并有相关的工作经验。 3、熟悉ARM64虚拟化技术 4、熟练使用C/C++语言,对Linux底层性能优化有深入理解,对代码质量有追求 5、拥有良好的自驱力和学习能力 6、熟悉飞腾SOC平台(如D2000,E2000Q)更佳
岗位职责
1、负责操作系统的…
招聘城市:北京
…对 CPU/GPU 内存层次、PCIe/NVLink 带宽有清晰概念;理解操作系统核心原理(如进程调度、内存管理);
4、熟悉分布式系统的基本原理(如一致性协议、一致性哈希、负载均衡算法、集合通信 MPI/NCCL),具备良好的分布式思维;
5、具备 CUDA C/C++ 开发或优化经验,或了解 OpenAI Triton 算子编写者优先;
6、熟悉或阅读过主流推理/训练开源项目的源码者优先,如 vLLM、SGLang、TensorRT-LLM、Triton Inference Server、DeepSpeed、Megatron-LM 等
【岗位吸引力】
在这一职位上:
您将有机会参与无人机、机器人领域内大规模的数据处理分析系统的构建,进而为业务的深入发展做出贡献;
您处理的不是实验室的干净数据,而是自动驾驶、多模态智能体等真实物理世界的海量…
招聘城市:上海
计算机学院并行与分布式系统研究所招聘
招聘岗位:运动控制算法工程师
招聘人数:1 名
聘用方式
项目聘用A
招聘条件
大学本科(简称“大学”)及以上学历,无学位要求 1、1.机器人控制、自动控制、机械电子工程专业优先; 2. 熟练掌握C/C++,熟悉基本控制理论,数学功底强,具有较强的逻辑分析能力; 3. 有多关节机器人控制经验,或有工业领域运动控制算法的开发经验,熟悉运动学、动力学理论,精通运动算法及运动控制; 4. 对新知识充满热情,思维灵活,动手能力及执行能力强,有良好的沟通能力,协作精神和进取心,工作态度积极。 5. 优先条件:有工业产线自动化项目落地经验、参与过机器人运动控制算法量产项目者优先…
招聘城市:上海
计算机学院并行与分布式系统研究所招聘博士后
课题组介绍链接: ip***.cn[点击查看]
招聘岗位:博士后
招聘人数:1 名
聘用方式
博士后
招聘条件
研究生教育学历,博士学位 1、具有计算机系统、计算机体系结构、操作系统、安全、芯片架构等相关专业博士学位者优先,年龄一般不超过35周岁,身心健康 2、具有软硬协同系统、安全体系结构、操作系统、可信计算、AI 系统优化等方向的相关研究基础 3、具备独立开展科学研究的能力,具有较强的中英文写作、沟通和学术表达能力 4、具备严谨的学术态度、敬业精神、团队合作意识与良好的沟通协调能力 5、能全职在校从事科研工作
岗位职责
1、在合作导师指导下开操作系统方向的科研工作 2…
招聘城市:上海
岗位介绍:
部门介绍
分布式存储团队负责B站在线存储相关方向, 包括但不限于KV存储/对象存储/文件存储/数据库中间件等
职位亮点
团队成员积极热情,内部技术氛围浓厚,在 KV 存储、对象存储等多个技术方向上积累了扎实的实践经验。新同学在导师的耐心指导下能够快速熟悉工作内容,顺利融入团队。相信加入我们不仅能让你实现快速成长,也将在 B 站的技术舞台上为你提供广阔的发展空间和施展才华的机会。
职位描述
工作职责:
1. 参与对象存储系统的开发与优化,支撑公司海量非结构化数据的高效存储与访问;
2. 参与设计和实现高可用、高性能、大规模扩展的对象存储服务;
3. 跟进业界前沿技术,持续…
招聘城市:北京,上海
…4.前沿推理系统深度开发:跟踪并引领AI Infra业界最新进展,深度参与并优化主流开源推理框架,进行架构级的核心代码重构、极致的通信优化与算子融合,推动最新infra成果在核心业务的高效落地。
任职要求:
【任职资格】
必备项:
1.2027届本科及以上学历,计算机、人工智能等相关专业;
2.具备良好的计算机基础素养和分析解决问题的能力,熟练掌握C/C++或Python编程语言;
3.学习能力强,对AI Infra方向有技术热情,富有极客精神;
4.具备扎实的机器学习和深度学习基础,熟悉GPU、NPU硬件架构,熟悉CUDA,CCL,RDMA或者任意机器学习DSL;
5.具有良好的沟通协作能力,工作积极主动。
加分项:
1.具备有影响力的大规模分布式系统…
招聘城市:上海
…交通大学计算机学院并行与分布式系统研究所博士后招聘启事
课题组介绍链接:
招聘岗位:博士后
招聘人数:1 名
聘用方式
博士后
招聘条件
研究生教育学历,博士学位 2、具有计算机系统、计算机体系结构、操作系统、安全、芯片架构等相关专业博士学位者优先,年龄一般不超过35周岁,身心健康 3、具有软硬协同系统、安全体系结构、操作系统、可信计算、AI 系统优化等方向的相关研究基础 4、具备独立开展科学研究的能力,具有较强的中英文写作、沟通和学术表达能力 5、具备严谨的学术态度、敬业精神、团队合作意识与良好的沟通协调能力 6、能全职在校从事科研工作
岗位职责
1、在合作导师指导下开展系统安全与软硬件协同方向的…
招聘城市:上海
岗位介绍:
部门介绍
分布式存储团队负责B站在线存储相关方向, 包括但不限于KV存储/对象存储/文件存储/数据库中间件等
职位亮点
团队成员积极热情,内部技术氛围浓厚,在 KV 存储、对象存储等多个技术方向上积累了扎实的实践经验。新同学在导师的耐心指导下能够快速熟悉工作内容,顺利融入团队。相信加入我们不仅能让你实现快速成长,也将在 B 站的技术舞台上为你提供广阔的发展空间和施展才华的机会。
职位描述
工作职责:
1. 参与对象存储系统的开发与优化,支撑公司海量非结构化数据的高效存储与访问;
2. 参与设计和实现高可用、高性能、大规模扩展的对象存储服务;
3. 跟进业界前沿技术,持续…
招聘城市:北京
…的实时推理需求。
3.低进度优化:基于结构化和非结构化模型进行低进度训推协同优化,从源头解决模型性能与精度的平衡难题。
4.广告链路端到端重塑:超长行为序列与超大候选Item情况下,优化传统的多阶段网络传输架构,需要一体化硬件支撑的召回/排序/机制统一服务。
任职要求:
海内外高校在校本科生(大三及以上)、硕士生及博士生,且以下条件至少满足一项
1.工程高手:有大厂实验室的实习经验,或有贡献突出的开源项目,熟悉PyTorch、Megatron、vLLM/SGLang等机器学习框架,有大规模分布式系统开发经验。
2.竞赛大神:在ACM-ICPC(国际大学生程序设计竞赛)、Kaggle、数学建模竞赛(如MCM/ICM)、奥赛(数学、物理、信息学等…
招聘城市:北京
…具备一定的电子电路知识。
2. 熟悉 Linux 系统,有 Linux 使用经验,能够编写 bash 等脚本、安装和移植应用。
3. 具备较强的编程基础,掌握 C、C++ 编程,熟悉 C++、Python 通用开发与调试,并有一定的工程构建与代码版本管理经验。
4. 拥有良好的沟通与表达能力,最好有项目管理和团队合作经验。
5. 具备使用 AI 工作的能力,熟练使用 AI 工具(如 ChatGPT、GitHub Copilot、Claude 等),能将 AI 嵌入工作流程以提升效率。
6. 加分项:
a) 熟悉 CV、语音、LLM、多模态等至少一个领域的 AI 算法,了解其原理、流程及评价指标。
b) 具备 Web 开发基础,熟悉前后端及数据库开发。
c) 了解 TGI、vLLM、SGLang 等分布式推理和训练框架,有部署、优化与维护经验者优先。…
招聘城市:上海
岗位介绍:
职位描述
工作职责:
1、参与分布式存储系统、可观测平台或微服务架构的设计与开发
2、独立完成所负责模块的编码、调试与单元测试
3、协助排查和定位线上问题,参与 code review
4、编写技术文档,沉淀工程实践
工作要求:
1、计算机相关专业本科及以上;
2、扎实的编程基础,熟悉 Go / C++ 等任一语言
3、掌握操作系统、计算机网络、数据结构与算法等基础知识
4、了解分布式系统基本概念(Raft、CAP、共识协议等)优先
5、有开源项目参与经验或相关项目经历者优先
网申须知
网申开始日期:2026-03-05 00:00
网申截止日期:2026-06-01 00:00
仅限 2026-09 至 2027-08 毕业的大学生,快来投递吧~
投递…
招聘城市:北京,上海
…推理框架、训练框架、云原生和高性能计算方向的技术演进。
任职要求:
岗位要求
1. 本科及以上学历,计算机、软件工程、人工智能、自动化、电子信息等相关专业。
2. 编程基础扎实,熟悉 C++、Python、Go、Rust 、Java中至少一门语言。
3. 理解操作系统、计算机网络、分布式系统、数据库等基础知识。
4. 对性能优化、系统稳定性、云原生、GPU计算或大模型部署有兴趣。
5. 具备较强的问题定位和工程实现能力。
具有以下经验者优先
1. 熟悉 Kubernetes、Docker、Ray、Slurm、Triton、vLLM、TensorRT等工具。
2. 有CUDA、GPU编程、模型量化、推理加速经验。
3. 参与过大模型部署、训练平台、推理服务或高并发系统项目。
4. 了解MoE模型推理优化、KV Cache管理、Speculative Decoding等前沿方向者优先
招聘城市:上海
岗位介绍:
职位描述
工作职责:
1. 分布式训练底座 (Training Infra)
框架优化: 负责维护和优化基于 Megatron-LM, FSDP, VeRL的分布式训练框架,通过多维并行策略提高训练吞吐。
算子优化: 参与多模态大模型训练核心算子的设计与优化,包括 Attention、MoE、算子融合等方向,持续提升模型训练效率和硬件利用率。
通信优化: 深入优化 H/NCCL通信库,解决 RDMA/RoCE 网络下的通信瓶颈,提升多机多卡并行效率(DP/PP/TP/CP/EP)。
稳定性保障: 构建自动容错与快速恢复系统(Checkpoint 优化、故障自动检测与接续),确保千卡集群在数月跨度的训练中保持极高可用性。
2. 推理加速与工程化 (Inference Infra)
高性能引擎: 负责基于 vLLM、TensorRT-LLM、SGLang、Triton Inference Server 等推理框架的开发…
招聘城市:上海
岗位介绍:
职位描述
工作职责:
1. 分布式训练底座 (Training Infra)
框架优化: 负责维护和优化基于 Megatron-LM, FSDP, VeRL的分布式训练框架,通过多维并行策略提高训练吞吐。
算子优化: 参与多模态大模型训练核心算子的设计与优化,包括 Attention、MoE、算子融合等方向,持续提升模型训练效率和硬件利用率。
通信优化: 深入优化 H/NCCL通信库,解决 RDMA/RoCE 网络下的通信瓶颈,提升多机多卡并行效率(DP/PP/TP/CP/EP)。
稳定性保障: 构建自动容错与快速恢复系统(Checkpoint 优化、故障自动检测与接续),确保千卡集群在数月跨度的训练中保持极高可用性。
2. 推理加速与工程化 (Inference Infra)
高性能引擎: 负责基于 vLLM、TensorRT-LLM、SGLang、Triton Inference Server 等推理框架的开发…
招聘城市:深圳
…精通嵌入式Linux软件及andriod软件开发环境的搭建,熟悉Linux内核裁剪和设备驱动开发, 有linux 内核及linux内核驱动开发经验;
4、熟悉嵌入式系统的硬件系统结构,精通ARM架构,;
5、精通 TCP/IP通讯,熟悉UART、I2C、SPI等通讯协议;
6、精通NAND FLASH/LCD/TOUCH PANEL/CODEC/HDMI/WIFI等外设的驱动调试;
7、有linux驱动开发经验优先考虑;
8、熟悉arm双核、四核平台,有3D打印行业优先;
9、优秀毕业生可考虑录用
优先条件:
1、熟悉linux下的shell/perl/python 脚本。
2、熟悉开源的Web服务器(如Nginx、Apache等),有分析其代码实现或模块编写经验者优先;
3、有分布式数据存储, 分布式计算实际项目开发经验;
4、有分布式大型系统架构和…
招聘城市:上海,北京
…推理/数据集/资源调度等流程及工具的研发建设
任职要求:
任职要求
计算机/软件工程相关专业在校生,熟悉Go/Python/Java至少一门语言
了解Linux系统及算法基础,熟悉MySQL/Redis/MQ等组件使用
熟悉 Kubernetes 技术栈,有一定的云原生机器学习系统实践和开发经验
有大模型部署经验,对 vLLM/SGLang/Dynamo 等至少一种推理框架有使用经验
具备快速学习能力,熟练使用 Git,熟练使用 github copilot/cursor 等 AI 编程工具
加分项
接触过Volcano/联邦集群/OpenKruise等云原生技术,有分布式系统实践经验
熟悉大模型推理基本原理,了解大模型分布式部署架构,例如多机部署和 PD 分离部署
熟悉常见的大模型如 DeepSeek/Qwen 等的架构及主要特点,有英伟达 GPU…
招聘城市:北京,上海
…职责:
负责全公司机器学习基础设施的研发,包括大规模分布式训练架构、高性能推理服务、深度学习编译优化、GPU硬件加速、RDMA网络优化等,支撑公司所有机器学习相关业务,如:搜索、推荐、广告、图像、NLP、语音、自动驾驶等。
任职要求:
1.本科及以上学历;
2.具备良好的计算机基础素养和分析解决问题的能力,熟练掌握C++或Python;
3.学习能力强,对机器学习系统优化有技术热情,富有极客精神。
具备以下经验者优先
1.熟悉TensorFlow/PyTorch等深度框架代码的优先;
2.熟悉TVM/MLIR等编译优化技术的优先;
3.熟悉GPU、RDMA硬件架构,熟练使用CUDA、NCCL、Verbs编程的优先;
4.熟悉机器学习、深度学习算法的优先(欢迎算法背景同学转方向);
5.有分布式系统…