牛大妈在校招职位搜索负载均衡 有 29 条结果

招聘城市:上海
岗位介绍:
职位描述
工作职责:
1. 参与服务治理体系的设计与开发,支撑公司内部微服务的高可用和服务稳定;
2. 负责服务发现、负载均衡、熔断限流、链路追踪等核心治理能力的实现与优化;
3. 参与构建基于 Service Mesh 或 RPC 框架的治理基础设施,提升系统可观测性与自动化运维能力;
4. 与各业务团队协作,推动服务治理方案在实际场景中的落地与推广;
5. 编写相关技术文档,参与 Code Review,持续提升团队代码质量与工程能力。
工作要求:
1. 精通Golang/C++ 编程语言;
2. 具备大规模分布式系统的研发和优化能力;
3. 好学,责任感强,逻辑思维能力、沟通能力强,能够承担工作压力;
网申须知
网申开始日期:2026-03-05 00:00
网…
招聘城市:北京
…ACM/ICPC、NOI/IOI、Top Coder、Kaggle等比赛获奖者优先;
3、熟悉计算机体系结构,对 CPU/GPU 内存层次、PCIe/NVLink 带宽有清晰概念;理解操作系统核心原理(如进程调度、内存管理);
4、熟悉分布式系统的基本原理(如一致性协议、一致性哈希、负载均衡算法、集合通信 MPI/NCCL),具备良好的分布式思维;
5、具备 CUDA C/C++ 开发或优化经验,或了解 OpenAI Triton 算子编写者优先;
6、熟悉或阅读过主流推理/训练开源项目的源码者优先,如 vLLM、SGLang、TensorRT-LLM、Triton Inference Server、DeepSpeed、Megatron-LM 等
【岗位吸引力】
在这一职位上:
您将有机会参与无人机、机器人领域内大规模的数据处理分析系统的构建,进而为业务的深入发展做出贡献;
您处理的不是…
招聘城市:北京,上海
…序列并行策略及分布式通信拓扑,优化内存足迹,支撑长文本与复杂多模态后训练。
2.计算资源弹性调度与容错容灾:研究超大规模集群下的弹性训练技术(Elastic Training),实现节点动态加入/退出、无感故障自动恢复(Fault Tolerance)与训练超参数自动寻优,提升集群算力有效利用率(MFU)。
3.Agent RL算法基础设施:构建面向Agent强化学习的高效Rollout引擎、多模型(Policy/Value/Reward/Reference)多阶段流水线编排及动态负载均衡机制;设计并建设支持高并发、低延迟的工具调用(Tool-use)虚拟环境/沙箱模拟器交互系统。
4.训推一致性协同设计(Co-design):打通训练与推理底层架构,研究在后训练阶段(如在线RL、Iterative DPO)如何实现训练框架与高性能推理…
招聘城市:杭州,西安,武汉,合肥,安庆
标题: 迪普科技2026届校园招聘暨2027届实习生招聘行程公告(第二期)
公司名称: 杭州迪普科技股份有限公司(迪普科技)
公司行业: 互联网,计算机软件/硬件/服务,通信/电信/网络设备
公司标签: 国家知识产权示范企业,国家信息安全漏洞库一级技术支撑单位,信息安全标准化技术委员会成员单位,连续六年入选浙江省企业创造力百强榜,猎聘2025浙江年度非凡雇主,国内高端负载均衡第一品牌,《中国企业专利实力500强》网络安全企业第一位,全国唯一一家连续两届获得中国人工智能大赛A级证书的企业,上市公司
公司简介: 杭州迪普科技股份有限公司坐落于风景秀丽的钱塘江畔,成立于2008年,以“让网络更简单、智能、安全”为使命,聚焦于…
招聘城市:北京,上海,杭州
…分布式采样引擎的优化、异构算力资源的高效调度、以及计算与通信的深度并行化策略。然而,该领域面临着严峻的技术挑战:
一是如何在保持高吞吐采样(High Throughput)的同时,解决分布式环境下数据回传的通信瓶颈(Communication Bottleneck);
二是针对RL特有的数据非平稳性,如何保障在大规模异步训练下的算法收敛稳定性与超参数鲁棒性;三是涉及CPU仿真环境与GPU神经网络训练之间的精细负载均衡,以最大化集群利用率并降低昂贵的训练成本。
任职要求:
1、不限年级,本科及以上在读,计算机/人工智能/软件工程等相关专业优先;
2、熟悉Linux/Unix平台上的C++编程,熟悉网络编程-多线程编程,有良好的编程习惯;…
招聘城市:北京,上海
…我们在做的事:让千亿参数的模型在万卡集群上跑得更快、更稳、更省——把每一张GPU的算力榨干,把每一次训练崩溃的损失降到最低,把工程师等待结果的时间从“几天”压到“几小时”。
1、分布式训练框架优化
①深入源码,针对美团训练场景做定制化改造。
②设计和实现更高效的张量并行、流水线并行、数据并行混合策略。
③探索 MoE(混合专家) 模型的并行训练方案,解决专家负载均衡、通信爆炸等硬问题。
2、计算效率优化
①基于 CUDA / Triton 编写和优化高性能算子(FlashAttention、FusedMLP等)。
②分析训练 profiling 数据,定位计算/通信/内存的瓶颈并针对性优化。
③推进混合精度训练、梯度压缩等技术落地。
任职要求:
1…
招聘城市:北京
北京搜狐新媒体信息技术有限公司
大模型算法工程师
25K-35K/月 北京 硕士及以上 模拟面试
职位诱惑:行业头部平台 前沿技术落地 扁平化管理 完善培训体系 五险一金
发布时间:2026年8月7日
职位描述
岗位职责:
1. 负责多智能体系统(MAS)核心架构设计与研发,搭建标准化、可扩展的智能体协作底座,实现智能体角色编排、动态任务分配、A2A智能通信、协同决策、冲突协商与负载均衡,支撑复杂长周期任务的自动化闭环执行; 2. 深耕Agentic Workflow智能体工作流体系研发与优化,迭代升级智能体核心能力,包括分层任务拆解、动态规划执行、长短时记忆管理、工具链自适应调用、状态持久化、异常自愈与重试机制,提升智能体自主执行…
招聘城市:深圳,其它
…信息类,计算机类,通信类,集成电路类
职位描述:
岗位职责
方向 1|AI 云原生基础设施(核心招募线)
1.面向异构算力(GPU+GPNPU)的 K8s 调度扩展、弹性算力调度、抢占式任务编排
2.AI 工作负载优化:GPU/GPNPU虚拟化、多租户隔离、算力 QoS、资源碎片治理
3.Serverless AI、动态批处理、弹性推理集群架构
方向 2|分布式训推系统 & 大模型 Infra
1.LLM/VLM 分布式推理:Tensor/Pipeline/MoE 并行、KV Cache 优化、通信层优化
2.异构集群多卡 / 多节点通信、NCCL 适配自研芯片、分布式容错框架
3.模型服务网关、动态负载均衡、推理流量调度系统
方向 3|软硬协同系统软件(芯片 × 云原生交叉重点)
1.自研 GPNPU驱动、Runtime 与云原生平台打通…
招聘城市:上海
…QEMU)、容器技术等实践经验;
* 了解TCP/IP协议栈、HTTP/QUIC协议,对高并发、分布式系统有基本认知;
* 熟悉Shell/Python/Go等脚本语言,具备自动化工具开发能力者加分。
3、问题解决:具备优秀的逻辑分析与故障排查能力,能通过源码阅读、调试工具(gdb、perf、ftrace等)定位复杂问题。
4、综合素质:对技术有强烈热情,具备良好的沟通协作能力与抗压能力;有开源项目贡献、技术博客或竞赛获奖经历者优先。
5、加分项:熟悉AI推理框架、负载均衡算法、CDN缓存策略或有云原生实践经验。
网申须知
网申开始日期:2026-03-05 00:00
网申截止日期:2026-06-01 00:00
仅限 2026-09 至 2027-08 毕业的大学生,快来投递吧~
投递简历
招聘城市:北京
…1.计算机或相关专业硕士及以上学历;
2.熟悉算法、数据结构、设计模式,编程风格良好,有大模型算法经验优先;
3.有扎实的Java基础,精通Java多线程、网络通信及系统调优;
4.熟悉分布式系统的设计和应用,熟悉分布式、缓存、消息队列、负载均衡等机制和实现,熟悉kafka、redis、zookeeper等实现机制;
5.熟悉常用的设计模式,熟悉主流开源应用框架,如Spring、Maven等开发技术;
6.热爱技术,对技术有不懈的追求;
7.良好的学习能力、团队协作能力和沟通能力,态度端正积极,善于思考,能独立分析和解决问题。
岗位亮点:
参与到店数据服务平台多个复杂技术工具的建设,支持千亿数据量计的分析场景。使用行业内前沿的大数据,算法技术提升性能…
招聘城市:北京,上海

2.高性能算子开发 面向异构计算硬件,研发极致优化的融合算子 ,探索Tiling策略、内存访问模式、流水线并行等底层性能优化手段。
3.推理框架优化 深入优化自研推理框架,降低调度开销,实现计算与通信的高效重叠,提升硬件利用率。
4.分布式系统架构 设计高可用的分布式推理系统,通过智能请求调度、动态负载均衡、反压控制等机制,保障系统在突发流量下的稳定性与SLA。
5.长上下文场景极致优化 针对T级别参数模型在M级别序列长度下的推理场景,系统性优化显存占用、IO带宽、算力分配及跨节点通信效率,充分释放硬件潜力。
【为什么是我们】
1.直面大模型时代最核心的工程挑战——用极致的系统优化,打破推理成本…
招聘城市:北京
…关键因素。本课题专注于大模型推理加速与分布式系统优化的前沿技术探索,通过软硬件协同设计和算法工程联合优化,降低大模型推理的应用成本,提高推理性能。研究内容包括但不限于:
1.投机推理(Speculative Decoding),研究基于预测性执行的动态推理优化方法,参与设计低延迟推理框架,通过概率模型预生成候选序列以降低解码计算开销。
2.分布式系统优化,探索多节点协同推理中的通信-计算负载均衡策略,提出基于异构硬件的混合并行调度方案,实现吞吐量提升。
3.稀疏Transformer优化与模型压缩,通过稀疏Transformer优化以及模型压缩技术提升模型的计算效率。
4.算子优化,熟悉最新硬件架构的算子优化方法,通过更高效的算子优化模型的吞吐和延时。…
招聘城市:北京,上海
…关键因素。本课题专注于大模型推理加速与分布式系统优化的前沿技术探索,通过软硬件协同设计和算法工程联合优化,降低大模型推理的应用成本,提高推理性能。研究内容包括但不限于:
1.投机推理(Speculative Decoding),研究基于预测性执行的动态推理优化方法,参与设计低延迟推理框架,通过概率模型预生成候选序列以降低解码计算开销。
2.分布式系统优化,探索多节点协同推理中的通信-计算负载均衡策略,提出基于异构硬件的混合并行调度方案,实现吞吐量提升。
3.稀疏Transformer优化与模型压缩,通过稀疏Transformer优化以及模型压缩技术提升模型的计算效率。
4.算子优化,熟悉最新硬件架构的算子优化方法,通过更高效的算子优化模型的吞吐和延时。…
招聘城市:上海
…通信效率,解决 GPU 降频、算力跑不满问题
2、分布式通信优化:针对 NCCL 集合通信库做参数调优,优化多机多卡分布式训练通信逻辑,降低通信时延、提升集合通信吞吐
3、系统与内核调优:基于 Linux 操作系统做内核参数、内存、IO、进程调度优化,适配高负载 GPU 集群运行场景
4、算力调度优化:配合 Slurm/K8s 算力调度平台,优化任务队列、资源配额、负载均衡策略,减少任务排队、资源碎片问题
5、AI 框架适配调优:对接 PyTorch、TensorFlow、vLLM 等主流框架,完成训练 / 推理场景参数调优,实现计算与通信重叠,提升端到端任务性能
6、集群基准测试:使用行业标准压测工具完成集群算力、吞吐、时延基准测试,定位性能瓶颈并落地优化方案
工作要求:…
招聘城市:上海
…通信效率,解决 GPU 降频、算力跑不满问题
2、分布式通信优化:针对 NCCL 集合通信库做参数调优,优化多机多卡分布式训练通信逻辑,降低通信时延、提升集合通信吞吐
3、系统与内核调优:基于 Linux 操作系统做内核参数、内存、IO、进程调度优化,适配高负载 GPU 集群运行场景
4、算力调度优化:配合 Slurm/K8s 算力调度平台,优化任务队列、资源配额、负载均衡策略,减少任务排队、资源碎片问题
5、AI 框架适配调优:对接 PyTorch、TensorFlow、vLLM 等主流框架,完成训练 / 推理场景参数调优,实现计算与通信重叠,提升端到端任务性能
6、集群基准测试:使用行业标准压测工具完成集群算力、吞吐、时延基准测试,定位性能瓶颈并落地优化方案
工作要求:…
招聘城市:北京
…机关、司法机关调查,履行出资人职责的机构专项检查,或正在接受审计尚未作出结论的;
(2)受党纪、行政处分,处于影响期内的;
(3)与原单位有劳动纠纷的;
(4)其他有关法律法规或规章制度规定的不得任用的情形。
三、?
岗位职责与任职资格
(一)信息化管理岗(网络方向)1名
岗位职责:
1.负责集团整体网络架构规划、方案设计、升级改造,负责核心交换机、防火墙、负载均衡、出口网关等骨干设备架构调试和运维,负责内外网、无线网络、DNS配置、SD-WAN专线、IPV6改造等整体建设。
2.负责主流私有云平台虚拟机、网络部署运维,解决云平台虚拟网络、云主机、存储资源故障,统筹云网一体化运维管理。
3.制定网络相关管理制度、配置规范…
招聘城市:北京
…工程
|||需求专业:机械工程
工作地点:北京市大兴区
|||工作地点:北京市大兴区
|||工作地点:北京市大兴区
|||工作地点:北京市大兴区
|||工作地点:北京市大兴区
|||工作地点:北京市大兴区
|||工作地点:北京市大兴区
职位描述:岗位职责1. 负责企业/项目网络架构的规划、部署、调试与日常运维,保障内网、外网、专线、无线网络稳定高效运行。2. 负责交换机、路由器、防火墙、AC/AP、负载均衡、VPN等网络设备的配置、调试、升级与维护。3. 排查网络故障、处理网络卡顿、丢包、环路、访问异常等问题,保障业务网络7*24稳定运行。4. 负责网络安全策略配置、访问权限管控…
招聘城市:上海

4. 深度学习业务系统,维护和优化服务性能,保障可用性。
任职要求:
1.计算机或相关专业本科及以上学历;
2.熟悉算法、数据结构、设计模式,编程风格良好;
3.有扎实的Java基础,精通Java多线程、网络通信及系统调优;
4.熟悉分布式系统的设计和应用,熟悉分布式、缓存、消息队列、负载均衡等机制和实现,熟悉kafka、redis、zookeeper等实现机制;
5.熟悉常用的设计模式,熟悉主流开源应用框架,如Spring、Maven等开发技术;
6.热爱技术,对技术有不懈的追求;
7.良好的学习能力、团队协作能力和沟通能力,态度端正积极,善于思考,能独立分析和解决问题。
岗位亮点:
1. 参与高并发、高性能、高可用的本地生活系统建设,掌握各环节核心技术要素,和团队…
招聘城市:上海
…可用性。
任职要求:
1.计算机或相关专业硕士及以上学历;
2.熟悉算法、数据结构、设计模式,编程风格良好;
3.有扎实的Java基础,精通Java多线程、网络通信及系统调优;
4.熟悉分布式系统的设计和应用,熟悉分布式、缓存、消息队列、负载均衡等机制和实现,熟悉kafka、redis、zookeeper等实现机制;
5.熟悉常用的设计模式,熟悉主流开源应用框架,如Spring、Maven等开发技术;
6.热爱技术,对技术有不懈的追求;
7.良好的学习能力、团队协作能力和沟通能力,态度端正积极,善于思考,能独立分析和解决问题。
岗位亮点:
1.能够接触核心业务和技术系统,有较大的技术挑战和业务挑战,能够积累丰富的互联网大厂技术经验。
2.有资深技术导师带教。…
招聘城市:上海
…可用性。
任职要求:
1.计算机或相关专业硕士及以上学历;
2.熟悉算法、数据结构、设计模式,编程风格良好;
3.有扎实的Java基础,精通Java多线程、网络通信及系统调优;
4.熟悉分布式系统的设计和应用,熟悉分布式、缓存、消息队列、负载均衡等机制和实现,熟悉kafka、redis、zookeeper等实现机制;
5.熟悉常用的设计模式,熟悉主流开源应用框架,如Spring、Maven等开发技术;
6.热爱技术,对技术有不懈的追求;
7.良好的学习能力、团队协作能力和沟通能力,态度端正积极,善于思考,能独立分析和解决问题。
岗位亮点:
1.能够接触核心业务和技术系统,有较大的技术挑战和业务挑战,能够积累丰富的互联网大厂技术经验。
2.有资深技术导师带教。…