招聘城市:深圳,其它
深圳虾皮信息科技有限公司
招聘信息
AI训练/推理框架工程师
2026-08-06 14:48:04
职位描述
工作职责:
1、参与开发和建设公司的训练、微调、评估、推理工具链,支撑公司 AI 模型的分布式训练和推理应用;
2、参与公司内分布式训练和推理任务优化,包括但不限于框架优化、算子优化、通信优化和存储优化等;
3、与 AI 模型训练、推理业务团队以及平台等团队紧密协作,共同构建端到端的 AI 模型能力;
4、跟进和探索前沿的分布式训练、微调、评估和推理技术方案,推动相应工具的不断迭代。
岗位要求:
1、2026届应届毕业生,本科及以上学历;
2、掌握计算机专业基础知识,如计算机操作系统、计算机网络、计算机组成原理等;
3、掌握…
招聘城市:北京
…
职位名称:AI仿真训练与推演开发工程师
学历:本科,硕士
需求人数:1
需求专业:人工智能,计算机技术,计算机类,新一代电子信息技术(含量子技术等),计算机科学与技术,大数据技术与工程,软件工程,信息与通信工程
工作地点:北京市朝阳区
职位描述:1、运用C++语言进行作战仿真平台核心算法和业务逻辑的开发,包括但不限于作战实体行为模拟、战术规则实现、数据交互处理等,确保代码的高效性和稳定性;2、利用QT框架进行平台用户界面的设计与开发,创建直观、易用的操作界面,实现界面与后台逻辑的良好交互,提升用户体验;3、负责大语言模型(LLM)与仿真平台的集成开发,实现自然语言到AFSIM脚本的自动转换,支持用户通过自然…
招聘城市:北京,上海
…训练引擎的关键特性,如大规模集群下的稳定断点续训、高性能异步Rollout机制、以及高性能算子(Kernel)的集成与优化。
任职要求:
任职资格:
1、优秀的代码能力、数据结构和基础算法功底,熟悉Python开发,熟悉 Linux/Git开发环境;
2、有较好的学习能力、沟通协作能力和自驱力,能和团队一起探索新技术,推进技术进步(⭐️有大牛带着成长)
2、熟悉至少一种主流基础深度学习训练框架(TensorFlow/PyTorch/PaddlePaddle等)的使用和实现;
3、了解主流LLM模型结构,使用过至少一种主流LLM训练框架(Megatron-LM/DeepSpeed/veRL等);
加分项:
1、熟悉DP/TP/PP/ZeRO等分布式训练策略原理,有大模型训练调优分析经验者优先;
2、熟悉至少一种AI…
招聘城市:北京,上海
…至少一种主流基础深度学习训练或推理框架(TensorFlow/PyTorch/PaddlePaddle/TensorRT等)的使用和实现;
3、熟悉主流LLM模型结构,熟悉至少一种主流LLM训练或推理框架(Megatron-LM/DeepSpeed/vLLM/TensorRT-LLM等)的使用和实现;
4、熟悉GPU硬件架构,了解GPU 软件栈(CUDA,cuDNN),具备 GPU 性能分析的能力;
5、有强烈的工作责任心,较好的学习能力、沟通协作能力和自驱力,能和团队一起探索新技术,推进技术进步。
加分项:
1、熟悉蒸馏、剪枝、量化等模型压缩方案,有大模型压缩或小型化经验、或有相关论文者优先;
2、熟悉CUDA编程,有TensorRT或其它AI加速库、高性能算子开发经验者优先;
3、熟悉至少一种AI编译加速组件者优先,包含但不限与TorchInductor…
招聘城市:北京
…通过并行计算优化、分布式架构优化、异构调度等多种框架技术,打造高效、易用、领先的AI推理框架;
2、深度参与周边深度学习系统多个子方向的工作,包括但不限于模型管理、推理部署、日志/监控、工作流编排等;
3、与全公司各业务算法部门深度合作,为重点项目进行算法与系统的联合优化,支撑业务目标达成。
任职要求:
任职资格:
1、优秀的代码能力、数据结构和基础算法功底,熟悉C++/Python开发,熟悉 Linux/Git 开发环境;
2、熟悉至少一种主流基础深度学习训练或推理框架(TensorFlow/PyTorch/PaddlePaddle/TensorRT等)的使用和实现;
3、熟悉主流LLM模型结构,熟悉至少一种主流LLM推理框架(vLLM/SGLang/TensorRT-LLM等)的使用和实现;
4、熟悉GPU硬件架构,了解GPU 软件栈(CUDA,cuDNN…
招聘城市:北京
仿真工程师
8000-10000元
jo***.cn[点击查看]
工作地域:北京市 职位类别:其他专业技术人员 学历要求:硕士研究生在学 招聘人数:2人
发布时间:2025-11-03
* 专业要求:
不限专业
* 职位描述:
岗位职责:
1.基于Isaac Sim、MuJoCo、PyBullet等平台,搭建机器人高保真仿真环境,支持强化学习、运动规划等算法的快速验证。
2.设计多体动力学仿真基础设施,优化物理引擎性能。
3.开发自动化工具链,生成多模态仿真数据(RGB-D、点云、力触觉、IMU等),支撑模型训练与Real2Sim2Real流程。
4.结合生成式AI(如Diffusion、GAN),提升仿真数据的逼真度和多样性,解决数据稀缺问题。
5.设计任务测试基准(如抓取、导航),构建复杂交互场景(如动态物体建模、3D场景生成),支持算法…
招聘城市:北京
…优秀的代码能力、数据结构和基础算法功底,熟悉C++/Python开发,熟悉 Linux/Git开发环境;
2、熟悉至少一种主流基础深度学习训练框架(TensorFlow/PyTorch/PaddlePaddle等)的使用和实现;
3、熟悉主流LLM模型结构,熟悉至少一种主流LLM训练框架(veRL/Megatron-LM/DeepSpeed等)的使用和实现;
4、熟悉GPU硬件架构,了解GPU 软件栈(CUDA,cuDNN),具备 GPU 性能分析的能力;
5、有强烈的工作责任心,较好的学习能力、沟通协作能力和自驱力,能和团队一起探索新技术,推进技术进步。
加分项:
1、熟悉DP/TP/PP/ZeRO等分布式训练策略原理,有大模型训练调优分析经验者优先;
2、熟悉至少一种AI编译加速组件者优先,包含但不限与TorchInductor/TVM/Triton/XLA等;
5…
招聘城市:北京,上海
…训练引擎的关键特性,如大规模集群下的稳定断点续训、高性能异步Rollout机制、以及高性能算子(Kernel)的集成与优化。
任职要求:
任职资格:
1、优秀的代码能力、数据结构和基础算法功底,熟悉Python开发,熟悉 Linux/Git开发环境;
2、有较好的学习能力、沟通协作能力和自驱力,能和团队一起探索新技术,推进技术进步(⭐️有大牛带着成长)
2、熟悉至少一种主流基础深度学习训练框架(TensorFlow/PyTorch/PaddlePaddle等)的使用和实现;
3、了解主流LLM模型结构,使用过至少一种主流LLM训练框架(Megatron-LM/DeepSpeed/veRL等);
加分项:
1、熟悉DP/TP/PP/ZeRO等分布式训练策略原理,有大模型训练调优分析经验者优先;
2、熟悉至少一种AI…
招聘城市:上海,北京
…训练实验,学习如何通过思维链推理提升模型在复杂任务上的表现
算法探索:学习探索前沿强化学习算法,协助团队进行奖励模型的构建和优化
Reasoning技术探索:参与模型监督、自我提升等训练优化探索
训练框架优化:学习使用LLM训练框架,参与协助优化训练流程,提升团队开发效率
任职要求:
任职资格
具备较好的编程能力和算法开发能力,熟悉常用的机器学习、深度学习算法
熟悉Llama-Factory、veRL、MS-Swift等框架,有相关项目经验更佳
了解分布式训练框架如DeepSpeed、Megatron-LM等
有较强的学习意愿和团队协作精神,能保证每周至少3天实习时间,实习期至少3个月
加分项
对强化学习有基本了解或项目经验
有开源项目贡献经历,尤其是与…
招聘城市:深圳,其它
深圳虾皮信息科技有限公司
Ai训练-推理框架工程师
20K-40K/月深圳市本科及以上 模拟面试
发布时间:2026年2月27日
职位描述
岗位职责:
"工作职责:1、参与开发和建设公司的训练、微调、评估、推理工具链,支撑公司AI模型的分布式训练和推理应用;2、参与公司内分布式训练和推理任务优化,包括但不限于框架优化、算子优化、通信优化和存储优化等;3、与AI模型训练、推理业务团队以及平台等团队紧密协作,共同构建端到端的AI模型能力;4、跟进和探索前沿的分布式训练、微调、评估和推理技术方案,推动相应工具的不断迭代。岗位要求:1、2026届应届毕业生,本科及以上学历;2、掌握计算机专业基础知识,如计算…
招聘城市:北京
…通过并行计算优化、分布式架构优化、异构调度等多种框架技术,打造高效、易用、领先的AI推理框架;
2、深度参与周边深度学习系统多个子方向的工作,包括但不限于模型管理、推理部署、日志/监控、工作流编排等;
3、与全公司各业务算法部门深度合作,为重点项目进行算法与系统的联合优化,支撑业务目标达成。
任职要求:
1、优秀的代码能力、数据结构和基础算法功底,熟悉C++/Python开发,熟悉 Linux/Git 开发环境;
2、熟悉至少一种主流基础深度学习训练或推理框架(TensorFlow/PyTorch/PaddlePaddle/TensorRT等)的使用和实现;
3、熟悉主流LLM模型结构,熟悉至少一种主流LLM推理框架(vLLM/SGLang/TensorRT-LLM等)的使用和实现;
4、熟悉GPU硬件架构,了解GPU 软件栈(CUDA,cuDNN),具备 GPU…
招聘城市:上海
…推理加速与工程化 (Inference Infra)
高性能引擎: 负责基于 vLLM、TensorRT-LLM、SGLang、Triton Inference Server 等推理框架的开发与优化,提升大模型在线服务的吞吐、时延和资源利用率。
算子优化: 参与 Transformer 核心算子的开发与性能优化,包括 Attention、KV Cache、量化推理、算子融合等方向,探索 CUDA/Triton 等高性能实现方案。
推理架构: 参与构建面向大规模生产环境的推理服务体系,支持高并发、低延迟和高可用的模型服务部署与运维。
3. 存储与算力管理 (Storage & Compute)
I/O 优化: 优化超大规模数据集的加载速度,解决训练过程中的存储带宽瓶颈(如利用 GPFS, Lustre 或 JuiceFS)。
稳定性保障: 构建大规模集群故障检测、自动恢复与容灾体系,提升训练与推理服务的可靠…
招聘城市:上海
…AI 框架适配调优:对接 PyTorch、TensorFlow、vLLM 等主流框架,完成训练 / 推理场景参数调优,实现计算与通信重叠,提升端到端任务性能
6、集群基准测试:使用行业标准压测工具完成集群算力、吞吐、时延基准测试,定位性能瓶颈并落地优化方案
工作要求:
面向2027届海内外本硕博毕业生(2026年9月-2027年8月期间毕业)
1、计算机、网络工程、电子信息、高性能计算、人工智能等相关专业;
2、熟悉 Linux 操作系统,掌握基础 Linux 命令,了解 Shell/Python 任意一种脚本语言,具备基础脚本编写能力;
3、了解计算机网络基础原理,熟悉 TCP/IP、二层 / 三层网络架构,有 RDMA、InfiniBand、RoCE 网络认知者优先;
4、了解 GPU、CUDA 基本概念,接触过分布式计算、高性能集群、AI 训练环境…
招聘城市:北京,上海
岗位职责:
1、参与AI平台大模型推理部署等流程及工具的研发建设,完善平台现有功能。
2、参与AI平台Quota管理模块的开发,实现多机房、多集群环境下的,各种异构计算资源的配额管理功能。
3、参与AI平台联邦调度能力的设计和开发,与下游云原生团队共同实现平台联邦和弹性部署能力。
任职要求:
1、计算机/软件工程相关专业在校生,熟悉Go/Python/Java至少一门语言
2、了解Linux系统及算法基础,熟悉MySQL/Redis等组件使用
3、了解 Kubernetes 架构和生态,有一定的云原生机器学习系统实践和开发经验;
具备快速学习能力,能持续跟踪AI基础设施技术动态
加分项
1、接触过Mesos、Yarn、Argo、Volcano 等云原生技术
2、熟悉大模型推理基本…
招聘城市:广州
人工智能研发工程师(大模型优化)
不限
硕士研究生,本科生
1年以下
1万元以上
职位诱惑:五险一金,年终奖,双休,有年假
职位描述
Description
岗位价值:
深度参与大模型推理性能优化工作,推动AI产品算力和大模型解决方案的最佳落地,成为连接前沿AI技术与业务场景的关键力量。
您将负责:
-?分析大模型推理业务场景(如LLM、VLM等),设计高性能、低成本的模型构建方案并推动工程实现;
-?优化开源大模型(如DeepSeek、Llama、Qwen等),研究vLLM、SGLang等框架技术实现高效的加速推进系统;
-?对接融合算子与优化算子,保障功能完整与性能领先。
我们期待您:
-?研究生学历,计算机、人工智能相关专业;
-?熟练掌握C++/Python及Linux开发,熟悉PyTorch及…
招聘城市:北京,杭州
岗位职责:
1.负责模型预训练、微调、部署及推理过程中的数据准备、模型和数据加速、数据集存储及管理,为大模型提供高效稳定的多模态数据预处理能力,构建高质量的AI数据迭代链路。
2.探索AI Native的多模数据存储格式,支持AI数据高效存储、读取和分析,提升数据的使用价值。
3.跟进LLM、多模态大模型的前沿发展,探索数据如何更好驱动模型迭代。
任职要求:
1、熟悉Java/Python语言
2、热爱技术研发,具备高度抽象设计能力和快速学习能力,注重代码质量,能够独立分析解决问题,责任心强
3、27届,能够实习6个月以上,每周出席4天及以上。
招聘城市:北京,上海
岗位职责:
核心职责:
参与AI平台大模型推理部署等流程及工具的研发建设,完善平台现有功能。
参与AI平台Quota管理模块的开发,实现多机房、多集群环境下的,各种异构计算资源的配额管理功能。
参与AI平台联邦调度能力的设计和开发,与下游云原生团队共同实现平台联邦和弹性部署能力。
任职要求:
任职要求:
计算机/软件工程相关专业在校生,熟悉Go/Python/Java至少一门语言
了解Linux系统及算法基础,熟悉MySQL/Redis等组件使用
了解 Kubernetes 架构和生态,有一定的云原生机器学习系统实践和开发经验;
具备快速学习能力,能持续跟踪AI基础设施技术动态
加分项:
接触过Mesos、Yarn、Argo、Volcano 等云原生技术
熟悉大模型推理基本原理,拥有使用 vLLM…
招聘城市:上海,北京,杭州
…AGI大模型预训练数据采集、去重、清洗等核心链路重构,从引擎层适配大模型数据处理场景;
2、引擎优化维稳:负责Spark、Celeborn、Hive等离线计算引擎的维护、性能调优、资源优化,解决海量数据场景下的性能与稳定性问题;
3、底层技术攻坚:结合AGI数据处理需求,参与计算引擎定制化改造,攻坚超大规模数据计算的高难度技术问题;
4、技术迭代沉淀:跟进大数据前沿技术,落地优化方案,完善AGI数据基础设施体系。
任职要求:
1、学历:本科及以上,计算机、大数据、人工智能等相关专业,2027届应届毕业生,学业基础扎实;
3、编程能力:熟练掌握Java/C++/Python任一语言,编码功底良好,代码逻辑清晰;
4、核心素养:热爱分布式引擎底层研发与AGI数据方向…