招聘城市:北京,上海
…书业务场景中的模型压缩技术的实现和优化,对模型进行轻量化压缩,提高训练/推理效率,支持业务降本增效;
3、参与/负责针对英伟达GPU、华为昇腾NPU等不同的计算硬件,制定不同的模型压缩方案并在业务落地;
任职要求:
任职资格:
1、熟悉蒸馏、剪枝、量化等模型压缩常用方案;
2、熟悉至少一种主流的大模型训练或推理框架(PyTorch / Megatron / vLLM / SGLang等)的原理和实现;
3、熟练使用Python/C++至少一种语言,并具备良好的代码质量和风格;
4、有强烈的工作责任心,较好的学习能力、沟通能力和自驱力;
加分项:
有优秀开源项目经历;
参与或主导过大型项目业务落地或有压缩相关论文;
有大模型压缩或小型化模型设计经验
招聘城市:北京
…化等;
2、参与/负责多个业务场景中的模型压缩技术实现,对模型进行轻量化压缩,提高训练/推理效率,支持业务降本增效;
3、参与/负责针对英伟达GPU、华为昇腾NPU等不同的计算硬件,制定不同的模型压缩方案并在业务落地;
任职要求:
1、熟悉蒸馏、剪枝、量化等模型压缩常用方案,参与或主导过大型项目业务落地或有相关论文者优先;
2、熟悉至少一种主流的大模型训练或推理框架(PyTorch / Megatron / vLLM / SGLang等)的原理和实现;
3、熟练使用Python/C++至少一种语言,并具备良好的代码质量和风格;
4、有强烈的工作责任心,较好的学习能力、沟通能力和自驱力;
5、有大模型压缩或小型化模型设计经验者优先;
6、有优秀…
招聘城市:北京,上海
…书业务场景中的模型压缩技术的实现和优化,对模型进行轻量化压缩,提高训练/推理效率,支持业务降本增效;
3、参与/负责针对英伟达GPU、华为昇腾NPU等不同的计算硬件,制定不同的模型压缩方案并在业务落地;
任职要求:
任职资格:
1、熟悉蒸馏、剪枝、量化等模型压缩常用方案;
2、熟悉至少一种主流的大模型训练或推理框架(PyTorch / Megatron / vLLM / SGLang等)的原理和实现;
3、熟练使用Python/C++至少一种语言,并具备良好的代码质量和风格;
4、有强烈的工作责任心,较好的学习能力、沟通能力和自驱力;
加分项:
有优秀开源项目经历;
参与或主导过大型项目业务落地或有压缩相关论文;
有大模型压缩或小型化模型设计经验
招聘城市:北京,上海
…大模型推理系统;
2、探索负载感知的推理系统流量调度算法,如基于Prefix Cache命中率调度、基于P/D分离的流量调度、基于KVCache使用率、推理排队负载感知的流量调度、长上下文请求调度优化等,持续提升MaaS系统的稳定性、成本效益;
3、探索并跟进业界开源SOTA模型,如Qwen系列、DeepSeek系列,多维度评估模型效果并建立相关的准入体系,及时上架到MaaS系统;
4、参与MaaS系统的国产卡适配,如华为910C、阿里PPU等;
5、参与攻克大规模分布式推理系统带来的复杂挑战,通过弹性调度、容量规划、链路压测等手段提升系统健壮性,确保平台能够弹性扩展,支撑业务的飞速增长。
任职要求:
任职要求
1、熟悉业界主流Dense、MOE大模型架构及…
招聘城市:上海,北京
…中的模型压缩技术的实现和优化,对模型进行轻量化压缩,提高训练/推理效率,支持业务降本增效;
3、参与/负责针对英伟达GPU、华为昇腾NPU等不同的计算硬件,制定不同的模型压缩方案并在业务落地;
任职要求:
任职资格:
1、熟悉蒸馏、剪枝、量化等模型压缩常用方案;
2、熟悉至少一种主流的大模型训练或推理框架(PyTorch / Megatron / vLLM / SGLang等)的原理和实现;
3、熟练使用Python/C++至少一种语言,并具备良好的代码质量和风格;
4、有强烈的工作责任心,较好的学习能力、沟通能力和自驱力;
加分项:
1. 有优秀开源项目经历;
2. 参与或主导过大型项目业务落地或有压缩相关论文;
3. 有大模型压缩或小型化模型设计经验
招聘城市:北京
岗位职责:
1. 参与对深度学习模型进行模型剪枝、蒸馏、量化等相关压缩技术的研究与落地;
2. 参与研发深度学习模型推理服务框架,实现推理服务高吞吐、低延迟、高可用;
3. 参与不同NPU/GPU上高性能训练/推理算子研发,实现训练/推理计算加速。
任职要求:
- 优秀的代码能力,扎实的数据结构和基础算法功底;
- 熟悉至少一种主流的机器学习框架(Tensorflow/Pytorch);
- 熟悉c++/cuda编程;
- 对模型压缩领域技术有一定基础。
招聘城市:北京,上海
岗位职责:
1、探索新一代大语言模型基座架构,以高效推理模式为核心优化目标,探索全新模型结构和scaling law。
2、在工作中能快速成长,积极探索前沿技术,解决好业务中遇到的实际问题,完成数据处理、建模和工程上线,对AI技术始终保持热爱,实习期间可发表论文。
任职要求:
1、硕士/博士在读,计算机、数学等相关专业,国内985/全球TOP高校优先,实习期至少3个月;
2、大模型领域前沿技术有深度研究,在国际顶会/顶刊发表过高水平论文者优先;
3、在大模型领域有实践经验,包括数据过滤、数据去重、数据合成,或继续预训练、SFT、RLHF,或知识蒸馏、量化和模型剪枝,或参与过rag和agent商业产品研发;
4、有良好代码能力…
招聘城市:上海,北京
岗位职责:
模型训练:参与大型语言模型的训练实验,学习如何通过思维链推理提升模型在复杂任务上的表现
算法探索:学习探索前沿强化学习算法,协助团队进行奖励模型的构建和优化
Reasoning技术探索:参与模型监督、自我提升等训练优化探索
训练框架优化:学习使用LLM训练框架,参与协助优化训练流程,提升团队开发效率
任职要求:
任职资格
具备较好的编程能力和算法开发能力,熟悉常用的机器学习、深度学习算法
熟悉Llama-Factory、veRL、MS-Swift等框架,有相关项目经验更佳
了解分布式训练框架如DeepSpeed、Megatron-LM等
有较强的学习意愿和团队协作精神,能保证每周至少3天实习时间,实习期至少3个月
加分项
对强化学习有基本了解或项目…
招聘城市:深圳,北京
岗位职责:
工作职责:
1、海量文本数据处理,包含分类、质量打分、语义识别等;
2、建立文本处理流程,持续优化模型效果;
3、跟踪最新NLP研究成果,并应用到处理流程中。
任职要求:
任职资格:
1、计算机相关方向本科及以上学历;
2、良好的编程能力,熟练运用Python语言,熟悉常见的机器学习框架;
3、熟悉常见的机器学习和NLP算法,了解当前热点和前沿技术;
4、有高水平会议或期刊论文者优先。
5、可尽快到岗者优先,至少实习3个月,每周工作日出勤至少4天。
招聘城市:上海
岗位职责:
1. 参与LLM/MLLM/Agent/Embedding相关算法研发与业务落地,解决小红书社区生态内容治理中的实际问题;
2. 进行大模型的前沿技术探索、模型后训练和应用,包括但不限于数据分析、多模态理解、Agent搭建、RAG、SFT/GRPO等技术;
3. 面向基于内容理解技术的生态审核场景,持续提升目标域的机审召回率及准确率能力;
任职要求:
1.硕士及以上学历,计算机科学与技术、人工智能、计算机、机器学习、大数据、数学等相关专业;
2.熟悉Python、C/C++等语言,具有较强的代码开发和实现能力,至少熟练掌握Pytorch等主流深度学习框架,能熟练使用Linux。
3.发表过多模态大模型领域知名论文、有多模态/大模型训练调优、Agent…
招聘城市:深圳
…文生图、强化学习等相关算法优化。
任职要求:
1、计算机/电子信息/自动控制/软件工程/数学等相关专业,硕士及以上学历在读同学;
2、扎实的大模型和机器学习理论基础,熟悉MLLM / Agent/ Skill / Harness 等相关算法,有大模型相关场景的业务实践经验者优先;
3、具备优秀的研究和创新能力,在CVPR/ICCV/ECCV/ACL/EMNLP/NAACL/COLING/CVPR/ICCV/ICLR/NeurIPS等会议上发表过论文者优先;
4、具备优秀的编程能力和经验,熟悉Python、C/C++、Java等编程语言,具有扎实的数据结构和算法功底;
5、优秀的分析、解决问题能力,对新技术充满好奇,敢于挑战高难度,善于提出解决方案并快速验证。
6、熟悉以下研究方向优先:多模态理解,搜索,文生图, Omni ,工具调用…
招聘城市:北京,上海
…模型上的最佳配置组合
4、协助定位分析分布式训练中的关键性能瓶颈(如GPU利用率低、显存瓶颈、网络通信阻塞、I/O延迟等),设计并实施优化方案进行验证。
5、参与研发/优化训练引擎的关键特性,如大规模集群下的稳定断点续训、高性能异步Rollout机制、以及高性能算子(Kernel)的集成与优化。
任职要求:
任职资格:
1、优秀的代码能力、数据结构和基础算法功底,熟悉Python开发,熟悉 Linux/Git开发环境;
2、有较好的学习能力、沟通协作能力和自驱力,能和团队一起探索新技术,推进技术进步(⭐️有大牛带着成长)
2、熟悉至少一种主流基础深度学习训练框架(TensorFlow/PyTorch/PaddlePaddle等)的使用和实现;
3、了解主流LLM模型…
招聘城市:北京
岗位职责:
工作职责:
1. 真实业界数据的处理分析:定性分析、定量评估数据质量、对数据采集和处理方案不断优化改进;
2. 模型开发:参与Qwen、Llama等开源LLM的训练微调、量化和部署实践,追踪业内前沿,达到领先的性能指标;
3. 结合小红书丰富的工业场景,根据实际业务需求进行技术落地和创新。
任职要求:
岗位要求:
1. 计算机/数学/统计等相关专业,硕士及以上学历,良好的PyTorch/python技术栈;
2. 有PyTorch多卡训练相关经历加分,熟练使用ChatGPT 等工具提升工作效率加分;
3. 对 SOTA 的大模型技术有深入了解,能够问出好的问题;
4. 25年及之后毕业,每周至少4天,实习三个月及以上的时间。
招聘城市:北京
…参与/负责研发面向大语言模型(LLM)/多模态大模型(MLLM)等类型模型的推理服务框架;
2、通过并行计算优化、分布式架构优化、异构调度等多种框架技术,打造高效、易用、领先的AI推理框架;
2、深度参与周边深度学习系统多个子方向的工作,包括但不限于模型管理、推理部署、日志/监控、工作流编排等;
3、与全公司各业务算法部门深度合作,为重点项目进行算法与系统的联合优化,支撑业务目标达成。
任职要求:
任职资格:
1、优秀的代码能力、数据结构和基础算法功底,熟悉C++/Python开发,熟悉 Linux/Git 开发环境;
2、熟悉至少一种主流基础深度学习训练或推理框架(TensorFlow/PyTorch/PaddlePaddle/TensorRT等)的使用和实现;
3、熟悉主流LLM模型结构,熟悉至少一种主流LLM推理…
招聘城市:北京,上海
岗位职责:
1、海量文本数据处理,包含分类、质量打分、语义识别等;
2、建立文本处理流程,持续优化模型效果;
3、跟踪最新NLP研究成果,并应用到处理流程中。
任职要求:
1、计算机相关方向本科及以上学历;
2、良好的编程能力,熟练运用Python语言,熟悉常见的机器学习框架;
3、熟悉常见的机器学习和NLP算法,了解当前热点和前沿技术;
4、有高水平会议或期刊论文者优先。
5、可尽快到岗者优先,至少实习3个月,每周工作日出勤至少4天。
招聘城市:上海
…希望你:
1. 深度学习基础扎实,熟悉Transformer原理,熟悉当前主流LLM架构
2. 熟悉常见大模型训练框架(Megatron/DeepSpeed/Verl)
3. 有LLM相关项目经验:CPT、SFT、RL 任意方向即可
4. 有阅读论文与复现能力,能快速上手实验
5. 良好的自我学习能力和独立思考能力
加分项:
1. 有相关领域顶会论文,或拥有影响力工作
2. 有自己的LLM项目
3. 有机器翻译(MT)经验
4. 熟悉生成式推荐(前沿进展,有相关研究或业务落地经验
5. 有 Agent RL相关的项目经验或算法调优经验
网申须知
网申开始日期:2026-03-05 00:00
网申截止日期:2026-06-01 00:00
仅限 2026-09 至 2027-08 毕业的大学生,快来投递吧~
投递简历
招聘城市:北京,上海
岗位职责:
1.研究大模型前沿技术,包括但不限于预训练,指令微调和强化学习等对齐技术,多模态、可控文本生成等;
2.负责大模型高效分布式训练和性能优化;
3.研究模型压缩和推理优化技术,包括但不限于剪枝、量化及知识蒸馏等;
4.推动大模型在搜索、客服、推荐、广告等场景规模化落地;
5.参与大模型平台建设。
任职要求:
1.硕士及以上学历,计算机、数学、统计学或相关专业;
2.扎实的算法功底,熟悉自然语言处理和机器学习技术,对技术开发及应用有热情;
3.熟悉Python/Java等编程语言,有一定工程能力;
4.熟悉PyTorch/Tensorflow/Megtron等深度学习分布式框架并有实际项目经验;
5.熟悉Transformer/BERT/GPT等基础模型;
6.在NLP…
招聘城市:北京,上海,杭州
…推理机制,探索如何通过算法创新来实现CoT的高效压缩。
具体研究内容包括但不限于:基于模型结构进行优化、基于推理过程进行优化、基于Prompt进行优化、以及基于数据驱动的压缩策略等。通过本课题的研究,期望能够为LLMs的高效推理提供新的理论和技术支持,推动其在更多实际场景中的广泛应用。
任职要求:
1、不限年级,本科及以上在读,计算机/人工智能/软件工程等相关专业优先;
2、熟悉Linux/Unix平台上的C++编程,熟悉网络编程-多线程编程,有良好的编程习惯;
3、熟悉其中一种主流的深度学习训练或推理框架(TensorFlow / PyTorch / Onnx / TensorRT等)的原理和实现者优先;
4、有扎实的专业基础知识,熟悉常用的数据结构和算法,对…
招聘城市:上海
…负责构建和维护检索增强生成(RAG)案例库,包括违规案例的结构化存储、语义检索、案例匹配等,提升审核决策的准确性和可解释性;
3.进行大模型内容生成前沿技术探索和研发,包含但不限于Prompt Engineering、Few-shot Learning、Chain-of-Thought、Multi-Agent协作等;
任职要求:
1.在大模型数据生成、SFT等方向有一定经验,有相关的落地项目或比赛经历;
2.有良好的英文读写能力和扎实的数学基础,有快速学习新技术的能力;
3.有扎实的编程基础,熟悉Python/C++等编程语言,具有快速复现前沿论文的能力;
4.熟悉至少一个深度学习和大模型训练框架,包括PyTorch、TensorFlow、MXNet、Caffe、HuggingFace、DeepSpeed等;
5.较强的业务问题到算法模型的建模能力…
招聘城市:上海,北京
…意图理解等;
任职要求:
1.对大模型、多模态有强烈兴趣,或在大模型方向有相关经验者优先;
2.有良好的英文读写能力和扎实的数学基础,有快速学习新技术的能力;
3.有扎实的编程基础,熟悉Python/C++等编程语言,具有快速复现前沿论文的能力;
4.熟悉至少一个深度学习和大模型训练框架,包括PyTorch、TensorFlow、MXNet、Caffe、HuggingFace、DeepSpeed等;
5.有较强的研究能力,在国际顶尖会议或期刊(包括但不限于CVPR, ICCV, ECCV, NeurIPS, ICML, ICLR, AAAI, IJCAI, ACMMM, TIP, TPAMI, IJCV,ACL、EMNLP、NAACL、COLING、CoNLL、NLPCC等)上发表过论文者优先;
6.较强的业务问题到算法模型的建模能力,有强烈的求知欲、自驱力和进取心,能及时关注和…