招聘城市:北京,上海
…参与AI平台大模型推理部署等流程及工具的研发建设,完善平台现有功能。
2、参与AI平台Quota管理模块的开发,实现多机房、多集群环境下的,各种异构计算资源的配额管理功能。
3、参与AI平台联邦调度能力的设计和开发,与下游云原生团队共同实现平台联邦和弹性部署能力。
任职要求:
1、计算机/软件工程相关专业在校生,熟悉Go/Python/Java至少一门语言
2、了解Linux系统及算法基础,熟悉MySQL/Redis等组件使用
3、了解 Kubernetes 架构和生态,有一定的云原生机器学习系统实践和开发经验;
具备快速学习能力,能持续跟踪AI基础设施技术动态
加分项
1、接触过Mesos、Yarn、Argo、Volcano 等云原生技术
2、熟悉大模型推理基本原理,拥有使用…
招聘城市:北京,上海
…推理系统带来的复杂挑战,通过弹性调度、容量规划、链路压测等手段提升系统健壮性,确保平台能够弹性扩展,支撑业务的飞速增长。
任职要求:
任职要求
熟悉业界主流Dense、MOE大模型架构及主要特点,能识别出模型效果及主要使用场景,支持用户大模型的选型和使用需求;
了解至少一种大模型服务推理部署框架,如vLLM、SGLang、Dynamo等,并有过大模型服务部署的经验;
优秀的代码能力、数据结构和基础算法功底,熟悉C++/Python开发,熟悉 Linux/Git 开发环境;
有强烈的工作责任心,较好的学习能力、沟通协作能力和自驱力,能和团队一起探索新技术,推进技术进步。
加分项
有AI大模型网关相关方向研究或实操经验,如多模型…
招聘城市:北京,上海
…参与AI平台大模型推理部署等流程及工具的研发建设,完善平台现有功能。
参与AI平台Quota管理模块的开发,实现多机房、多集群环境下的,各种异构计算资源的配额管理功能。
参与AI平台联邦调度能力的设计和开发,与下游云原生团队共同实现平台联邦和弹性部署能力。
任职要求:
任职要求:
计算机/软件工程相关专业在校生,熟悉Go/Python/Java至少一门语言
了解Linux系统及算法基础,熟悉MySQL/Redis等组件使用
了解 Kubernetes 架构和生态,有一定的云原生机器学习系统实践和开发经验;
具备快速学习能力,能持续跟踪AI基础设施技术动态
加分项:
接触过Mesos、Yarn、Argo、Volcano 等云原生技术
熟悉大模型推理基本原理,拥有使用 vLLM/TensorRT-LLM等推理…
招聘城市:北京
…参与/负责研发面向大语言模型(LLM)/多模态大模型(MLLM)等类型模型的推理服务框架;
2、通过并行计算优化、分布式架构优化、异构调度等多种框架技术,打造高效、易用、领先的AI推理框架;
2、深度参与周边深度学习系统多个子方向的工作,包括但不限于模型管理、推理部署、日志/监控、工作流编排等;
3、与全公司各业务算法部门深度合作,为重点项目进行算法与系统的联合优化,支撑业务目标达成。
任职要求:
1、优秀的代码能力、数据结构和基础算法功底,熟悉C++/Python开发,熟悉 Linux/Git 开发环境;
2、熟悉至少一种主流基础深度学习训练或推理框架(TensorFlow/PyTorch/PaddlePaddle/TensorRT等)的使用和实现;
3、熟悉主流LLM模型结构,熟悉至少一种主流LLM推理框架(vLLM…
招聘城市:北京
…负责研发面向大语言模型(LLM)/多模态大模型(MLLM)等类型模型的推理服务框架;
2、通过并行计算优化、分布式架构优化、异构调度等多种框架技术,打造高效、易用、领先的AI推理框架;
2、深度参与周边深度学习系统多个子方向的工作,包括但不限于模型管理、推理部署、日志/监控、工作流编排等;
3、与全公司各业务算法部门深度合作,为重点项目进行算法与系统的联合优化,支撑业务目标达成。
任职要求:
任职资格:
1、优秀的代码能力、数据结构和基础算法功底,熟悉C++/Python开发,熟悉 Linux/Git 开发环境;
2、熟悉至少一种主流基础深度学习训练或推理框架(TensorFlow/PyTorch/PaddlePaddle/TensorRT等)的使用和实现;
3、熟悉主流LLM模型结构,熟悉至少一种主流LLM推理框架…
招聘城市:北京
…负责研发面向大语言模型(LLM)/多模态大模型(MLLM)等类型模型的推理服务框架;
2、通过并行计算优化、分布式架构优化、异构调度等多种框架技术,打造高效、易用、领先的AI推理框架;
2、深度参与周边深度学习系统多个子方向的工作,包括但不限于模型管理、推理部署、日志/监控、工作流编排等;
3、与全公司各业务算法部门深度合作,为重点项目进行算法与系统的联合优化,支撑业务目标达成。
任职要求:
任职资格:
1、优秀的代码能力、数据结构和基础算法功底,熟悉C++/Python开发,熟悉 Linux/Git 开发环境;
2、熟悉至少一种主流基础深度学习训练或推理框架(TensorFlow/PyTorch/PaddlePaddle/TensorRT等)的使用和实现;
3、熟悉主流LLM模型结构,熟悉至少一种主流LLM推理框架…
招聘城市:上海,北京
岗位职责:
核心职责
参与小红书大模型平台推理部署等流程及工具的研发建设,完善平台现有功能
参与平台Quota管理模块的开发,实现多机房、多集群环境下的,各种异构计算资源的配额管理功能
参与平台大模型训练/压缩/推理/数据集/资源调度等流程及工具的研发建设
任职要求:
任职要求
计算机/软件工程相关专业在校生,熟悉Go/Python/Java至少一门语言
了解Linux系统及算法基础,熟悉MySQL/Redis/MQ等组件使用
熟悉 Kubernetes 技术栈,有一定的云原生机器学习系统实践和开发经验
有大模型部署经验,对 vLLM/SGLang/Dynamo 等至少一种推理框架有使用经验
具备快速学习能力,熟练使用 Git,熟练使用 github copilot/cursor 等 AI 编程工具
加分项
接触过…
招聘城市:北京,上海
岗位职责:
1.负责大模型推理引擎的研发和优化,包括推理系统优化、模型量化压缩和模型部署;
2.负责开发和维护基于大规模数据的推理引擎;
3.参与解决推理过程中的技术难题,提升推理算法的性能和效果;
4.开展相关领域的技术研究,提出创新性的解决方案。
任职要求:
1.大学本科及以上学历,计算机相关专业优先;
2.有软件开发经验,有推理引擎开发经验者优先考虑;
3. 熟练掌握C++、CUDA编程,熟悉常见的数据结构和算法;
4. 熟悉机器学习和深度学习理论,具备扎实的编程能力,熟悉Transformer结构优化者优先;
5. 熟悉常用的深度学习框架,如TensorFlow、PyTorch等,熟悉以下推理框架者优先sglang/vllm、FasterTransformer、DeepSpeed FastGen、TensorRT-LLM等;
6. 具备良好的…
招聘城市:北京
岗位职责:
1. 参与对深度学习模型进行模型剪枝、蒸馏、量化等相关压缩技术的研究与落地;
2. 参与研发深度学习模型推理服务框架,实现推理服务高吞吐、低延迟、高可用;
3. 参与不同NPU/GPU上高性能训练/推理算子研发,实现训练/推理计算加速。
任职要求:
- 优秀的代码能力,扎实的数据结构和基础算法功底;
- 熟悉至少一种主流的机器学习框架(Tensorflow/Pytorch);
- 熟悉c++/cuda编程;
- 对模型压缩领域技术有一定基础。
招聘城市:北京,上海
…深入研究并提升大模型对代码语义、工程级上下文及复杂依赖关系的理解能力,推动代码生成和理解在复杂工程环境中的落地;
2、设计并实现面向代码场景的模型训练与推理方案,包括领域特定预训练、上下文建模、推理策略优化等;
3、提升模型在跨文件、跨模块、跨仓库场景下的分析与推理能力,支持超大规模代码库(几十万行及以上)的理解与分析;
4、结合端智能场景,优化端云协同的 AI 系统架构,在模型能力、时延、带宽、功耗与稳定性之间取得平衡,并最终落地到用户行为分析与本地决策;
5、建立面向代码智能与端智能场景的评测体系,持续定位并突破当前大模型在工程级与端侧落地中…
招聘城市:北京,上海
岗位职责:
1、探索新一代大语言模型基座架构,以高效推理模式为核心优化目标,探索全新模型结构和scaling law。
2、在工作中能快速成长,积极探索前沿技术,解决好业务中遇到的实际问题,完成数据处理、建模和工程上线,对AI技术始终保持热爱,实习期间可发表论文。
任职要求:
1、硕士/博士在读,计算机、数学等相关专业,国内985/全球TOP高校优先,实习期至少3个月;
2、大模型领域前沿技术有深度研究,在国际顶会/顶刊发表过高水平论文者优先;
3、在大模型领域有实践经验,包括数据过滤、数据去重、数据合成,或继续预训练、SFT、RLHF,或知识蒸馏、量化和模型剪枝,或参与过rag和agent商业产品研发;
4、有良好代码能力…
招聘城市:北京
岗位职责:
1. 参与对深度学习模型进行模型剪枝、蒸馏、量化等相关压缩技术的研究与落地;
2. 参与研发深度学习模型推理服务框架,实现推理服务高吞吐、低延迟、高可用;
3. 参与不同NPU/GPU上高性能训练/推理算子研发,实现训练/推理计算加速。
任职要求:
- 优秀的代码能力,扎实的数据结构和基础算法功底;
- 熟悉至少一种主流的机器学习框架(Tensorflow/Pytorch);
- 熟悉c++/cuda编程;
- 对模型压缩领域技术有一定基础。
招聘城市:北京,上海
岗位职责:
1.负责LLM大语言模型的推理优化;
2.负责机器学习引擎的编译优化工作;
3.负责模型稀疏化和模型量化工作。
任职要求:
1.熟练掌握CUDA编程、C++编程,数据结构和算法知识;
2.熟悉TVM或TensorRT或FastTransformer等推理优化框架;
3.熟悉LLM大模型相关背景知识,有相关方向的研究经验和产出。
岗位亮点
1.紧跟人工智能行业进展,接触到前沿技术和行业趋势,磨练出对人工智能的独到见解;
2.参与AI大模型的数据、训练与评测的全流程,了解从理论到工程实践的全面技能;
3.有机会参与公司的创新项目,跨足不同领域,拓宽人工智能技术的应用范围。
招聘城市:北京,上海,广州
岗位职责:
日常实习:面向全体在校生,为符合岗位要求的同学提供为期>3个月及以上的项目实践机会。
团队介绍:创作发布团队负责小红书“+”号入口,是全平台用户笔记发布的核心能力模块,承载着内容生成、处理与分发的关键任务。我们希望通过智能化技术,持续提升内容创作效率与用户体验。
在这里,AI 引擎工程师将聚焦于结合小红书内部业务特点,对“端 & 云 AI 推理引擎”进行深度优化,从模型能力构建、框架适配,到端云协同部署,推动算法真正落地业务,构建完整的推理闭环。
你将接触并支持的算法方向包括:AIGC、文本与多模态大语言模型(LLM)、音频处理、基础视觉等多个前沿领域。这些模型往往结构复杂、实时性…
招聘城市:北京
…的推理调度策略优化和关键算子(Kernel)的性能剖析与极致优化,持续提升系统的吞吐量、降低延迟;
4、生态合作与协同:作为技术接口人,与国产芯片原厂技术支持团队紧密合作,高效推进芯片驱动、基础软件栈的引入、问题排查与版本迭代,确保技术路线顺畅推进。
任职要求:
任职资格:
1、熟练掌握 C++/Python 编程,具备扎实的计算机体系结构、数据结构和算法基础,具备良好的编程习惯;
2、有至少一款非Nvidia GPU的异构计算芯片适配大模型训练、推理框架的相关经验,包括但不限于AI框架适配、模型移植、性能优化或算子开发;
3、熟悉至少一种主流的机器学习框架(PyTorch/PaddlePaddle/TensorFlow等),对框架内部实现有一定了解;
4、具备大型深度学习模型(尤其是大…
招聘城市:北京,上海,杭州
岗位职责:
深入研究和应用AI大模型技术,对工程架构做全面设计,推动架构智能化升级,确保系统具备高扩展性、高稳定性和高性能,以适应不断变化的业务需求和数据量的增长。
任职要求:
1、不限年级,本科及以上在读,人工智能/计算机/软件工程等相关专业优先;
2、具备优秀的代码能力、数据结构和基础算法功底,熟练掌握C/C++、Python等一个或多个编程语言;
3、熟悉大模型相关的算法和技术,有自然语言处理、大模型训练、强化学习算法经验者优先;
4、在软件工程或者人工智能领域有出色的科研经历,在NeurlPS/ICRL/ICML/ISSTA/ACL/EMNLP等国际顶级期刊会议上发表论文者优先;
5、良好的沟通协作能力,责任心强,积极…
招聘城市:北京,上海
…大规模分布式推理系统带来的复杂挑战,通过弹性调度、容量规划、链路压测等手段提升系统健壮性,确保平台能够弹性扩展,支撑业务的飞速增长。
任职要求:
1、熟悉业界主流Dense、MOE大模型架构及主要特点,能识别出模型效果及主要使用场景,支持用户大模型的选型和使用需求;
2、了解至少一种大模型服务推理部署框架,如vLLM、SGLang、Dynamo等,并有过大模型服务部署的经验;
3、优秀的代码能力、数据结构和基础算法功底,熟悉C++/Python开发,熟悉 Linux/Git 开发环境;
4、有强烈的工作责任心,较好的学习能力、沟通协作能力和自驱力,能和团队一起探索新技术,推进技术进步。
加分项
1、有AI大模型网关相关方向研究…
招聘城市:北京,上海,杭州
岗位职责:
深入研究和应用AI大模型技术,对工程架构做全面设计,推动架构智能化升级,确保系统具备高扩展性、高稳定性和高性能,以适应不断变化的业务需求和数据量的增长。
任职要求:
1、不限年级,本科及以上在读,人工智能/计算机/软件工程等相关专业优先;
2、具备优秀的代码能力、数据结构和基础算法功底,熟练掌握C/C++、Python等一个或多个编程语言;
3、熟悉大模型相关的算法和技术,有自然语言处理、大模型训练、强化学习算法经验者优先;
4、在软件工程或者人工智能领域有出色的科研经历,在NeurlPS/ICRL/ICML/ISSTA/ACL/EMNLP等国际顶级期刊会议上发表论文者优先;
5、良好的沟通协作能力,责任心强,积极…
招聘城市:上海,北京
…的表现
算法探索:学习探索前沿强化学习算法,协助团队进行奖励模型的构建和优化
Reasoning技术探索:参与模型监督、自我提升等训练优化探索
训练框架优化:学习使用LLM训练框架,参与协助优化训练流程,提升团队开发效率
任职要求:
任职资格
具备较好的编程能力和算法开发能力,熟悉常用的机器学习、深度学习算法
熟悉Llama-Factory、veRL、MS-Swift等框架,有相关项目经验更佳
了解分布式训练框架如DeepSpeed、Megatron-LM等
有较强的学习意愿和团队协作精神,能保证每周至少3天实习时间,实习期至少3个月
加分项
对强化学习有基本了解或项目经验
有开源项目贡献经历,尤其是与LLM相关的项目
发表过相关领域的学术论文
对模型对齐、推理…
招聘城市:北京,上海
…模分布式推理系统带来的复杂挑战,通过弹性调度、容量规划、链路压测等手段提升系统健壮性,确保平台能够弹性扩展,支撑业务的飞速增长。
任职要求:
任职要求
1、熟悉业界主流Dense、MOE大模型架构及主要特点,能识别出模型效果及主要使用场景,支持用户大模型的选型和使用需求;
2、了解至少一种大模型服务推理部署框架,如vLLM、SGLang、Dynamo等,并有过大模型服务部署的经验;
3、优秀的代码能力、数据结构和基础算法功底,熟悉C++/Python开发,熟悉 Linux/Git 开发环境;
4、有强烈的工作责任心,较好的学习能力、沟通协作能力和自驱力,能和团队一起探索新技术,推进技术进步。
加分项
1、有AI大模型网关相关方向…