招聘城市:北京,上海
…模型推理部署等流程及工具的研发建设,完善平台现有功能。
参与AI平台Quota管理模块的开发,实现多机房、多集群环境下的,各种异构计算资源的配额管理功能。
参与AI平台联邦调度能力的设计和开发,与下游云原生团队共同实现平台联邦和弹性部署能力。
任职要求:
任职要求:
计算机/软件工程相关专业在校生,熟悉Go/Python/Java至少一门语言
了解Linux系统及算法基础,熟悉MySQL/Redis等组件使用
了解 Kubernetes 架构和生态,有一定的云原生机器学习系统实践和开发经验;
具备快速学习能力,能持续跟踪AI基础设施技术动态
加分项:
接触过Mesos、Yarn、Argo、Volcano 等云原生技术
熟悉大模型推理基本原理,拥有使用 vLLM/TensorRT-LLM等推理框架部署大模型…
招聘城市:北京,上海
…参与AI平台大模型推理部署等流程及工具的研发建设,完善平台现有功能。
2、参与AI平台Quota管理模块的开发,实现多机房、多集群环境下的,各种异构计算资源的配额管理功能。
3、参与AI平台联邦调度能力的设计和开发,与下游云原生团队共同实现平台联邦和弹性部署能力。
任职要求:
1、计算机/软件工程相关专业在校生,熟悉Go/Python/Java至少一门语言
2、了解Linux系统及算法基础,熟悉MySQL/Redis等组件使用
3、了解 Kubernetes 架构和生态,有一定的云原生机器学习系统实践和开发经验;
具备快速学习能力,能持续跟踪AI基础设施技术动态
加分项
1、接触过Mesos、Yarn、Argo、Volcano 等云原生技术
2、熟悉大模型推理基本原理,拥有使用…
招聘城市:上海,北京
岗位职责:
核心职责
参与小红书大模型平台推理部署等流程及工具的研发建设,完善平台现有功能
参与平台Quota管理模块的开发,实现多机房、多集群环境下的,各种异构计算资源的配额管理功能
参与平台大模型训练/压缩/推理/数据集/资源调度等流程及工具的研发建设
任职要求:
任职要求
计算机/软件工程相关专业在校生,熟悉Go/Python/Java至少一门语言
了解Linux系统及算法基础,熟悉MySQL/Redis/MQ等组件使用
熟悉 Kubernetes 技术栈,有一定的云原生机器学习系统实践和开发经验
有大模型部署经验,对 vLLM/SGLang/Dynamo 等至少一种推理框架有使用经验
具备快速学习能力,熟练使用 Git,熟练使用 github copilot/cursor 等 AI 编程工具
加分项
接触过…
招聘城市:北京
…16小时,截止2022年6月,已经累计配送近220万单。
欢迎加入美团无人车团队,与我们一起用科技推动即时零售再升级!
岗位职责:
1. 负责自动驾驶模型在嵌入式平台上的部署与性能优化。
2. 设计并实现模型量化、剪枝、蒸馏等轻量化技术方案。
3. 协同算法团队完成模型训练到部署的全流程闭环。
4. 分析并解决模型部署过程中的精度损失与实时性瓶颈问题。
任职要求:
1. 硕士研究生及以上学历,计算机、自动化、电子工程等相关专业。
2. 熟悉C++、Python,具备扎实的编程与算法基础。
3. 熟悉 TensorRT 模型部署框架者优先。
4. 了解自动驾驶感知、规划或控制模型者优先。
5. 一周出勤4天以上,可长期实习优先。
岗位亮点:…
招聘城市:广州
…年以上?作经验,1年以上?模型基础设施、训推平台运维相关?作经验; 2、熟悉Linux系统常?操作命令,能独?完成?模型部署、训推平台搭建、GPU资源管理与监控; 3、了解主流?模型(如deepseek、ChatGLM等)的部署架构与运维要点,熟悉容器化部署(Docker、K8s)者优先; 4、具备良好的技术学习能?与问题排查能?,能快速适配?模型基础设施相关技术迭代需求; 5、具备基础的技术带教与分享能?,能协助培养团队?模型基础设施相关技术?才; 6、?作责任?强,具备良好的沟通能?,能对接?商与团队内部推进?作落地,严格遵守?内信息安全与运维规范。 优先条件 1、有银?、?融?业?模型基础设施搭建、训推平台运维相关?作经验者…
招聘城市:上海,杭州
…参与模型从 PyTorch 到 ONNX / TensorRT 的转换、验证和部署
分析并优化模型推理的吞吐、延迟与显存占用
任职要求:
我们希望你:
有过互联网企业实习经验,每周到岗 4-5 个工作日,实习 6 个月以上者优先,27年及以后毕业
1、大学本科或以上学历,计算机相关专业
2、熟练使用 Python,熟悉 PyTorch 深度学习框架
3、熟悉常见深度学习模型结构
4、熟悉GPU 基本原理,有 CUDA、Triton Kernel 开发或优化经验者优先,有使用 profiler(如 Nsight Systems、 Nsight C、PyTorch profiler 等)进行性能分析优化的经验优先
5、有以下其一或多项经验者优先
使用过 vLLM/SGLang/Tensorrt-LLM或其他大模型推理框架,并熟悉底层原理
熟悉TensorRT/ONNX Runtime等模型部署或加速,熟悉模型…
招聘城市:北京,上海
…移动计算/模型压缩 相关会议或期刊发表或投稿论文(MLSys/EuroSys/MobiSys/MobiCom/CVPR/ICCV等),或有相关研究经历。
或在 On-device AI/Model Compression/Efficient Inference 方向有深入研究(需提供技术报告或开源项目)。
3.熟悉至少一种移动端开发技术栈(Android/iOS/Flutter/React Native),有端侧性能优化经验。
4.了解深度学习推理框架(TensorFlow Lite/ONNX Runtime/MNN/NCNN/Core ML等),有模型部署实践。
5.熟悉Python/C++/Java/Kotlin/Swift任一语言,有系统编程或性能调优经验者优先。
6.加分项:参与过端侧AI开源项目(如llama.cpp/MLC-LLM/web-llm);有GPU/NPU异构计算经验;了解WebAssembly/WebGPU。
【实习收获】
掌握端侧大模型从研究到落地的全链路技术
接触亿级用户产品的端智能…
招聘城市:北京,上海
…及以上的Linux平台下的开发经验;
2. 有扎实的编程基础,良好的数据结构和算法功底,熟悉C++/Java/Python至少一种编程语言;
3. 有较强的系统架构设计和性能优化能力,优秀的分析和解决问题的能力;
4. 熟悉至少一种主流的机器学习框架(TensorFlow / PyTorch),熟悉开源社区、善于挖掘和整合开源能力者优先;
5. 具备较强的学习能力、沟通协作能力,有良好的团队精神;
6. 有创新精神,勇于挑战未知技术领域。
具备以下者优先:
1. 有实际大模型训练平台开发经验(标注平台、数据管理平台、模型管理系统、模型评测系统、模型自动化部署);
2. 具有实际模型训练加速经验,熟悉训练框架、分布式训练方案(Pytorch、Megatron、Deep-Speed);
3. 熟悉模型部署框架(Triton、FasterTransformer等)。
招聘城市:北京
…实习内容:
参与基于Agentic RAG 等技术构建企业级别知识库问答等LLM上层应用。
参与AI 加辅助编程工具的开发与优化(如代码自动补全、智能Bug检测等);
基于大语言模型(LLM)探索代码生成与重构的可行性方案;
研究AI在软件工程中的落地场景(如需求分析、文档生成、Figma生成代、测试用例生成与结果分析码等)。
2. 端智能开发方向
目标:在移动端设备等资源受限场景下实现高效的AI模型部署与推理。
实习内容:
参与端侧AI模型的轻量化设计与优化(如模型剪枝、量化、蒸馏等);
探索端云协同的智能应用方案(如模型动态更新、数据隐私保护等);
落地实际场景的端智能应用(如移动端图像识别、用户行为分析等)…
招聘城市:北京
佛山知擎科技有限公司北京分公司
招聘信息
大模型研发工程师(全职)
2026-03-17 15:58:25
职位描述
教育背景:计算机科学、人工智能、软件工程或相关专业985/211大学全日制本科及以上学历。
经验技能:
1. 扎实的Python编程基础,良好的软件工程能力和代码规范。
2. 必须具备:至少1年以上大模型相关项目开发经验,熟练掌握大模型微调(Fine-Tuning)、RAG、Agent开发等,并有成功的项目实践。
3. 必须具备:熟悉主流的大模型应用开发框架,如 LangChain、LangGraph等,理解其核心概念并能灵活运用。
4. 对LLM Ops有相关经验,了解模型部署、监控、评估等相关工具和实践。
核心素质:
1. 极强的动手能力和解决问题能力,能够快速将想法转化为可…
招聘城市:北京,上海,深圳,其它
…基础设施要求。
善于设计技术解决方案来确保数据主权、符合 GDPR 规定,以及实现安全的模型治理。
优先条件:
拥有计算机科学或相关技术专业的硕士或博士学位。
有设计集成式系统、应对实时推理限制以及在资源受限环境中实现模型量化的经验。
有优化状态管理和精细跟踪方面的经验,或善于利用模型部署指标知识,通过大规模生成内容来最大限度地提高吞吐量并减少计算浪费。
善于在复杂的企业环境中设计和扩展生产级机器学习系统,并善于设计和扩展工作流流水线以实现 CI/CD/CT 自动化和实验。
有生成式媒体模型和微调功能方面的经验,可确保在图片、视频和音频中生成高度逼真且与品牌一致的内容。…
招聘城市:北京,上海
岗位职责:
1.负责大模型推理引擎的研发和优化,包括推理系统优化、模型量化压缩和模型部署;
2.负责开发和维护基于大规模数据的推理引擎;
3.参与解决推理过程中的技术难题,提升推理算法的性能和效果;
4.开展相关领域的技术研究,提出创新性的解决方案。
任职要求:
1.大学本科及以上学历,计算机相关专业优先;
2.有软件开发经验,有推理引擎开发经验者优先考虑;
3. 熟练掌握C++、CUDA编程,熟悉常见的数据结构和算法;
4. 熟悉机器学习和深度学习理论,具备扎实的编程能力,熟悉Transformer结构优化者优先;
5. 熟悉常用的深度学习框架,如TensorFlow、PyTorch等,熟悉以下推理框架者优先sglang/vllm、FasterTransformer、DeepSpeed FastGen、TensorRT-LLM等;
6. 具备良好的…
招聘城市:北京,上海
…及以上的Linux平台下的开发经验;
2. 有扎实的编程基础,良好的数据结构和算法功底,熟悉C++/Java/Python至少一种编程语言;
3. 有较强的系统架构设计和性能优化能力,优秀的分析和解决问题的能力;
4. 熟悉至少一种主流的机器学习框架(TensorFlow / PyTorch),熟悉开源社区、善于挖掘和整合开源能力者优先;
5. 具备较强的学习能力、沟通协作能力,有良好的团队精神;
6. 有创新精神,勇于挑战未知技术领域。
具备以下者优先:
1. 有实际大模型训练平台开发经验(标注平台、数据管理平台、模型管理系统、模型评测系统、模型自动化部署);
2. 具有实际模型训练加速经验,熟悉训练框架、分布式训练方案(Pytorch、Megatron、Deep-Speed);
3. 熟悉模型部署框架(Triton、FasterTransformer等)。
招聘城市:上海,北京
…的开发经验;
2.有扎实的编程基础,良好的数据结构和算法功底,熟悉C++/Java/Python至少一种编程语言;
3.有较强的系统架构设计和性能优化能力,优秀的分析和解决问题的能力;
4.熟悉至少一种主流的机器学习框架(TensorFlow/PyTorch),熟悉开源社区、善于挖掘和整合开源能力者优先;
5.具备较强的学习能力、沟通协作能力,有良好的团队精神;
6.有创新精神,勇于挑战未知技术领域。
具备以下者优先:
1.有实际大模型训练平台开发经验(标注平台、数据管理平台、模型管理系统、模型评测系统、模型自动化部署);
2.具有实际模型训练加速经验,熟悉训练框架、分布式训练方案(Pytorch、Megatron、Deep-Speed);
3.熟悉模型部署框架(Triton、FasterTransformer等)。
立即申请: zh***com[点击查看]
招聘城市:上海
岗位介绍:
职位描述
工作职责:
1、AI相关业务的算法模型开发,以及对应服务的基础研发、落地、上线任务;
2、算法模型的优化迭代:数据的清洗、模型结构设计/训练、模型部署;
3、和业务负责人沟通业务需求、数据、标准、指标,和工程团队对接上线,以及上线后负责数据的回收;
工作要求:
1、能熟练完成LLM/VLM的后训练,了解agent在业务场景中的落地方式,实操过至少一个算法领域:视觉、文本、语音;
2、熟练使用Python,具备基本的工程、代码能力,熟悉常用机器学习训练推理框架;
3、熟练使用SQL,具备基本的查表、数据能力;
4、有过AI机器审核、风控、安全实习经历的同学优先;
投递简历
招聘城市:北京,上海
…熟练且高频地使用主流大模型与 AI 编程辅助工具,能根据产品逻辑与用户行为,自主完成从架构设计到代码实现的全链路交付。
3、云原生与基础架构认知: 熟悉 Linux 系统,了解 MySQL / Redis / MQ 等常见中间件;接触过 Kubernetes 生态技术栈(Docker / K8s / Argo 等),对云原生机器学习系统有一定认知。
4、AI 技术栈热情: 对 AI 领域充满浓厚兴趣,了解大模型(LLM / CV / NLP)的基本原理与应用场景,对 PyTorch / Transformer 架构有基本认知。
5、软素质与极客精神: 具备良好的工程质量意识与代码风格;沟通协作顺畅,自驱力强,能在高技术密度的团队中快速成长。
加分项
1、大模型部署与框架经验: 有大模型部署实践经验,对 vLLM / SGLang…
招聘城市:北京
…模型训练等方面的问题,进行技术方案的制定及技术难题的攻关;
3. 对模型进行优化和部署,提高模型的效率和性能;
4. 充分了解业内先进技术和前沿技术发展动态,驱动团队技术提升;
5. 与团队成员共同攻克技术难题,持续迭代项目能力输出,提高服务质量。
任职要求:
工作要求 :
1. 本科及以上学历,计算机相关专业;
2. 有扎实的编程基础,良好的数据结构和算法功底,熟悉C++/Java/Python至少一种编程语言;
3. 有较强的系统架构设计和性能优化能力,优秀的分析和解决问题的能力;
4. 熟悉至少一种主流的机器学习框架(TensorFlow / PyTorch),熟悉开源社区、善于挖掘和整合开源能力者优先。
具备以下者优先:
1. 有实际大模型训练平台开发经验(标注平台…
招聘城市:北京,深圳,其它
…如 MES、SCADA 等)进行无缝集成,确保模型在实际运行中的稳定性和可靠性,提供高效、实时的推理服务。
6.持续跟踪和研究大模型领域的前沿技术,如Transf
任职要求
岗位要求:
1,硕士及以上学历,熟悉Qwen、LLAMA、GPT、Deepseek等主流大语言模型或多模态模型算法基本原理
2,熟悉大模型预训练、监督微调、强化学习等基本流程,熟练使用LLAMAFactory、veRL、OpenRLHF、TRL等模型训练框架
3,熟悉大模型相关加速算法原理及部署,例如Deepspeed、VLLM、FlashAttention、SGLang等
4,熟悉RAG基本流程及主流RAG框架及算法,例如Langchian、LlamaIndex、GraphRAG、RagFlow等
5,熟悉Agent基本原理、WorkFlow编排机制以及主流框架算法,例如Dify、LangGraph等
6,具有和大模型相关的多模态知识解析、知识高效存储…
招聘城市:深圳,其它
深圳市集贤科技有限公司
AI大模型开发工程师
12K-18K/月 深圳市 硕士及以上 模拟面试
职位诱惑:年底双薪 绩效奖金 弹性工作 带薪年假 岗位晋升
薪酬福利:六险一金
发布时间:2025年11月12日
职位描述
岗位职责:
岗位职责:
1、知识库系统开发
设计并搭建企业级内部知识库系统,实现文档智能管理、检索与问答功能
集成NLP技术(如文本分类、实体识别)优化知识结构化与检索效率
2、大模型开发与优化
训练/微调行业专属大模型(如LLaMA、ChatGLM等开源模型),适配企业业务场景
解决模型部署中的性能、安全与合规问题,开发轻量化方案(如模型蒸馏)
3、AI应用落地
开发基于知识库与大模型的工具(如智能客服、自动…
招聘城市:北京
…的其他工作。
4.人员要求
●熟悉大模型训练全流程(如LoRA微调、RLHF、Prompt工程),具备实际项目经验,有昇腾GPU经验者优先。
●参与过基础模型或预训练模型的预训练、调优、指令设计等工作。
●精通至少一种主流数据库(如MySQL),具备索引优化、分库分表、读写分离等实战经验。
●有扎实的编程能力,熟练掌握Python/Java等语言,熟悉PyTorch/TensorFlow框架及HuggingFace生态。
●有LangChain/LLamaIndex等应用框架经验,或熟悉向量数据库(如Milvus)者、了解大模型与数据库联动场景(如用LLM生成SQL、数据分析报告自动化)者、具备全栈开发能力(前端/后端/DevOps),能独立完成原型搭建者优先。
●熟悉Linux环境,掌握Docker/Kubernetes等工具,了解云平台部署。…