牛大妈在社招职位搜索AI模型性能优化工程师 有 468 条结果

招聘城市:北京
…基于自研芯片,研发高性能推理与训练框架,解决芯片落地过程中的全链路问题;
2.能根据硬件特性和AI模型特点,不断迭代和完善框架性能和易用性、持续提升推理模型整网性能,和业务一起构建自研芯片软件生态。
岗位要求:
1.熟悉Linux开发环境,掌握Python/C++等语言,具备良好的编程基础以及系统设计能力;
2.熟悉GPU或SIMD编程体系架构,了解LLM、AIGC等模型结构,能够使用nvpro、nsys等profiler工具;
3.精通主流训练推理框架和加速技术,包括但不限于:Pytorch、Megatron、DeepSpeed、VLLM、Sglang等;
4.具有系统性分析模型性能瓶颈的能力,熟悉从算子调用,到模型训练推理,再到结果返回的功能定义和具体逻辑;
5.具备良好的技术热情和…
招聘城市:深圳
…基于自研芯片,研发高性能推理与训练框架,解决芯片落地过程中的全链路问题;
2.能根据硬件特性和AI模型特点,不断迭代和完善框架性能和易用性、持续提升推理模型整网性能,和业务一起构建自研芯片软件生态。
岗位要求:
1.熟悉Linux开发环境,掌握Python/C++等语言,具备良好的编程基础以及系统设计能力;
2.熟悉GPU或SIMD编程体系架构,了解LLM、AIGC等模型结构,能够使用nvpro、nsys等profiler工具;
3.精通主流训练推理框架和加速技术,包括但不限于:Pytorch、Megatron、DeepSpeed、VLLM、Sglang等;
4.具有系统性分析模型性能瓶颈的能力,熟悉从算子调用,到模型训练推理,再到结果返回的功能定义和具体逻辑;
5.具备良好的技术热情和…
招聘城市:北京,上海
…调度策略优化和关键算子(Kernel)的性能剖析与极致优化,持续提升系统的吞吐量、降低延迟;
4、生态合作与协同:作为技术接口人,与国产芯片原厂技术支持团队紧密合作,高效推进芯片驱动、基础软件栈的引入、问题排查与版本迭代,确保技术路线顺畅推进。
任职要求:
1、熟练掌握 C++/Python 编程,具备扎实的计算机体系结构、数据结构和算法基础,具备良好的编程习惯;
2、有至少一款非Nvidia GPU的异构计算芯片适配大模型训练、推理框架的相关经验,包括但不限于AI框架适配、模型移植、性能优化或算子开发;
3、熟悉至少一种主流的机器学习框架(PyTorch/PaddlePaddle/TensorFlow等),对框架内部实现有一定了解;
4、具备大型深度学习模型(尤其是大语言模型LLM或…
AI算法工程1.计算机科学、人工智能、数学、电子信息等相关专业,具备5年以上相关工作经验,有算法/模型实际应用项目经验者优先;2.熟练掌握Python、C++、Java等其中至少一种主流编程语言,熟悉TensorFlow、PyTorch、Scikit-learn等AI框架;3.具备扎实的数学与算法基础,精通机器学习、深度学习常见模型(CNN、RNN、Transformer等);4.具备良好的团队协作、跨部门沟通能力,可高效配合技术团队推进算法/模型落地实施;5.负责AI算法/模型的全流程设计、开发、训练、优化与验证,覆盖机器学习、深度学习等技术方向;6.依据业务需求构建AI模型,实现数据分析、预测、智能识别等相关功能,落地业务价值;7.主导参与AI模型在生产环境中的部署、服务化落地及性能调优…
招聘城市:温州
AI算法工程1.计算机科学、人工智能、数学、电子信息等相关专业,具备5年以上相关工作经验,有算法/模型实际应用项目经验者优先;2.熟练掌握Python、C++、Java等其中至少一种主流编程语言,熟悉TensorFlow、PyTorch、Scikit-learn等AI框架;3.具备扎实的数学与算法基础,精通机器学习、深度学习常见模型(CNN、RNN、Transformer等);4.具备良好的团队协作、跨部门沟通能力,可高效配合技术团队推进算法/模型落地实施;5.负责AI算法/模型的全流程设计、开发、训练、优化与验证,覆盖机器学习、深度学习等技术方向;6.依据业务需求构建AI模型,实现数据分析、预测、智能识别等相关功能,落地业务价值;7.主导参与AI模型在生产环境中的部署、服务化落地、MLOps实践及性能
招聘城市:深圳
…主流大模型推理框架,如vllm,sglang,tensorrt-llm等,具备语言、多模态模型大规模部署和优化经验;
3.熟悉并行策略,如数据并行、流水线并行等,熟悉NVLINK、GPU RDMA通信者优先;
4.熟悉各类深度学习网络和算子底层实现细节,有实操经验优先;
5.熟悉主流开源模型及其架构特点,具备针对不同模型进行分析优化的能力优先;
6.具备GPU、AI芯片体系结构知识,熟悉芯片特性,具备系统性能分析和调优经验优先。
加分项:
1.熟悉常见的算子编译优化、图优化和算子融合流程,如torch.compile,triton,tilelang等;
2.熟悉GPU/AI芯片编程,如CUDA,Ascend C等,熟悉cutlass等加速库;
3.参与vllm、sglang等开源项目贡献者。
岗位介绍:
在腾讯,后台开发工程不仅是…
招聘城市:北京
…主流大模型推理框架,如vllm,sglang,tensorrt-llm等,具备语言、多模态模型大规模部署和优化经验;
3.熟悉并行策略,如数据并行、流水线并行等,熟悉NVLINK、GPU RDMA通信者优先;
4.熟悉各类深度学习网络和算子底层实现细节,有实操经验优先;
5.熟悉主流开源模型及其架构特点,具备针对不同模型进行分析优化的能力优先;
6.具备GPU、AI芯片体系结构知识,熟悉芯片特性,具备系统性能分析和调优经验优先。
加分项:
1.熟悉常见的算子编译优化、图优化和算子融合流程,如torch.compile,triton,tilelang等;
2.熟悉GPU/AI芯片编程,如CUDA,Ascend C等,熟悉cutlass等加速库;
3.参与vllm、sglang等开源项目贡献者。
岗位介绍:
在腾讯,后台开发工程不仅是…
招聘城市:上海
…主流大模型推理框架,如vllm,sglang,tensorrt-llm等,具备语言、多模态模型大规模部署和优化经验;
3.熟悉并行策略,如数据并行、流水线并行等,熟悉NVLINK、GPU RDMA通信者优先;
4.熟悉各类深度学习网络和算子底层实现细节,有实操经验优先;
5.熟悉主流开源模型及其架构特点,具备针对不同模型进行分析优化的能力优先;
6.具备GPU、AI芯片体系结构知识,熟悉芯片特性,具备系统性能分析和调优经验优先。
加分项:
1.熟悉常见的算子编译优化、图优化和算子融合流程,如torch.compile,triton,tilelang等;
2.熟悉GPU/AI芯片编程,如CUDA,Ascend C等,熟悉cutlass等加速库;
3.参与vllm、sglang等开源项目贡献者。
岗位介绍:
在腾讯,后台开发工程不仅是…
招聘城市:杭州
…主流大模型推理框架,如vllm,sglang,tensorrt-llm等,具备语言、多模态模型大规模部署和优化经验;
3.熟悉并行策略,如数据并行、流水线并行等,熟悉NVLINK、GPU RDMA通信者优先;
4.熟悉各类深度学习网络和算子底层实现细节,有实操经验优先;
5.熟悉主流开源模型及其架构特点,具备针对不同模型进行分析优化的能力优先;
6.具备GPU、AI芯片体系结构知识,熟悉芯片特性,具备系统性能分析和调优经验优先。
加分项:
1.熟悉常见的算子编译优化、图优化和算子融合流程,如torch.compile,triton,tilelang等;
2.熟悉GPU/AI芯片编程,如CUDA,Ascend C等,熟悉cutlass等加速库;
3.参与vllm、sglang等开源项目贡献者。
岗位介绍:
在腾讯,后台开发工程不仅是…
招聘城市:北京
岗位职责:
1.设计建设一站式 Serverless AI 推理平台,衔接模型训练到工业应用落地的过程;
2.通过模型部署编排、算力调度、推理加速、异构计算等手段,持续优化推理成本,提供极致低成本的推理平台。
岗位要求:
1.有 AI 推理在工业上大规模落地的经验,熟悉 AI 模型从资源建设到上线对外过程中常见的问题和解决方案;
2.熟悉 GPU 架构,并且能根据 GPU 架构合理设计上层算力调度、推理加速等相关软件栈,充分发挥 GPU 的算力,具备CUDA高性能并行编程经验;
3.熟悉 PyTorch 或其他常用机器学习框架和 TensorRT 或其他常用推理框架,了解 Transformer 等常用模型结构和常用的模型推理性能优化手段;
4.良好的团队沟通和协作能力。

腾讯 边缘AI推理研发工程

全职 深圳
招聘城市:深圳
岗位职责:
1.设计建设一站式 Serverless AI 推理平台,衔接模型训练到工业应用落地的过程;
2.通过模型部署编排、算力调度、推理加速、异构计算等手段,持续优化推理成本,提供极致低成本的推理平台。
岗位要求:
1.有 AI 推理在工业上大规模落地的经验,熟悉 AI 模型从资源建设到上线对外过程中常见的问题和解决方案;
2.熟悉 GPU 架构,并且能根据 GPU 架构合理设计上层算力调度、推理加速等相关软件栈,充分发挥 GPU 的算力,具备CUDA高性能并行编程经验;
3.熟悉 PyTorch 或其他常用机器学习框架和 TensorRT 或其他常用推理框架,了解 Transformer 等常用模型结构和常用的模型推理性能优化手段;
4.良好的团队沟通和协作能力。

腾讯(tencent) AI应用开发工程

全职 深圳
招聘城市:深圳
…系统,解决用户个性化问题;
3.设计并优化AI模型推理服务,确保高并发、低延迟的稳定性;
4.数据驱动的工具开发​:开发数据分析工具,利用工具输出可视化报告;
5.持续优化模型性能(如压缩、量化),平衡准确率与资源消耗,确保系统在企业级环境中的可用性。
岗位要求:
1.熟练掌握Java,熟悉FastAPI/SpringBoot框架,具备高并发服务开发经验;
2.掌握大模型应用开发技术栈(如LangChain、Prompt Engineering),有RAG、Agent开发经验者优先。熟悉模型部署工具(TensorRT、vLLM),具备云原生开发能力(Docker/K8s);
3.3年以上后端开发经验,有完整AI项目落地案例(如智能客服、数据分析工具)。熟悉向量数据库(Milvus、Chroma)和关系型数据库(MySQL),具备数据处理与特征工程能力;…
招聘城市:武汉
AI算法的工程化与性能优化
2.开发与优化移动端(Android/iOS)数智人的3D渲染与驱动引擎;
3.封装和集成语音、视觉等AI算法,提供高效稳定的客户端SDK;
4.优化端侧AI模型的推理性能,提升实时交互体验;
5.解决音画同步、内存、功耗等客户端核心技术难题。
岗位要求:
1.本科及以上学历,计算机相关专业;
2.2-5年以上客户端开发经验,精通Android开发及性能优化者优先;
3.扎实的编程和计算机基础,具备较强的工程实现能力;
4.注:此岗位为腾讯集团旗下子公司编制岗位。
加分项:
1.3D图形学/游戏/ARVR开发经验(熟悉OpenGL ES/Vulkan等);
2.端侧AI推理框架(如NCNN, OnnxRuntime)的使用或优化

小红书(xiaohongshu) 模型开发工程

全职 上海,杭州
招聘城市:上海,杭州
…的Agent能力基建;推进模型推理框架与全生命周期管理平台,探索Agent与模型协同优化的技术路径。
2. 优化审核基础大模型训练推理链路,系统性降低全链路推理成本。
任职要求:
职位要求
1. 能够熟练部署和使用主流 AI 模型和工具,了解 Prompt 和 Context Engineering 等基本调优手段;
2. 熟悉 GRPO/PPO 等 RL基础算法,熟悉veRL/Slime等强化学习框架,对端到端Agent训练有较深入的理解或项目经验;
3. 熟悉大模型基础原理,熟悉大模型推理优化技术方案,熟悉vLLM/SGlang等推理框架;
4. 具备大规模模型训练与 AI 工程性能优化的落地经验的优先;
5. 较强的自驱学习能力,对端到端系统设计、编码规范和系统优化有高标准要求;…
招聘城市:深圳
…RAG)、智能体(Agent)等前沿AI技术的发展动态,探索其在智能资产管理、交互式意图理解、终端自适应学习等场景中的创新应用与落地可行性;
5.与产品、工程、业务团队紧密协作,推动算法方案从需求分析、设计开发到上线部署的全流程落地,并通过数据分析持续跟踪线上效果,基于用户反馈进行模型迭代与性能优化
6.分享算法设计思路与落地经验,推动团队技术能力的整体提升。
岗位要求:
1.计算机、人工智能、模式识别等相关专业硕士及以上学历,3年以上相关工作经验,有NLP、RL、LLM等领域项目经验者优先;
2.熟练掌握自然语言处理、机器学习、深度学习等相关技术,熟悉主流模型架构(如Transformer、BERT、GPT等)及训练优化方法;
3…
招聘城市:重庆
…车辆工程、机械工程(车辆、汽车动力学方向)专业;熟悉汽车构造、汽车理论、汽车动力学、汽车设计、汽车测试、汽车振动等专业知识。2.参与汽车底盘相关开发项目与课题,具备完成底盘性能调校、整车动力学建模设计与控制优化、耐久及轻量化开发等专业能力者优先。3.具有智能悬架开发与匹配、线控底盘开发经验者优先。4.适应出差,具有强的责任心、团队协调能力、技术创新意识、市场开拓能力、执行能力和分析解决问题能力;通过大学英语四级,能够熟练阅读英文技术文件。岗位7汽车性能数字化工程(重庆)岗位职责1.负责AI技术融合应用,研究人工智能(机器学习、深度学习、数据挖掘等)技术在汽车性能开发(底盘、热管理、NVH等)中的落地应用模型开发与…
招聘城市:深圳
…项目性能优化经验者更佳;
3.熟悉Unity架构与常见渲染管线(如URP),了解IL2CPP/Mono,能独立完成常见性能问题排查与解决;
4.掌握移动端性能优化核心方法,包括但不限于Draw Call/Batch、Shader、动画、资源加载、内存与GC等;
5.具备扎实的C#编程基础,有C++或底层排查经验者优先;
6.具备AI工具实际使用经验,能够将大模型/Agent能力有效应用于研发流程中;
7.有AI Agent开发、工作流编排或AI Coding落地案例者优先考虑;
8.具备主动学习能力,善于将“性能优化”与“AI提效”结合,以结果为导向,沟通协作能力强。
加分项:
1.有开源Agent框架、RAG、工具调用(Tool Use)或内部研发Agent平台建设经验;
2.有深度Unity内存分析及优化

小红书 媒体性能优化工程

全职 北京,上海
招聘城市:北京,上海
…频和图像处理算法在服务端和客户端的工程优化与业务落地;
2. 通过软硬一体优化,提升算法性能,降低计算成本或功耗,实现媒体算法在服务端和客户端的业务落地。
任职要求:
1、精通C/C++编程,熟悉python编程。具备Linux/Andorid/IOS中至少一种系统平台的开发经验;
2、熟悉CPU/GPU硬件系统架构。精通X86/ARM平台的SIMD指令集优化,或者精通GPU平台的CUDA/OpenGL/Vulkan/Metal优化
3、至少熟练掌握以下一种算法:视频/图像编解码、传统视频/图像后处理与画质增强、视频AI分析;
4、熟悉音视频处理流程,如视频转码、合流、渲染、播放。熟悉FFmpeg/Gstreamer/OpenCV等开源媒体处理框架;
5、具备AI算法优化经验,熟悉模型量化/压缩/混精等优化手段,擅长推理引擎优化
招聘城市:深圳
岗位职责:
1.负责大模型在端侧推理的SDK研发,性能优化
2.负责不同端侧硬件平台(高通和 MTK的NPU)的适配开发;
3.负责端侧推理sdk工程化开发,工具开发,效率提升等工作。
岗位要求:
1.本科及以上学历,计算机科学、电子信息、自动化等相关专业背景,熟悉计算机体系结构;
2.具备AI模型部署及优化开发经验,熟练掌握c++,java开发:;
3.精通Transformer架构,熟悉Llama、GPT等主流大模型技术栈;
4.至少熟练使用一种推理框架(vLLM/ONNX Runtime/TensorRT/DeepSpeed等),有部署经验;
5.掌握性能分析工具(Nsight、PyTorch Profiler等);
6.有android开发经验优先。
加分项:
1.在同等条件下,通过腾讯云认证或取得同等资格认证的候选人,我们会优先考虑。
招聘城市:北京
岗位职责:
1.负责大模型在端侧推理的SDK研发,性能优化
2.负责不同端侧硬件平台(高通和 MTK的NPU)的适配开发;
3.负责端侧推理sdk工程化开发,工具开发,效率提升等工作。
岗位要求:
1.本科及以上学历,计算机科学、电子信息、自动化等相关专业背景,熟悉计算机体系结构;
2.具备AI模型部署及优化开发经验,熟练掌握c++,java开发:;
3.精通Transformer架构,熟悉Llama、GPT等主流大模型技术栈;
4.至少熟练使用一种推理框架(vLLM/ONNX Runtime/TensorRT/DeepSpeed等),有部署经验;
5.掌握性能分析工具(Nsight、PyTorch Profiler等);
6.有android开发经验优先。
加分项:
1.在同等条件下,通过腾讯云认证或取得同等资格认证的候选人,我们会优先考虑。