牛大妈在社招职位搜索AI+Infra+研效专家+-+跨端架构 有 1000+ 条结果

招聘城市:上海
…熟悉框架(React Native/Flutter/ 小程序容器等);
3、有 SDK、基础组件库、统一渲染层或侧基建建设经验优先;
4、了解大模型相关应用:流式接口、RAG、多模态交互、云协同 AI 场景;
5、有 WASM、ONNX Runtime、侧模型量化、GPU/NPU 加速经验优先;
6、具备良好架构设计、性能调优与问题定位能力,善于团队推进;
7、自驱力强,对 AI + 融合方向有浓厚兴趣与长期投入意愿;
我们的优势
- 无职级、扁平化组织:不设传统职级,不卷资历,沟通直接高效,决策链路极短;
- 能力驱动成长,发展不设限:以价值和结果定义回报与舞台,有能力有愿力即可快速主导核心基建项目;
- 技术氛围纯粹,深耕长期价值:重视基础架构与…

小红书(xiaohongshu) AI Infra工程师/专家

全职 北京,上海,深圳
招聘城市:北京,上海,深圳
…部门介绍】引擎架构部是目前小红书AI Infra核心部门,囊括搜广推、CV、NLP、语音、多模态等主要业务场景。团队主导SOTA AI Infra架构设计与核心模块开发,支撑AI业务在AI前沿场景上规模落地。
【岗位职责】
参与开发下一代超大模型(百亿-万亿级)模型的GPU/NPU/PPU/CPU千卡互联分布式训练和推理框架。
参与开发分布式并行/流水线/通信优化/ZeRO/FSDP工作,消除大规模分布式训练通讯/计算/内存瓶颈,极致优化模型训练和推理的性能。
参与开发Triton,TileLang计算图编译优化或者使用CUDA/cutlass编写高性能算子,将硬件性能压榨到极致,最大化发挥出GPU/NPU/PPU/CPU等异构硬件协同算力。
参与开发/调试用于异构计算全链路的AI编译器,探索…
招聘城市:北京
…内核模块开发经验;
3)高性能网络:精通RDMA、TCP/IP协议栈,有基于DPDK/SPDK、eBPF的网络性能优化经验;
4)AI计算栈:深入理解AI框架架构、CUDA编程、GPU显存管理,有大型模型训练调优或框架开发经验;
4.具备杰出的系统性思维和难题攻关能力,能独立主导团队的大型技术项目。
岗位介绍:
在腾讯,后台开发工程师不仅是“又快又稳”的问题解决专家,更是生态共创者。你将与技术团队一同沉淀优质代码,让它成为我们共有的宝贵资产。在不同的业务场景和技术发展阶段,你的架构思维也将帮助更多协作团队拓展新的思考。我们也珍视你的挑战精神,同时欢迎你一起参与团队愿景、文化和产品方向的探讨。
招聘城市:上海
岗位职责:
1.负责大模型推理引擎架构设计、研发与迭代,深度适配主流GPU及异构AI芯片,优化推理性能与算力成本,搭建生产级PD分离推理调度系统,保障推理服务高并发、低延迟、高稳定;
2.搭建并优化多模态大模型训练底层基建,解决训练显存管理、混合并行调度、节点通信同步痛点,完善算力调度与数据流水线,支撑模型高效稳定训练;
3.针对训练与推理场景核心技术难题,落地动态显存分配、KV Cache优化、变长序列批处理、通信优化、异构算力负载均衡等关键技术;
4.基于GPU与异构芯片架构,完成训练、推理全流程性能分析、算子及调度优化,推动优化方案工程化落地;
5.跟踪大模型Infra前沿技术,沉淀优化实践经验;参与vLLM、SGLang…

腾讯(tencent) AI infra规划架构

全职 深圳
招聘城市:深圳
岗位职责:
1.负责公司整体AI平台架构设计和AI工程化技术。通过AI基础设施和软硬件协同优化来提升公司大模型训练和推理的效率。负责前沿异构计算芯片、大模型推理优化、大规模训练的技术演进跟踪和落地。
岗位要求:
1.2年以上相关开发经验,熟悉Go/C++/Python/Java等至少两门语言;
2.有TensorFlow、Pytorch使用或者优化经验,有机器学习平台开发经验优先;
3.了解GPU、CUDA、神经网络、RAG等技术,有大模型分布式训练和推理优化经验优先;
4.对AI底层硬软件基础设施,AI工程化和大模型推理优化感兴趣。
岗位介绍:
在腾讯,优秀的技术运营工程师始终赋能业务,关注技术运营的质量、成本、效率和安全。他们不仅是经验…

腾讯(tencent) AI infra规划架构

全职 深圳
招聘城市:深圳
岗位职责:
1.负责公司整体AI平台架构设计和AI工程化技术。通过AI基础设施和软硬件协同优化来提升公司大模型训练和推理的效率。负责前沿异构计算芯片、大模型推理优化、大规模训练的技术演进跟踪和落地。
岗位要求:
1.2年以上相关开发经验,熟悉Go/C++/Python/Java等至少两门语言;
2.有TensorFlow、Pytorch使用或者优化经验,有机器学习平台开发经验优先;
3.了解GPU、CUDA、神经网络、RAG等技术,有大模型分布式训练和推理优化经验优先;
4.对AI底层硬软件基础设施,AI工程化和大模型推理优化感兴趣。
岗位介绍:
在腾讯,优秀的技术运营工程师始终赋能业务,关注技术运营的质量、成本、效率和安全。他们不仅是经验…
招聘城市:北京
…落地。
岗位要求:
1.计算机相关专业本科及以上学历,3年及以上后 / 平台 / Infra 研发经验;
2.精通至少一门主流后语言(Python / Go / Java 等),主导过中大型平台或系统的设计与落地,具备优秀的系统设计与工程实现能力;
3.熟悉容器化与沙盒隔离、分布式系统、任务调度与并发控制,有大规模任务编排或性能优化经验;熟悉网络通信与代理机制,能处理外部接口访问与稳定性问题;
4.了解大模型与 Agent 的基本原理,熟悉主流 Agent Benchmark(如 SWE-bench、Terminal-Bench、MCP 相关评测等)的 Harness 与打分逻辑,并据此进行工程化抽象,能与算法团队就模型能力与评测指标深度对话;
5.具备丰富的团队协作经验,能在算法…

小红书(xiaohongshu) 大模型 Infra 全栈研发工程师/专家

全职 北京,上海,杭州
招聘城市:北京,上海,杭州
AI Infra 研发范式: 将 AI 工具深度融入 Infra 开发链路,熟练运用 AI 编程工具进行架构探索、复杂 Debug 与重构,大幅提升 AI Infra 全栈工程的迭代效率。
任职要求:
任职要求:
1.AI 工程范式:熟练使用 Claude Code、Cursor、Codex 等工具,具备成熟的 Agentic Engineering 实践技巧,能够基于 AI 工具进行复杂的系统级 Debug、代码重构及单测生成。
2.语言与系统基础:精通 C++ 与 Python,熟悉 Rust 或 Golang 开发,具备扎实的计算机体系结构、数据结构与操作系统底层知识,有深度学习相关框架的理解认知。
3.框架实战能力:深入理解并具备修改 PyTorch 等主流深度学习框架源码的能力,对前沿模型架构有敏锐嗅觉,熟悉 Transformer、ViT,并对 Mamba、Linear Attention 等新型架构的计算特性有了解…
招聘城市:成都
…IVF 等向量索引算法及文本/全文检索有实际研发与性能调优经验者优先;
4.生态与计算框架: 具备开源大数据生态(如 Spark, Flink, Iceberg, ClickHouse 等)底层源码级开发或社区贡献经验者优先;熟悉 Ray 等分布式 AI 计算框架内核,或具备大规模异构资源调度与计算下推实战经验者优先。
岗位介绍:
在腾讯,后台开发工程师不仅是“又快又稳”的问题解决专家,更是生态共创者。你将与技术团队一同沉淀优质代码,让它成为我们共有的宝贵资产。在不同的业务场景和技术发展阶段,你的架构思维也将帮助更多协作团队拓展新的思考。我们也珍视你的挑战精神,同时欢迎你一起参与团队愿景、文化和产品方向的探讨。
招聘城市:深圳
岗位职责:
1.负责公司AI配套基础设施的规划和性能优化,包括网络专线、内存、磁盘、CPU算力;
2.推动公司整体CPU和内存使用效能提升,包括RL框架和KV Cache的内存压缩优化,大规模K8S集群的CPU超卖和内存压缩能力建设。
岗位要求:
1.3年以上相关开发经验,熟悉Go/C++/Python/Java等至少两门语言;
2.熟悉Linux、虚拟化技术、K8S、Docker;有KVM或K8S集群优化经验优先,有混部技术经验优先;
3.了解x86、ARM架构,了解计算机系统底层硬件,有相关网络基础知识;有服务器CPU、网络、存储性能调优,内存压缩优化等经验优先;
4.对AI基础设施感兴趣,熟悉AI所需的周边配套资源,了解AI算法原理和深度学习框架优先。
岗位…
招聘城市:北京,上海
…提升,保障线上可用性。
任职要求:
1、精通 Java / Go 等主流后语言,具备扎实的分布式系统与高并发服务开发经验;
2、熟悉 IM / 长链通信系统架构,理解消息分发与连接管理机制;
3、熟悉微服务架构、服务治理、缓存、数据库、消息队列与注册中心;
4、具备系统稳定性治理与性能优化经验,熟悉容灾 / 多地多活架构设计;
5、熟悉 Prometheus / Grafana / OpenTelemetry 等可观测性体系;
6、有云原生(K8s / Istio)经验优先;
7、理解 RAG / Function Call / Agent 调用机制者加分;
8、具备强烈的 Owner 意识与团队协调能力,能从全局视角推动复杂系统演进;
9、对 AI 产品的架构挑战与稳定性问题有深刻兴趣,追求高可靠、高性能、高复用的工程实践…
招聘城市:深圳
岗位职责:
1.负责AI训练、推理场景硬件加速解决方案设计和落地;
2.深入理解大模型、推荐应用场景,分析工作负载并建模;
3.整合内外资源,并协同编译、应用框架,进行软硬一体化解决方案设计和开发。
岗位要求:
1.本科及以上学历,5年以上相关工作经验;
2.深入理解上层软件到底层芯片整个技术栈,熟悉 CPU、GPU、NPU、各种加速卡以及IO/网络,并具备架构能力;
3.熟悉硬件产品研发周期,了解但不限于服务系统级、板级、芯片级不同周期的研发和生产流程,能高效牵引内、外部合作团队;
4.熟悉大模型、推荐等应用场景,熟悉业界解决方案,并有过加速方案设计及落地经验;
5.有很强的项目把控及推进能力,能够清晰…
招聘城市:北京,上海
…与执行效率;
4、与算法与服务协作,建设任务调度、RAG 服务与 Tool 编排框架;
5、推动 AI 工程体系标准化与自动化,建设可配置、可调试的开发工具与可视化平台。
任职要求:
1、熟悉 Function Call / Agent / ReAct / Tool 调用机制与大模型应用架构
2、精通 Java / Go / Python 等后语言,具备服务化开发与异步通信框架(SSE / gRPC / MQ)经验;
3、熟悉分布式任务调度、Workflow 编排或服务编排框架设计;
4、理解模型上下文管理、缓存与资源复用机制;
5、有强烈的 Owner 意识与系统设计思维,能独立承担复杂模块建设与技术演进;
6、善于团队协作,具备良好的沟通能力与技术抽象能力;
7、对 AI 工程体系建设、Agent 技术演进有深厚兴趣与学习意愿。…
招聘城市:深圳
岗位职责:
1.作为技术带头人负责团队大型AI项目的技术方案设计和研发;
2.跟进业界先进的大模型算法趋势和应用,评估价值并探索在团队内部场景落地;
3.制定团队AI能力发展蓝图和计划,包括不限于技能培训、考试和梯队培养等;
4.负责外部技术资源的对接和引入,包括不限于高校合作、内外部技术交流等。
岗位要求:
1.硕士以上学历,8年以上工作经验,有数据工程、数据挖掘、大模型等项目经验,有大模型在垂直领域(如智能客服、金融风控等)的落地应用经验优先;
2.精通大模型pre_traing,post_traing,推理优化等技术方案,熟悉机器学习、深度学习等常用算法;
3.熟练掌握Python、C++、SQL等一种或多种语言;
4.有…
招聘城市:深圳
…具备AI基础设施(AI Infra) 的架构设计经验。拥有构建或运维大模型训练/推理平台的实际经验,熟悉其关键技术挑战;
2.核心技术能力: 熟悉 Kubernetes,熟悉GPU虚拟化、分布式训练框架(如PyTorch DDP),熟练掌握LLMOps全链路工具与理念,并有实践经验,熟悉向量数据库、推理优化框架(如vLLM)等大模型相关技术栈;
3.附加要求: 熟悉AIOps经典场景(如异常检测、根因分析),并对LLM在运维领域的应用有深刻见解。
岗位介绍:
在腾讯,后台开发工程师不仅是“又快又稳”的问题解决专家,更是生态共创者。你将与技术团队一同沉淀优质代码,让它成为我们共有的宝贵资产。在不同的业务场景和技术发展阶段,你的架构思维也将帮助…
招聘城市:深圳
…3.积极追踪业内AI动态,优化内部技术方案,改进产品性能,不断推进AI架构升级。
岗位要求:
1.熟练掌握TensorFlow、Pytorch、deepSpeed等主流深度学习框架中的一种或多种,并有具体的项目应用经验(包括但不限于模型训练优化、模型服务优化等经验);
2.熟练使用Java/Go/Python至少一种编程语言,良好的软件设计和开发能力;
3.具备owner意识,能主动推进项目进展,承担更多责任,具备团队协作意识。
岗位介绍:
在腾讯,后台开发工程师不仅是“又快又稳”的问题解决专家,更是生态共创者。你将与技术团队一同沉淀优质代码,让它成为我们共有的宝贵资产。在不同的业务场景和技术发展阶段,你的架构思维也将帮助更多协作团队拓展新的思考…
招聘城市:西安
…点,推进AI产品商业化进展;
4.参与产品改进和新产品的开发,提供关键技术和市场需求的反馈;
5.执行流程管理、事项管理、项目管理,逻辑清晰,具有判断决策和风险识别及解决的能力。
岗位要求:
1.熟悉AI产品、拥有产品规划能力,有公有云PaaS/ SaaS的产品运营及售前支持的经验者优先;对大模型及大模型相关应用有相关研究或实践经验者优先;
2.具备ToB产品的场景化解决方案的构建能力,具备数据分析能力;
3.具备需求理解能力:挖掘客户业务的真实需求并拆解到具体可落地的产品功能层面;
4.具备行业洞察能力:对互联网企业的需求痛点非常熟悉,能够洞察业务本质;
5.具备有效沟通能力:与客户、行业架构师…
招聘城市:北京,上海
…提升,保障线上可用性。
任职要求:
1、精通 Java / Go 等主流后语言,具备扎实的分布式系统与高并发服务开发经验;
2、熟悉 IM / 长链通信系统架构,理解消息分发与连接管理机制;
3、熟悉微服务架构、服务治理、缓存、数据库、消息队列与注册中心;
4、具备系统稳定性治理与性能优化经验,熟悉容灾 / 多地多活架构设计;
5、熟悉 Prometheus / Grafana / OpenTelemetry 等可观测性体系;
6、有云原生(K8s / Istio)经验优先;
7、理解 RAG / Function Call / Agent 调用机制者加分;
8、具备强烈的 Owner 意识与团队协调能力,能从全局视角推动复杂系统演进;
9、对 AI 产品的架构挑战与稳定性问题有深刻兴趣,追求高可靠、高性能、高复用的工程实践…
招聘城市:北京,上海
…多模型路由、Tool Calling、DeepResearch 等核心机制
3.服务与高并发对话系统研发:参与 AI 对话产品服务核心架构设计,构建支撑大规模并发的流式消息分发与路由系统(基于 SSE / WebSocket / gRPC 等协议);结合 RAG、Agent、多轮会话、流式交互能力设计并落地新一代 AI Native 应用的交互方案
4.大前端与交互体验攻坚:深度参与大前端(iOS / Android / Web)核心模块开发,攻坚富文本与复杂卡片渲染、多模态交互(音视频/图像)、复杂动画及极致的客户性能治理(启动、内存、卡顿与流畅度)
5.全链路高可用保障:针对复杂 AI 任务的不确定性,设计健壮的工程兜底机制,涵盖中间状态存储与恢复(Memory/State Management)、长链路容错、智能重试与降级,支撑核心…
招聘城市:深圳
…能独立解决层(硬件、网络、框架、调度)复杂问题,有大型 AI 训练集群稳定性治理成功案例者优先;
6.具备优秀的技术领导力与团队协作能力,能主导复杂技术项目落地;拥有清晰的逻辑思维与表达能力,善于沉淀技术经验并推动团队技术成长;
7.对技术有极致追求,有较强的问题驱动能力与创新意识,了解行业主流大模型训练基础设施技术栈(如 DeepSpeed、FSDP、Slurm 等)者优先。
岗位介绍:
在腾讯,后台开发工程师不仅是“又快又稳”的问题解决专家,更是生态共创者。你将与技术团队一同沉淀优质代码,让它成为我们共有的宝贵资产。在不同的业务场景和技术发展阶段,你的架构思维也将帮助更多协作团队拓展新…