牛大妈在校招职位搜索REDstar大模型 Infra 工程师 有 7 条结果

小红书(xiaohongshu) 【REDstar模型 Infra 工程

全职 北京,上海,杭州
招聘城市:北京,上海,杭州
商业、国际化、审核、企业智能等小红书核心业务的模型落地。在这里,你会面对千卡级后训练、高并发推理、EPD 分离与 KV Cache 复用、低比特模型量化、国产异构芯片性能优化、万卡级 GPU 调度等真实业务的大规模 AI Infra 挑战。在这里你可以选择在训练、推理或模型压缩方向深耕,也可以参与跨方向系统设计,成长为真正理解模型全链路的 AI Infra 工程。团队持续参与开源与行业技术交流,期待有志于构建生产级 Infra 能力并持续提升个人行业影响力的优秀同学加入。
工作职责:
1、训练与推理框架研发: 参与 Relax RL 后训练框架和 rLLM 推理框架的核心研发,支撑 LLM、MLLM、Agent、DiT 等模型的高效训练与…
招聘城市:北京,上海
Infra团队深耕模型「数-训-压-推-评」技术闭环,具备专业的模型训练加速、模型压缩、推理加速、部署提效等方向硬核技术积淀,基于RedAccel训练引擎、RedSlim压缩工具、RedServing推理部署引擎、DirectLLM模型MaaS服务,支撑小红书社区、商业、交易、安全、数平、研效等多个核心业务实现AI技术高效落地!
模型训练方向:
1、参与设计实现支持RLHF/DPO等对齐技术的高效训练框架,优化强化学习阶段的Rollout、Reward Model集成、多阶段训练Pipeline;
2、研发支持多机多卡RL的分布式训练框架,开发TP/PP/ZeRO-3与RL流程的动态协同机制,解决RL算法在超长时序下的显存/通信瓶颈;
3、基于自建的训推引擎,落地公司统一的模型生产…

小红书(xiaohongshu) 【REDstar】AI Agent Infra 工程

全职 北京,上海,杭州
招聘城市:北京,上海,杭州
…回归分析、上线 Gate、线上抽样和 Bad Case 回流能力,让模型、Prompt、Tool、Context 或执行架构的每次变化都能够被评估、对比和安全发布,形成从线上反馈到系统优化的持续进化闭环。
6、前沿探索与生产验证: 持续跟踪 Agent Runtime、Harness、Memory、Evaluation、Multi-Agent 等前沿方向,形成独立的架构判断;与核心业务共建 Anchor Tenant,通过真实业务效果和生产指标验证新技术,并沉淀可复用的 Reference Architecture、开源项目或行业技术成果。
7、跨团队系统协同: 与模型、推理、MaaS、数据、安全、可观测、CI/CD 和业务团队协作,共同解决 Agent 效果、工程模型与生产系统交叉形成的复杂问题。
任职要求:
任职资格:
1、具备扎实的计算机基础和代码能力,熟悉 Python / C++ / Rust / Go 中至少一门…

小红书 【REDstar】基座模型算法工程

全职 北京,上海,杭州
招聘城市:北京,上海,杭州
语言模型的重塑,突破逐个token预测的方式,实现高效的推理模式,探索全新scaling law;
2、实现模型训练的数据清洗、合成和评估;设计和实现模型训练的AI Infra框架。
任职要求:
1、本科及以上学历,计算机、人工智能和数学等相关专业;
2、熟练掌握扩散模型设计和使用技巧,在知名模型公司/团队从事图像或视频生成者优先,有多模态/OMNI模型理解&生成统一框架经验者优先;
3、有丰富的模型预训练和后训练数据处理经验,熟练掌握数据收集、数据清洗、数据去重和数据合成等流程,能针对数据质量制定出评估指标和方法,在知名模型公司/团队长期从事数据技术者优先;
4、MoE/Dense模型训练实战经验,包括模型

小红书(xiaohongshu) 【REDstar】Agent/模型算法工程 - 国际化

全职 北京,上海,新加坡
招聘城市:北京,上海,新加坡
…最佳实践,推动前沿技术在rednote业务中的应用,保持团队的技术领先性,沉淀国际顶会论文(CVPR/NeurIPS/ICLR/ACL 等)。
任职要求:
1、本科及以上学历,计算机科学与技术、人工智能、计算机、机器学习、数据、数学等相关专业;
2、对模型和Agent有较深入的理解,熟悉常见的LLM实施模式、PE、RAG、评估框架等,熟悉主流 Agent 架构(Multi-Agent、Context Engineering/Management、ReAct/PlanAct/CodeAct),了解Agent相关的交互协议(MCP、A2A、FunctionCall);
3、熟悉Agentic RL等方法,了解相关 Infra(例如CodeRL,Reward System),能针对特定问题开展SFT、RL训练优化;
4、具备良好的学术视野和开拓精神,勇于钻研新技术,能主动思考、主动作为反馈。有CVPR/ICCV/NeurIPS/ICLR/ACL/EMNLP/KDD 等顶会论文发表经历更佳。
招聘城市:北京,上海
岗位职责:
模型AI Infrastructure团队专注于语言模型领域的前沿技术研究和落地,提供高性能、高可靠、可扩展的机器学习系统、丰富的异构计算资源和极致的端到端的机器学习服务体验,为公司提供核心技术能力和服务。
1、负责机器学习框架的研究与开发,服务于公司各个产品;
2、高效部署,优化NLP/多模态模型核心业务模型
任职要求:
1、本科及以上学历,计算机等相关专业方向优先;
2、熟练掌握GPU CUDA编程;
3、熟练掌握Megatron/DeepSpeed/FSDP等框架的研发,熟练掌握模型并行分布式技术;
4、对语言模型算法感兴趣,有机器学习算法知识背景;
5、追求技术极致,务实,渴望有自己的作品和代表作。
【加分项】
1、对于算子优化(CUDA…
招聘城市:北京,上海
…级调试、版本追踪与一键上线,让数据科学家专注模型创新;
3、持续优化训推基础设施:自研 Embedding 高速存储、特征 DSL 引擎、弹性调度与服务化推理框架,实现 10x 级性能提升;
4、跟踪 LLM / Agent 最新进展,将其工程化落地到搜索、广告、推荐及智能体业务,定义行业新标准。
任职要求:
1、计算机及相关专业本科以上学历,具备高性能系统或 AI Infra 研发经验;
2、精通 C/C++,具备扎实的系统底层能力(内存、并发、网络),代码风格优雅,热衷技术分享;
3、深入理解至少一种主流训练/推理框架(XDL、TFRA、DeepRec、TorchRec、DeepSpeed、veRL、Megatron 等),对其执行模型与性能瓶颈有源码级洞察;
4、熟悉 TensorFlow Serving、TensorRT、OpenXLA、ONNX Runtime 等推理后端,具备模型量化、编译优化…