牛大妈在社招职位搜索基础模型算法工程师 有 1000+ 条结果

小红书 大模型算法工程-基础模型

全职 北京,上海
招聘城市:北京,上海
…多场域(如广告、电商、推荐等)通用基础模型的设计与研发,提升模型的泛化与迁移能力
2. 负责跨域学习、序列建模、多模态建模等新范式在业务中的应用。
3. 负责统一的用户/内容表征体系构建,支持长周期用户兴趣建模与动态演化。
4. 探索新一代模型体系构建,提升业务模型技术的天花板
任职要求:
1. 具备扎实的机器学习、深度学习理论基础,对多模态、序列建模、跨域学习、迁移学习有深入理解与实践
2. 有推荐系统、搜索排序或者广告系统等相关业务经验,具备优秀的系统思维与解题能力
3. 掌握主流深度学习框架,具备高质量模型代码实现与调试能力
4. 具备良好的沟通协作能力和技术热情,能够推动跨团队项目高效落地

小红书 大模型算法工程

全职 北京,上海
招聘城市:北京,上海
…语言模型的重塑,突破逐个token预测的方式,实现高效的推理模式,探索全新scaling law;
2、实现大模型训练的数据清洗、合成和评估;设计和实现大模型训练的AI Infra框架。
任职要求:
1、本科及以上学历,计算机、人工智能和数学等相关专业,博士研究生优先;
2、熟练掌握扩散模型设计和使用技巧,在知名大模型公司/团队从事图像或视频生成者优先,有多模态/OMNI大模型理解&生成统一框架经验者优先;
3、有丰富的大模型预训练和后训练数据处理经验,熟练掌握数据收集、数据清洗、数据去重和数据合成等流程,能针对数据质量制定出评估指标和方法,在知名大模型公司/团队长期从事数据技术者优先;
4、MoE/Dense模型训练…
招聘城市:北京,上海,广州
…期待你除了算法外仍然是为出色的工程。期待你对技术有强烈的好奇心和开放心态,以未来几年 AI 技术的质变突破为目标。
岗位说明:你会负责下述至少一件事情
1.海量数据的处理:定性分析、定量评估数据质量,并给出 scalable 的改进方案,对数据采集和处理流程不断提出新的要求和改进方案。
2.模型的改进:在 Large Scale 上迭代并改进模型使其更加的高效(capacity per flops / improvement per flops),或者提升模型的 scale up 后的稳定性
3.研究并改进 Scale Law,随着模型的变化给出 Large Scale 上的技术选择(例如参数/数据比、不同超参数设置等)
4.多模态:研发多种模态作为输入/输出的 Large Scale 模型
任职要求:
1.良好…

小红书(xiaohongshu) 基础模型算法专家

全职 上海,北京,杭州
招聘城市:上海,北京,杭州
…数据配比、模型训练,样本级标签体系建设,RL数据合成、Reward Model设计、router replay、RL算法创新,显著提升alignment阶段模型生成能力;
3、数据&评测:持续改进数据体系pipeline,包括:数据收集、清洗、去重和配比等,合成各种高质量agentic/reasoning训练数据,提升模型通用能力;持续完善大模型评估体系和Bench,能有效评估STEM、math、code、知识、指令跟随、多语言等维度能力。
任职要求:
1、背景: 计算机、电子、数学等相关专业硕士/博士;深入理解大模型训练、推理和数据构建流程; -
2、专业深耕:在预训练(数据配比,模型结构,AI Infra)、SFT(e.g. 数据合成、拒绝采样)、强化学习(e.g. Reward Model,GRPO/PPO) 或 模型推理(e.g. 投机解码)等领域有深厚积累; -
3、工程能力:熟练使用 PyTorch,有Megatron-LM、FDPS…
招聘城市:北京,上海,杭州
…如GRPO 等)算法,构建高精度的 Reward Model,解决模型在复杂指令下的对齐问题。
推理模型(Reasoning)优化: 探索长链推理(CoT)、强化学习驱动的自反思与自进化机制,提升模型在的 System 2 思维能力。
Agentic RL 与Agency: 研发面向 Search Agent、Code Agent 和 Tool-use Agent 的强化学习方案,提升模型在开放环境中的任务拆解、工具调用及闭环执行能力。
合成数据与模型进化: 探索高质量合成数据的生成与过滤技术,实现模型能力的自我循环与持续进化
任职要求:
我们希望你具备:
背景: 计算机、数学等相关专业硕士/博士;深入理解 Transformer 架构及大模型训练全流程。
专业深耕: 在 Search(搜索)、Code(代码生成/工程)、tool-use、alignment 或 RL(强化学习) 领域有深厚积累。
工程能力: 熟练…

小红书(xiaohongshu) 基础模型算法工程

全职 北京,上海
招聘城市:北京,上海
…技术,在更小模型规模下最大化能力保持。
- 业务落地与规模化应用: 将高效率模型应用于小红书 Agent、AI 搜索、传统搜索、推荐、广告等真实用户场景,并持续优化效果与成本。
任职要求:
- 有大模型 Pre-training / Mid-training 经验,熟悉训练数据、模型结构、训练稳定性及大规模分布式训练;
- 有 Knowledge Distillation / Pre-training Distillation / Model Compression / Pruning 等相关经验;
- 有 SFT / RL / RLHF / OPD / Reward Modeling 等 Post-training 经验;
- 有 MoE、Attention、Long Context、Speculative Decoding、并行解码或其他模型效率优化方向研究经验;
- 熟悉 PyTorch,以及 Megatron-LM、DeepSpeed、FSDP、vLLM、SGLang 等训练或推理框架中的一种或多种;
- 具备优秀的问题拆解、工程实现和快速实验迭代能力,能够在复杂真实业务场景中独立推动算法效果落地…
招聘城市:北京
岗位职责:
1.负责微信生态内的大模型算法研究与落地应用,包括但不限于长文本理解、指令遵循、工具调用等基础能力;
2.紧密贴合实际业务场景,通过大语言模型后训练技术解决专项问题,提升业务指标和用户体验;
3.持续追踪前沿技术动态,并结合微信生态,推动研究成果的业务验证和落地转化。
岗位要求:
1.硕士或博士学位,机器学习、人工智能、自然语言处理或相关领域的专业背景;
2.熟悉主流的大模型后训练技术,具备丰富的模型微调及强化学习的实践经验;
3.有大型语言模型算法研究、复杂Agent系统开发者优先;
4.在人工智能顶级学术会议(如NeurIPS、ACL、ICML、EMNLP、ICLR等)发表过高质量相关论文者优先;
5.热爱并…

小红书(xiaohongshu) 排序模型算法工程

全职 北京,上海
招聘城市:北京,上海
…序列end to end兴趣挖掘模块;
3.跨场域模型:对业务深入了解,具备横向能力,设计高效的跨场域模型,利用全场域稠密行为解决稀疏场域预估不准确问题;
4.模型Scaling Up:依托LLM架构,设计和实现下一代高效的排序模型范式,包含模型Scaling Up验证以及高效交叉模块;
5.工程协同:与数据平台、工程团队合作,实现模型的高效分布式训练、部署和服务化(TensorFlow/PyTorch),同时编写高质量的技术文档,分享技术成果和知识。
任职要求:
1.研究生及以上学历,在机器学习、深度学习、强化学习、基础数学、统计数学等领域有着一定积累;
2.深入了解推荐系统,搜索排序以及广告等系统,并且一直对业务具备学习热情,做真正懂业务的算法工程
3.在…

小红书(xiaohongshu) dots-模型结构算法工程

全职 北京,上海,杭州
招聘城市:北京,上海,杭州
…新型模型结构探索
探索 Transformer 之后的结构优化方向,包括但不限于:
- MoE
- Hybrid Attention
- Retrieval-enhanced Architecture
以及:长上下文建模 / KV Cache 优化 / 推理效率优化 / 稀疏化与动态计算
我们希望找到:真正影响模型能力边界的结构,而不是参数堆叠。
3. 优化器与训练系统
研究超大模型训练中的优化与稳定性问题,包括:
- AdamW / Muon / Sophia / Shampoo 等优化器探索
- 混合精度训练
- 大 Batch 训练
- 大规模训练异常分析
任职要求:
我们希望你具备
基础要求
- 计算机 / 数学 / 物理等相关专业本科以上
- 扎实的 Python 能力,熟悉 PyTorch
- 良好的机器学习与深度学习基础
加分项
数学 / 算法能力强:ACM / ICPC / NOI / IOI / 数学物理竞赛背景 / 强统计学与优化基础
有大模型训练经验:Pretraining / MoE / 长上下文训练…

小红书(xiaohongshu) 广告模型算法工程

全职 北京,上海,杭州
招聘城市:北京,上海,杭州
模型优化,包括且不局限于CTR、CVR、LTR、生成式等模型优化,提升变现效率;
2. 负责跨场域跨业务基础模型,包括探索基础模型的多维度Scaling Law,以及与业务模型的结合范式升级;
3. 负责广告模型上的全域超长序列建模、序列及特征Tokenizer与交互、模型Scaling Up等广告大模型技术,以及结合广告AI Infra架构的升级;
4. 探索LLM/多模态大模型前沿技术与广告大模型的结合和应用,增强广告内容理解、用户意图理解、增强知识推理;
5. 探索生成式推荐范式、全链路One Model范式、多业务One Model范式,提升系统迭代变现效率。
(满足以上任一即可)
任职要求:
1. 计算机相关专业优先;
2. 具备优秀的编码能力,扎实的数据结构和算法
招聘城市:北京,上海
…策略、模型能力、下游任务的全链路归因能力
建立并持续完善的数据质量、多样性、重复度、覆盖率等评估体系,分析和量化每个维度的影响
针对模型核心能力进行重点强化,包括不限于数学、推理、Code、Agent、ICL、OCR等
探索如何使用更少数据量,达到同样模型能力的策略,持续提升per token的通用能力训练效果
探索基于各类策略
任职要求:
对大模型方向充满兴趣,且能充分意识到数据对于模型能力的重要价值和数据侧的巨大空间
有很好的数据感觉,对人类文明积累下来的优质数据分布有很好的判断
有很好的NLP/多模态经验,在数据和算法方向上有深度的工作
工程能力强,有大规模数据处理的经验
招聘城市:北京,上海
…学习基础,能熟练使用至少一种深度学习框架(e.g. PyTorch、Jax、TensorFlow、MindSpore、PaddlePaddle)。
2. 对监督学习、强化学习、表示学习等机器学习方法有深入理解并具备相关的实践经验。
3. 在 NLP/CV/RL 等至少一个 AI 领域中有过深入的研究经历,或通过机器学习算法解决过复杂业务场景问题。
4. 具备卓越的实验分析与问题解决能力,有创新思维,能够良好沟通、与团队成员高效协作。
加分项:
1. 有 ICML、ICLR、NeurIPS、ACL、CVPR、AAAI 等顶级学术会议发表过有影响力研究成果的优先。
2. 在 ACM/ICPC、NOI/IOI、Kaggle 等比赛获奖者优先。
3. 主导、参与过 AI 相关的有大影响力的开源/闭源项目的优先。
4. 有 AI Alignment 相关研究或大模型应用…
招聘城市:上海
…一位对多模态大模型充满热情的资深算法工程,你将深度参与B站视频理解大模型的研发与落地。作为团队的核心技术骨干,你将负责从数据构建、模型训练到效果评估的全链路关键模块设计,推动模型能力在业务场景中的持续突破。
职位描述
工作职责:
1. 负责B站视频内容理解、互动内容(评论/弹幕)理解、用户建模等方向的学术研究与技术突破,跟踪领域前沿动态,主导核心技术选型与关键难题攻克,提升团队核心技术竞争力。
2. 基于已有多模态大模型(VLM、MLLM),结合站内海量数据,开展post-pretraining/continued pretraining等前沿技术研究,构建适配业务场景、高效统一的下一代模型架构或技术方案。
3. 深耕多模态大模型相关核心技术研发…
招聘城市:深圳
岗位职责:
1.数据特征算法:负责海量文本&多模态数据(图像,视频,音频,3D)的内容理解(如分类标签体系、embedding表征、Caption生成等),质量检测(低质识别检测、优质美学评价等),去重/聚类分析,数据合成等算法
2.数据pipeline建设:负责数据采集、筛选清洗、标注与质量评估pipeline的建设。与模型业务团队紧密配合,充分分析挖掘数据资源,建立自动化数据处理流程与机制,支持模型持续迭代;
3.数据实验分析:对模型训练数据进行详细分析,建立科学数据实验机制,识别样本不足、质量问题、配比不均衡等潜在问题,驱动数据优化提升数据覆盖、质量、多样性需求,最终带来大模型生成效果的持续提升。
岗位要求:
1.硕士及以上学历,计算机视觉、自然语言处理或多模态方向背景优先…
招聘城市:北京
…多模态理解等任务,研发业界领先的多模态大模型
2.持续跟进业界最新的多模态大模型算法,参与多模态大模型的设计、训练、调优及评测工作,并推进多模态大模型在业务场景的应用落地。
岗位要求:
1.计算机科学、机器学习、人工智能、应用数学等相关专业,硕士及以上学历;
2.在多模态理解相关领域(包括自然语言处理、计算机视觉、语音理解/生成等)有扎实的研究基础,熟悉一个或多个模态领域的主流模型算法,如CLIP、LLAVA、VALL-E等;
3.熟悉深度学习框架,如TensorFlow或Pytorch;了解分布式训练框架,如Deepspeed和Meatron-LM等,并有一定的多机多卡分布式训练经验;
4.较强的工程实现能力,熟练掌握C…
招聘城市:北京,上海,杭州
…现有 Attention、NTP 等范式保持批判性思考,例如探索全新的
探索新架构、新目标函数、新训练范式在 Post-Training 中的可能性
参与从模型 → 推理过程 → 自学习环境(System-level Scaling)的演进
任职要求:
基础要求
扎实的机器学习 / 深度学习基础,对模型训练全流程有深入理解
熟悉至少一个方向:
强化学习(RL Scaling / RLAIF / Online RL 等)
多模态学习(尤其是视频、时序、感知建模)
Agent / 多智能体系统
良好的工程能力,能将研究想法落地为稳定系统
加分项
有大模型 Post-Training 或 MOE RL Scaling 实战经验
RL Algo & Infra co-design
对 Token 效率、推理效率、多尺度学习 等问题有深入思考
参与过 Agent 系统或复杂训练闭环的设计
有“系统思维”,不满足于单点指标提升
招聘城市:深圳
…实际应用产品;
3.参与算法优化和性能提升,确保产品在市场上的竞争力;
4.协助团队进行技术文档编写和知识分享,提升团队整体技术水平。
岗位要求:
1.计算机科学、统计学或相关专业本科及以上学历;
2.精通至少一种主流编程语言,如Python、C++等;
3.具有5年以上相关领域工作经验,有成功实施AI项目的经验者优先;
4.具备良好的团队合作精神和沟通能力,对技术有好奇心、有热情。
加分项:
1.有 AI 应用的成功项目经验;
2.在多模态、会话处理等方面有深入研究;
3.在国际顶级会议或期刊上发表过相关论文。
岗位介绍:
在腾讯,后台开发工程不仅是“又快又稳”的问题解决专家,更是生态共创者。你将…

小红书(xiaohongshu) Dots-Posttrain算法工程-General Agent

全职 北京,上海,杭州
招聘城市:北京,上海,杭州
…Agent、Long-term Objective、Scalable Oversight 等方向下基于强化学习的对齐方法;
基于前沿方法对幻觉、推理、工具使用、安全等场景问题进行针对性优化,提升大模型的应用价值。
任职要求:
1. 具备扎实的机器学习基础,能熟练使用至少一种深度学习框架(e.g. PyTorch、Jax、TensorFlow、MindSpore、PaddlePaddle)。
2. 对监督学习、强化学习、表示学习等机器学习方法有深入理解并具备相关的实践经验。
3. 在 NLP/CV/RL 等至少一个 AI 领域中有过深入的研究经历,或通过机器学习算法解决过复杂业务场景问题。
4. 具备卓越的实验分析与问题解决能力,有创新思维,能够良好沟通、与团队成员高效协作。
加分项:
1. 对大模型 RL 技术有极大热情
2. 有 ICML、ICLR、NeurIPS、ACL、CVPR、AAAI…

小红书 Hi Lab-多模态基模算法工程-生成理解统一

全职 北京,上海,广州
招聘城市:北京,上海,广州
…裹挟、不被主观偏好影响。期待你除了算法外仍然是为出色的工程。期待你对技术有强烈的好奇心和开放心态,以未来几年 AI 技术的质变突破为目标。
岗位说明:你会负责下述至少一件事情
1.海量的多模态数据处理:定性分析、定量评估数据质量,并给出 scalable 的改进方案,协助搭建多模态的数据流程;
2.搭建多模态的模型架构,在多种技术方案中找到 trade off 的关键,搭建更高效且可扩展的模型框架
3.研究并改进多模态模型的 Scale Law,随着模型的变化给出 Large Scale 上的技术选择(例如参数/数据比、不同超参数设置等)
任职要求:
1.良好的 pytorch / python 技术栈,具备熟练的阅读代码和编写代码的能力…
招聘城市:北京
岗位职责:
1.研发具备通用能力的端到端语音大模型,包括多语种语音识别、语音合成、声纹识别、副语言信息理解等;
2.推动上述语音技术与团队内部大语言模型 (LLM) 的深度融合,参与设计和实现智能语音交互系统架构;
3.在微信AI探索业务中,基于微信场景数据提供技术解决方案,探索业界前沿技术在业务中的落地与指标优化。
岗位要求:
1.硕士或博士学位,机器学习、人工智能、数字信号处理或相关领域的专业背景;
2.深入理解语音音频信号处理、声学建模、语言模型和大模型架构;
3.在语音合成、语音识别、声纹识别中至少一个领域有深入研究和扎实的实践经验;熟悉多个领域者优先;
4.有实际推动大模型在语音识别、合成…