牛大妈在社招职位搜索大模型算法工程师-基础模型 有 945 条结果

小红书 模型算法工程-基础模型

全职 北京,上海
招聘城市:北京,上海
…多场域(如广告、电商、推荐等)通用基础模型的设计与研发,提升模型的泛化与迁移能力
2. 负责跨域学习、序列建模、多模态建模等新范式在业务中的应用。
3. 负责统一的用户/内容表征体系构建,支持长周期用户兴趣建模与动态演化。
4. 探索新一代模型体系构建,提升业务模型技术的天花板
任职要求:
1. 具备扎实的机器学习、深度学习理论基础,对多模态、序列建模、跨域学习、迁移学习有深入理解与实践
2. 有推荐系统、搜索排序或者广告系统等相关业务经验,具备优秀的系统思维与解题能力
3. 掌握主流深度学习框架,具备高质量模型代码实现与调试能力
4. 具备良好的沟通协作能力和技术热情,能够推动跨团队项目高效落地
招聘城市:北京
岗位职责:
1.负责微信生态内的模型算法研究与落地应用,包括但不限于长文本理解、指令遵循、工具调用等基础能力;
2.紧密贴合实际业务场景,通过语言模型后训练技术解决专项问题,提升业务指标和用户体验;
3.持续追踪前沿技术动态,并结合微信生态,推动研究成果的业务验证和落地转化。
岗位要求:
1.硕士或博士学位,机器学习、人工智能、自然语言处理或相关领域的专业背景;
2.熟悉主流的模型后训练技术,具备丰富的模型微调及强化学习的实践经验;
3.有大型语言模型算法研究、复杂Agent系统开发者优先;
4.在人工智能顶级学术会议(如NeurIPS、ACL、ICML、EMNLP、ICLR等)发表过高质量相关论文者优先;
5.热爱并…
招聘城市:深圳
…支持模型高效部署;
3.研发应用于理解生成一体模型、原生多模态模型的加速算法,开展前瞻性技术探索与研发,为后续基模迭代与产品落地提供核心技术支撑;
4.跟进业界前沿的模型加速技术,快速迭代并落地创新加速方案,保障多模态生成模型工程化落地与商业化竞争力。
岗位要求:
1.计算机、人工智能、数学等相关专业的全日制本科(优先)以上;
2.具有扎实的深度学习算法基础,具备扎实的模型研发经验;有模型蒸馏、剪枝、轻量化设计等相关加速方向实操经验者优先,有底层算子开发经验、相关方向顶级论文发表经验者优先;
3.熟悉各类深度学习网络和算子底层实现细节,训练和推理模型调优,熟悉模型
招聘城市:北京,上海
…文本的语义对齐,提升模型在复杂多模态指令下的表现。
VLM Reasoning: 探索视觉场景下的逻辑推理能力(如视觉、复杂视频序列理解),让 VLM 具备“边看边思考”的能力。
多模态 Agent: 研发具备视觉反馈的智能体技术,利用 VLM 驱动复杂工具调用。
视频理解与长文本视觉: 针对小红书海量视频场景,优化长视频理解能力及多帧推理效率,挖掘视频数据的深层语义。
任职要求:
我们希望你具备:
背景: 计算机、视觉、机器人等相关专业硕士/博士;熟悉主流 VLM 架构(如 LLaVA, Qwen-VL, InternVL 等)。
专业深耕: 在 计算机视觉(CV)、多模态学习 或 视频理解 领域有深入研究。
工程能力: 精通 PyTorch,熟悉多模态模型的数据预处理流水线及大规模多机多卡训练…
招聘城市:北京,上海,杭州
…如GRPO 等)算法,构建高精度的 Reward Model,解决模型在复杂指令下的对齐问题。
推理模型(Reasoning)优化: 探索长链推理(CoT)、强化学习驱动的自反思与自进化机制,提升模型在的 System 2 思维能力。
Agentic RL 与Agency: 研发面向 Search Agent、Code Agent 和 Tool-use Agent 的强化学习方案,提升模型在开放环境中的任务拆解、工具调用及闭环执行能力。
合成数据与模型进化: 探索高质量合成数据的生成与过滤技术,实现模型能力的自我循环与持续进化
任职要求:
我们希望你具备:
背景: 计算机、数学等相关专业硕士/博士;深入理解 Transformer 架构及模型训练全流程。
专业深耕: 在 Search(搜索)、Code(代码生成/工程)、tool-use、alignment 或 RL(强化学习) 领域有深厚积累。
工程能力: 熟练…

小红书(xiaohongshu) 基础模型算法工程

全职 北京,上海
招聘城市:北京,上海
…技术,在更小模型规模下最大化能力保持。
- 业务落地与规模化应用: 将高效率模型应用于小红书 Agent、AI 搜索、传统搜索、推荐、广告等真实用户场景,并持续优化效果与成本。
任职要求:
- 有模型 Pre-training / Mid-training 经验,熟悉训练数据、模型结构、训练稳定性及大规模分布式训练;
- 有 Knowledge Distillation / Pre-training Distillation / Model Compression / Pruning 等相关经验;
- 有 SFT / RL / RLHF / OPD / Reward Modeling 等 Post-training 经验;
- 有 MoE、Attention、Long Context、Speculative Decoding、并行解码或其他模型效率优化方向研究经验;
- 熟悉 PyTorch,以及 Megatron-LM、DeepSpeed、FSDP、vLLM、SGLang 等训练或推理框架中的一种或多种;
- 具备优秀的问题拆解、工程实现和快速实验迭代能力,能够在复杂真实业务场景中独立推动算法效果落地…
招聘城市:北京,上海

2. 卓越的实战经验: 在 MLLM 推理优化、视觉对齐、视频语义理解 或 大规模预训练 领域有深入研究或成功落地经验。
3. 硬核的工程能力: 精通 PyTorch,熟悉 Megatron-LM、DeepSpeed 等分布式训练框架,能够处理百亿/千亿级参数模型在大规模集群上的高效训练。
4. 数据洞察力: 对高质量多模态数据的构建、清洗及 Automated Data Mixing 策略有独特见解,能从海量无序数据中提炼知识。
5. 卓越的评测与诊断能力: 熟悉主流多模态评测集,能够针对业务痛点构建垂直领域的 Benchmark;具备深度的模型表现诊断能力,能通过评测结果反向驱动数据混合(Data Mixing)与算法优化。
加分项:
在 CVPR, ICCV, NeurIPS, ICML, ICLR 等顶会发表过高影响力论文,或在知名开源…
招聘城市:北京,上海
…问题进行分析、算法设计、研发以及推动上线,提升业务效果;
任职要求:
1.在模型方向有一定经验,对Pre-train、SFT等技术有深入了解;
2.有良好的英文读写能力和扎实的数学基础,有快速学习新技术的能力;
3.有扎实的编程基础,熟悉Python/C++等编程语言,具有快速复现前沿论文的能力;
4.熟悉至少一个深度学习和模型训练框架,包括PyTorch、TensorFlow、MXNet、Caffe、HuggingFace、DeepSpeed等;
5.有较强的研究能力,在国际顶尖会议或期刊(包括但不限于CVPR, ICCV, ECCV, NeurIPS, ICML, ICLR, AAAI, IJCAI, ACMMM, TIP, TPAMI, IJCV,ACL、EMNLP、NAACL、COLING、CoNLL、NLPCC等)上发表过论文者优先;
6.较强的业务问题到算法模型的建模能力,有强烈的求知欲、自驱力…
招聘城市:深圳
岗位职责:
1.主导商业化领域多模态基础模型的建设,在商业化领域数据潜力挖掘、模型架构设计和训练机制优化等方向进行持续攻关,持续提升基础模型效果;
2.深入理解商业化场景并将其与基础模型结合,将基础模型应用于用户/内容/广告/商品理解、个性化生成、广告搜推等业务领域,提升各个业务算法效果;
3.持续跟进前沿算法,包括预训练/后训练、强化学习、持续学习、理解&生成统一模型、图像/视频生成等领域,并结合商业化场景持续探索创新,提升技术影响力。
岗位要求:
1.计算机相关专业博士或5年以上相关经验,具有扎实的计算机和机器学习基础,拥有优秀的的编程能力和工程能力;
2.具有较强的实践…
招聘城市:上海
岗位职责:
1.参与Omni原生多模态模型的研发,包括训练数据的设计和构造,基础模型算法的设计和迭代,进行大规模SFT和RL训练调优等;
2.持续跟进业界最新的多模态模型算法、强化学习算法,探索原生多模态模型、理解生成一体化模型的研发落地。
岗位要求:
1.计算机、人工智能等相关专业硕士以上学历;
2.有大规模强化学习、多模态理解基模研发相关经验者优先;
3.具有扎实的深度学习算法基础,熟悉深度学习框架和分布式训练推理加速,有实操经验者优先;
4.在多模态/CV/NLP等领域顶级会议(期刊)发表过论文、主导/参与业界知名的开源项目者优先;
5.具备极强的学习能力和技术追求,良好的…
招聘城市:深圳
基础模型或多模态模型的研发工作,系统理解整体技术架构与训练方法。
2.精通大规模模型训练范式,包括预训练(Pretraining)、监督微调(SFT)、多任务联合训练、蒸馏训练、后训练(如 RLHF/DPO 等),理解训练稳定性及效率优化方法。
3.熟悉视觉核心任务中的一种或多种,包括目标检测、分割、图片理解或视觉语言模型(VLM)等方向,熟悉 VLM for Grounding。
4.具备大规模数据构建与治理经验,熟悉自动标注、弱监督学习、数据蒸馏等技术路线。
5.在计算机视觉或机器学习领域的国际顶级会议或期刊(如CVPR/ICCV/ECCV/NeurIPS/ICLR等)发表过高质量论文,在权威竞赛或开源项目中有核心贡献者优先。
6.具备扎实的工程实现能力,熟练使用Python/PyTorch进行模型
模型」定义智能辅助驾驶新未来
蔚来招聘
招聘概要:
蔚来自动驾驶研发团队火热招聘中!以「世界模型+NWM」全新版本正式开启推送,国内首次将完整的闭环强化学习应用于智能辅助驾驶研发,打造「世界模型+闭环强化学习」领先技术架构,全面模型化城区与高速领航辅助,实现「类人安心感」和「类人效率」升级。
招聘对象:
• 社招:基础模型研究员 / 算法工程、智能辅助驾驶端到端模型研发工程 / 专家、模型 - VLM/VLA 多模态算法工程模型 - 端到端算法工程、智能辅助驾驶世界模型算法研发专家
• 校招:2024-2026届毕业生(2023年9月-2026年8月期间毕业),含智能辅助驾驶AI研究员、多模态模型算法工程、强化学习算法
招聘城市:北京
岗位职责:
1.负责社交模型方向的记忆检索、Agent函数调用、风格化基座模型等方向的算法突破;
2.紧密贴合业务,通过后训练(SFT&RL)提升模型的专项问题解决能力;
3.基于微信场景数据提供技术解决方案,探索业界前沿技术在业务中的落地与指标优化。
岗位要求:
1.硕士或博士学位,机器学习、人工智能、自然语言处理或相关领域的专业背景;
2.在post-training方向或RL方向有一定研究基础优先;
3.高质量相关论文NeurIPS、ACL、ICML、EMNLP作者优先;
4.有大型语言模型算法研究或落地经验者优先;
5.热爱探索AI前沿技术,具有团队精神和良好的沟通能力。
加分项:
1.北京、广州base均可。
岗位介绍:
渴望为世界带来新意的人,早已对…
招聘城市:北京
岗位职责:
1.负责微信内垂类模型Agent方向的研究和落地应用,包括但不限于上下文工程、多任务拆解及多工具调用等基础能力;
2.紧密贴合实际业务场景,通过语言模型后训练技术解决专项问题,提升业务指标和用户体验;
3.持续追踪前沿技术动态,并结合微信生态,推动研究成果的业务验证和落地转化。
岗位要求:
1.硕士或博士学位,机器学习、人工智能、自然语言处理或相关领域的专业背景;
2.熟悉主流的模型后训练技术,具备丰富的模型微调及强化学习的实践经验;
3.有大型语言模型算法研究、复杂Agent系统开发者优先;
4.在人工智能顶级学术会议(如NeurIPS、ACL、ICML、EMNLP、ICLR等)发表过高质量相关论文者…
招聘城市:深圳
岗位职责:
1.参与商业化领域的多模态基础模型的研发,包含领域数据挖掘、模型结构设计和训练机制优化等;
2.将商业化领域的多模态模型应用于用户/内容/广告/商品理解、个性化内容生成、广告搜推等业务领域,提升业务效果;
3.跟踪前沿算法研究(如预训练、后训练、强化学习、持续学习、理解&生成统一模型、图像/视频生成等),在商业化场景进行技术验证与落地。
岗位要求:
1.计算机相关专业硕士及以上学历,博士优先,具有扎实的计算机和机器学习基础,拥有优秀的的编程能力和工程能力;
2.在计算机视觉、多模态、NLP、AIGC、机器学习等一个或多个领域有较深入的研究,包括但不限于LLM/MLLM、商品理解、视频内容…
招聘城市:上海
岗位职责:
1.参与商业化领域的多模态基础模型的研发,包含领域数据挖掘、模型结构设计和训练机制优化等;
2.将商业化领域的多模态模型应用于用户/内容/广告/商品理解、个性化内容生成、广告搜推等业务领域,提升业务效果;
3.跟踪前沿算法研究(如预训练、后训练、强化学习、持续学习、理解&生成统一模型、图像/视频生成等),在商业化场景进行技术验证与落地。
岗位要求:
1.计算机相关专业硕士及以上学历,博士优先,具有扎实的计算机和机器学习基础,拥有优秀的的编程能力和工程能力;
2.在计算机视觉、多模态、NLP、AIGC、机器学习等一个或多个领域有较深入的研究,包括但不限于LLM/MLLM、商品理解、视频内容…
招聘城市:深圳
岗位职责:
1.参与商业化领域的多模态基础模型的研发,包含领域数据挖掘、模型结构设计和训练机制优化等;
2.将商业化领域的多模态模型应用于用户/内容/广告/商品理解、个性化内容生成、广告搜推等业务领域,提升业务效果;
3.跟踪前沿算法研究(如预训练、后训练、强化学习、持续学习、理解&生成统一模型、图像/视频生成等),在商业化场景进行技术验证与落地。
岗位要求:
1.计算机相关专业硕士及以上学历,博士优先,具有扎实的计算机和机器学习基础,拥有优秀的的编程能力和工程能力;
2.在计算机视觉、多模态、NLP、AIGC、机器学习等一个或多个领域有较深入的研究,包括但不限于LLM/MLLM、商品理解、视频内容…
招聘城市:北京,上海
…多模态输入的推理能力,模型能够无偏地利用 context 中不同模态的信息进行高质量的结构化推理,解决复杂问题。
视觉生成基础
具备高质量多模态输入的图片生成模型,提升真实感、一致性和复杂度;
具备强可控与可编辑的能力,支持多种控制方式并保持编辑前后的一致性;
探索 Diffusion 理论,在生成效率和效果上追求 10x 提升的架构创新。
音频生成基础
具备高质量多模态输入的音频生成模型,包括人声、哼唱、音乐、General Audio;
具备强可控和可编辑的能力,支持对音色/风格/情绪/语速等多种维度及其复合要求进行可控编辑;
探索端到端统一表征,追求 learnability / quality / compression 的极致 trade-off 优化。
生成与理解统一模型
探索减小不同模态在…

小红书(xiaohongshu) 广告模型算法工程

全职 北京,上海,杭州
招聘城市:北京,上海,杭州
模型优化,包括且不局限于CTR、CVR、LTR、生成式等模型优化,提升变现效率;
2. 负责跨场域跨业务基础模型,包括探索基础模型的多维度Scaling Law,以及与业务模型的结合范式升级;
3. 负责广告模型上的全域超长序列建模、序列及特征Tokenizer与交互、模型Scaling Up等广告模型技术,以及结合广告AI Infra架构的升级;
4. 探索LLM/多模态模型前沿技术与广告模型的结合和应用,增强广告内容理解、用户意图理解、增强知识推理;
5. 探索生成式推荐范式、全链路One Model范式、多业务One Model范式,提升系统迭代变现效率。
(满足以上任一即可)
任职要求:
1. 计算机相关专业优先;
2. 具备优秀的编码能力,扎实的数据结构和算法
社招|1月24日,Shopee模型专场开启,一天走完面试流程
Shopee虾皮招聘
招聘摘要:
Shopee 26届社招信息
公司简介 :Shopee模型团队专注打造面向全球竞争的多语言模型,以业务驱动创新,构建下一代自主智能体体系。依托东南亚数据优势,建设全栈基础设施,模型能力已在多业务场景落地,取得显著效益,技术成果获国际认可。
公司福利 :及时反馈,告别漫长等待;无需占用工作日时间,周末一天走完面试流程。
招聘职位 :模型LLM基座模型算法工程模型LLM预训练算法工程模型LLM强化学习算法工程模型LLM对齐算法工程模型LLM模型效率算法工程(训练)、模型LLM模型效率算法工程(推理)。
工作…