牛大妈在校招职位搜索基础模型算法实习生+-+LLM+Post-training 有 1000+ 条结果

招聘城市:上海,北京
…强化学习算法,协助团队进行奖励模型的构建和优化
Reasoning技术探索:参与模型监督、自我提升等训练优化探索
训练框架优化:学习使用LLM训练框架,参与协助优化训练流程,提升团队开发效率
任职要求:
任职资格
具备较好的编程能力和算法开发能力,熟悉常用的机器学习、深度学习算法
熟悉Llama-Factory、veRL、MS-Swift等框架,有相关项目经验更佳
了解分布式训练框架如DeepSpeed、Megatron-LM等
有较强的学习意愿和团队协作精神,能保证每周至少3天实习时间,实习期至少3个月
加分项
对强化学习有基本了解或项目经验
有开源项目贡献经历,尤其是与LLM相关的项目
发表过相关领域的学术论文
对模型对齐、推理、思维链(CoT)等LLM训练技术…
招聘城市:北京,上海
…本岗位侧重于提升大语言模型的“核心大脑”能力。你将通过先进的 Post-training 技术,让模型在Reasoning、Agentic以及人类意图对齐上达到业界顶尖水平,通过提升AI智能水平的上限,支撑小红书所有业务场景,包括且不限于搜索、广告、推荐、电商、客服及智能发布等核心场景。
你的工作内容
大规模对齐与强化学习: 研发并优化 SFT、RL(如GRPO 等)算法,构建高精度的 Reward Model,解决模型在复杂指令下的对齐问题。
推理模型(Reasoning)优化: 探索长链推理(CoT)、强化学习驱动的自反思与自进化机制,提升模型在的 System 2 思维能力。
Agentic RL 与Agency: 研发面向 Search Agent、Code Agent 和 Tool-use Agent 的强化学习方案,提升模型在开放环境中的任务拆解…
招聘城市:上海
…希望你:
1. 深度学习基础扎实,熟悉Transformer原理,熟悉当前主流LLM架构
2. 熟悉常见大模型训练框架(Megatron/DeepSpeed/Verl)
3. 有LLM相关项目经验:CPT、SFT、RL 任意方向即可
4. 有阅读论文与复现能力,能快速上手实验
5. 良好的自我学习能力和独立思考能力
加分项:
1. 有相关领域顶会论文,或拥有影响力工作
2. 有自己的LLM项目
3. 有机器翻译(MT)经验
4. 熟悉生成式推荐(前沿进展,有相关研究或业务落地经验
5. 有 Agent RL相关的项目经验或算法调优经验
网申须知
网申开始日期:2026-03-05 00:00
网申截止日期:2026-06-01 00:00
仅限 2026-09 至 2027-08 毕业的大学,快来投递吧~
投递简历

小红书(xiaohongshu) 【27届】广告基础模型算法实习

兼职 北京,上海,杭州
招聘城市:北京,上海,杭州
…等模型优化,提升变现效率;
2. 负责跨场域跨业务基础模型,包括探索基础模型的多维度Scaling Law,以及与业务模型的结合范式升级;
3. 负责广告模型上的全域超长序列建模、序列及特征Tokenizer与交互、模型Scaling Up等广告大模型技术,以及结合广告AI Infra架构的升级;
4. 探索LLM/多模态大模型前沿技术与广告大模型的结合和应用,增强广告内容理解、用户意图理解、增强知识推理;
5. 探索生成式推荐范式、全链路One Model范式、多业务One Model范式,提升系统迭代变现效率。
(满足以上任一即可)
任职要求:
1. 计算机相关专业优先,每周可实习4天以上,持续3个月以上;
2. 具备优秀的编码能力,扎实的数据结构和算法功底…
招聘城市:北京
…语言模型(LLM)/多模态大模型(MLLM)等类型模型的推理服务框架;
2、通过并行计算优化、分布式架构优化、异构调度等多种框架技术,打造高效、易用、领先的AI推理框架;
2、深度参与周边深度学习系统多个子方向的工作,包括但不限于模型管理、推理部署、日志/监控、工作流编排等;
3、与全公司各业务算法部门深度合作,为重点项目进行算法与系统的联合优化,支撑业务目标达成。
任职要求:
任职资格:
1、优秀的代码能力、数据结构和基础算法功底,熟悉C++/Python开发,熟悉 Linux/Git 开发环境;
2、熟悉至少一种主流基础深度学习训练或推理框架(TensorFlow/PyTorch/PaddlePaddle/TensorRT等)的使用和实现;
3、熟悉主流LLM模型结构,熟悉至少一种主流LLM推理框架(vLLM/SGLang/TensorRT-LLM
招聘城市:北京
【LongCat大模型人才校招】基础模型 Post-training 算法研究员
更新时间:2026-06-03
工作地点:北京市
事业群:核心本地商业-基础研发平台
岗位职责
我们在探索通过数据优化及大规模RL的方式,持续提升模型的核心基础能力和复杂生产力场景解决困难问题的能力。让模型具备深度思考与可靠行动的特性,推动模型在真实复杂任务中实现从“会说”到“会做”的跨越。团队在以下方向上进行探索,若你对以下一个或者多个课题感兴趣均欢迎投递:
1)大模型核心基础能力优化
1.围绕指令遵循、幻觉缓解、复杂推理、智能体规划等关键能力,研究并开发高效的后训练与对齐方案。
2.深入分析模型行为,通过数据策略、奖励建模、训练…
招聘城市:上海
…工作职责:
• 参与大模型训推平台开发,支撑千卡至万卡训练任务
• 开发任务调度系统(Kubernetes + Volcano)
• 集成分布式训练框架(Megatron-LM/DeepSpeed/FSDP)
• 构建实验管理平台(实验追踪、超参搜索、模型版本管理)
• 开发 GPU 监控、故障检测、断点续传等运维工具
工作要求:
• CS相关专业在读;
• 熟悉 Python,掌握后端框架(FastAPI/Flask/Go 均可)
• 了解 Kubernetes,有容器化部署经验优先
• 了解分布式训练原理(DP/MP/PP)优先
• 有 Linux 系统管理和 Shell 脚本经验
• 了解 Prometheus/Grafana 监控体系加分
• 有 MLflow/W&B/Kubeflow 经验加分
网申须知
网申开始日期:2026-03-05 00:00
网申截止日期:2026-06-30 00:00
仅限 2026-09 至 2027-08 毕业的大学,快来投递吧~
投递简历
招聘城市:上海
…机视觉一个或多个领域的研究和实践经验,包括但不限于以下方向:
a)图片/视频生成扩散模型
b)视觉自监督学习/表示学习/生成理解统一;
c)大规模视频生成训练经验、SFT或RLHF经验;
d)视频生成的数据清洗和构建。
4、具备扎实的算法功底与落地工程能力,实操动手能力突出者优先;
5、工作积极主动,思路有条理,能够独立完成具有挑战性的前沿研发工作;同时擅长跨协作配合,推动团队成果落地;
6、加分项:具有顶会论文,或产出具备行业影响力的研究项目、技术成果。
网申须知
网申开始日期:2026-06-15 00:00
网申截止日期:2027-06-30 00:00
仅限 2026-09 至 2030-06 毕业的大学,快来投递吧~
投递简历

小红书(xiaohongshu) 大模型算法实习

兼职 深圳,北京
招聘城市:深圳,北京
岗位职责:
工作职责:
1、海量文本数据处理,包含分类、质量打分、语义识别等;
2、建立文本处理流程,持续优化模型效果;
3、跟踪最新NLP研究成果,并应用到处理流程中。
任职要求:
任职资格:
1、计算机相关方向本科及以上学历;
2、良好的编程能力,熟练运用Python语言,熟悉常见的机器学习框架;
3、熟悉常见的机器学习和NLP算法,了解当前热点和前沿技术;
4、有高水平会议或期刊论文者优先。
5、可尽快到岗者优先,至少实习3个月,每周工作日出勤至少4天。
招聘城市:北京
岗位职责:
1.负责LLM强化学习链路整体优化,包括数据探索与增强、奖励模型优化、RL策略迭代及效果评估等,持续提升算法的效率与效果;
2.强化学习技术前瞻探索,包括但不限于离线强化学习、环境模型学习、约束强化学习等方向;
3.开展大语言模型在搜索、推荐、广告等业务场景中的应用并实现业务目标。
任职要求:
1.计算机科学、自动化、数学、统计学或相关领域专业的硕士或博士;
2.扎实的算法基础,熟悉强化学习、自然语言处理和机器学习技术,对技术开发及应用有热情;
3.能够基于实际业务问题优化算法,有RL算法优化和项目实践经验优先;
4.熟悉Python、Java等至少一种编程语言,具有良好的编程能力和扎实的数学理论基础

小红书 大模型算法实习

兼职 北京,上海
招聘城市:北京,上海
岗位职责:
1、海量文本数据处理,包含分类、质量打分、语义识别等;
2、建立文本处理流程,持续优化模型效果;
3、跟踪最新NLP研究成果,并应用到处理流程中。
任职要求:
1、计算机相关方向本科及以上学历;
2、良好的编程能力,熟练运用Python语言,熟悉常见的机器学习框架;
3、熟悉常见的机器学习和NLP算法,了解当前热点和前沿技术;
4、有高水平会议或期刊论文者优先。
5、可尽快到岗者优先,至少实习3个月,每周工作日出勤至少4天。
招聘城市:上海
岗位介绍:
职位描述
工作职责:
1、采购项目后端工作的协助推进,负责每月账单金额核对及拆分、协助完成成本使用数据更新;
2、跨部门协调沟通,根据业务类别,与相关业务部门项目对接人员核对并根据合同签署内容确认账单最终版本后提交采购业务负责人;
3、协助完成采购项目的进度跟进,问题收集与反馈等;
4、其他与采购项目相关的数据资料整理工作;
工作要求:
1、熟练使用office办公软件,Excel表格能力突出;
2、具有较强的逻辑性及沟通能力;
3、工作细致、仔细、责任心强;
4、对数字敏感,统计、财务、法律、审计、采购等相关专业背景优先。
实习期:平均每周工作日不少于4天,能实习6个月以上的人员优先
投递简历

北京长擎软件有限公司 大模型算法

兼职 北京市朝阳区
招聘城市:北京市朝阳区
1.负责LLM模型的训练和调优,以满足特定业务场景需求;
2.负责大模型相关的数据处理,包括数据爬取、数据增强、数据清洗、数据标注及后处理等;
3.与其他团队成员紧密合作,完成模型集成及部署,保障模型稳定运行及持续优化;
4.研究和应用*新的NLP技术和趋势,深入理解底层算法原理,以支持业务创新和发展。
岗位要求:
1.计算机、数学、统计等相关专业本科及以上学历,有机器学习、LLM模型相关经验;
2.扎实的机器学习、深度学习和自然语言处理理论基础,具备优秀的工程开发能力,有LLM模型训练和调优经验;
3.熟悉PyTorch,TensorFlow等深度学习平台,熟练掌握Python/C++编程语言;
4.能够对领域前沿技术保持持续关注和学习,愿意…
招聘城市:上海
岗位介绍:
职位描述
工作职责:
面向高性能 GPU 大卡集群、AI 训练 / 推理集群,聚焦集群全栈性能优化、网络异常检测、服务器故障定位,支撑大模型训练、分布式算力业务稳定高效运行
团队通用职责:
1、参与大规模 GPU 集群日常压测、基线梳理、运维保障,配合完成集群扩容、版本升级、环境标准化工作
2、基于 Prometheus、Grafana、DCGM 等工具搭建集群监控大盘,输出性能报表、故障分析报告与优化方案
3、编写 Shell/Python 自动化脚本、运维 SOP、故障处理手册,沉淀技术知识库
4、协同算法、平台、网络团队,联动定位集群全链路问题,保障大模型训练、分布式任务稳定运行
5、跟踪 GPU 集群、RDMA 网络、分布式通信前沿技术,持续优化集群架构与运行效率
岗位具体职责:
聚焦硬件、驱动…
招聘城市:北京
…理解和执行能力,提升美团服务能力和效率;
5. 不断探索技术新领域,推动技术能力的沉淀和技术氛围的建设。
任职要求:
1. 熟悉大模型的原理,具备数据处理、精调、预训练、强化等方面的经验;
2. 熟悉自然语言处理常见算法模型,具备深度学习技术在NLP领域的应用实践;
3. 具备良好的编程实现能力,熟悉C++、Python、Java等常用编程语言中至少一种;
4. 具备强烈的进取心、求知欲及团队合作精神,热衷于追求技术创新;
5. 每周至少全职工作四天,保证实习至少6个月,实习须征得导师同意。
岗位亮点:
1、资深算法专家的一对一指导
2、丰富的GPU资源及核心场景数据
3、真实应用场景的实践
4、发表国际会议论文的机会
招聘城市:北京,上海,杭州
…职责:
LLM Post-training方向:
本岗位侧重于提升大语言模型的“核心大脑”能力。你将通过先进的 Post-training 技术,让模型在Reasoning、Agentic以及人类意图对齐上达到业界顶尖水平,通过Scaling Post-training来提升大模型智能水平的上限,支撑小红书所有业务场景,包括且不限于搜索、广告、推荐、电商、客服及国际化等核心场景。
你的工作内容:
1、Agentic RL 与Agency: 研发面向 Work Agent、Code Agent、Search Agent 和 Tool-use Agent 的SFT与RL方案,提升模型在开放环境中的任务拆解、工具调用及闭环执行能力;
2、大规模对齐与强化学习: 研发并优化 SFT、RL(如GRPO 等)、OPD等算法,构建高精度的 Reward Model,解决模型在复杂指令下的对齐问题;
3、推理模型(Reasoning…
招聘城市:上海
…2、熟悉 Linux 操作系统,掌握基础 Linux 命令,了解 Shell/Python 任意一种脚本语言,具备基础脚本编写能力;
3、了解计算机网络基础原理,熟悉 TCP/IP、二层 / 三层网络架构,有 RDMA、InfiniBand、RoCE 网络认知者优先;
4、了解 GPU、CUDA 基本概念,接触过分布式计算、高性能集群、AI 训练环境者优先;
5、具备良好的问题排查思路、逻辑分析能力,学习能力强,能接受集群 7×24 应急值守(轮班),责任心强、善于沟通协作。
加分项:了解服务器硬件结构、BMC/IPMI 带外管理,有服务器运维、硬件排障实习经验优先。
网申须知
网申开始日期:2026-06-15 00:00
网申截止日期:2027-06-30 00:00
仅限 2026-09 至 2030-06 毕业的大学,快来投递吧~
投递简历

小红书 大模型算法实习

兼职 北京,上海
招聘城市:北京,上海
岗位职责:
1、探索新一代大语言模型基座架构,以高效推理模式为核心优化目标,探索全新模型结构和scaling law。
2、在工作中能快速成长,积极探索前沿技术,解决好业务中遇到的实际问题,完成数据处理、建模和工程上线,对AI技术始终保持热爱,实习期间可发表论文。
任职要求:
1、硕士/博士在读,计算机、数学等相关专业,国内985/全球TOP高校优先,实习期至少3个月;
2、大模型领域前沿技术有深度研究,在国际顶会/顶刊发表过高水平论文者优先;
3、在大模型领域有实践经验,包括数据过滤、数据去重、数据合成,或继续预训练、SFT、RLHF,或知识蒸馏、量化和模型剪枝,或参与过rag和agent商业产品研发;
4、有良好代码能力…
招聘城市:上海
…优化
5.编写实验脚本、构建评测工具,支持模型上线前的质量验证
工作要求:
我们希望你:
1. 深度学习基础扎实,熟悉当前主流LLM架构
2. 熟悉常见大模型训练框架(Megatron/DeepSpeed/Verl)
3. 有LLM相关项目经验:CPT、SFT、RL 任意方向即可
4. 有阅读论文与复现能力,能快速上手实验
5. 良好的自我学习能力和独立思考能力
加分项:
1. 有相关领域顶会论文,或拥有影响力工作
2. 有自己的LLM项目
3. 有机器翻译(MT)经验
4. 有 Agent RL相关的训练经验,或 harness engineering 经验
网申须知
网申开始日期:2026-06-15 00:00
网申截止日期:2027-06-30 00:00
仅限 2026-09 至 2030-06 毕业的大学,快来投递吧~
投递简历
招聘城市:北京
…语言模型(LLM)/多模态大模型(MLLM)等类型模型的推理服务框架;
2、通过并行计算优化、分布式架构优化、异构调度等多种框架技术,打造高效、易用、领先的AI推理框架;
2、深度参与周边深度学习系统多个子方向的工作,包括但不限于模型管理、推理部署、日志/监控、工作流编排等;
3、与全公司各业务算法部门深度合作,为重点项目进行算法与系统的联合优化,支撑业务目标达成。
任职要求:
任职资格:
1、优秀的代码能力、数据结构和基础算法功底,熟悉C++/Python开发,熟悉 Linux/Git 开发环境;
2、熟悉至少一种主流基础深度学习训练或推理框架(TensorFlow/PyTorch/PaddlePaddle/TensorRT等)的使用和实现;
3、熟悉主流LLM模型结构,熟悉至少一种主流LLM推理框架(vLLM/SGLang/TensorRT-LLM