招聘城市:北京
…上下文工程及 Agent 评测方法论(benchmark 构建、轨迹级评估、自动化 judge、失败模式分析)有系统理解与实践
自动化研究系统经验:AI for Science / AI Scientist 类工作、自动化假设生成与实验设计、Agent 长期记忆与知识累积机制、自动化数据分析系统等方向的研究或工程实践
因果推断背景:系统学习或研究过 uplift modeling、CATE 估计、双重机器学习与双重稳健估计、IPW / 离线策略评估、实验设计与因果识别策略;在 LLM 与因果推断交叉方向(LLM 辅助因果发现、反事实推理、causal representation learning)有探索经历者优先
搜索、推荐、广告算法背景:多目标排序、竞价与机制设计、在线学习与探索利用权衡、大规模稀疏模型的学习、研究或工业实践
【为什么是我们】
1.研究环境稀缺:多数 Agent…
招聘城市:上海
…26届春招-大模型算法工程师 80万元/年
2026-03-16 10:52:51发布
职位要求:
职位性质:全职
工作城市:上海市长宁区
招聘人数:50
学历要求:硕士
职位类别:其他人员
语言能力:不限
需求专业:计算机科学与技术,软件工程,数学,物理学,信息与通信工程
职位描述:
岗位职责
在本岗位,您将有机会同时深入技术本质并驱动业务落地,具体将参与:
1.大模型基座研发与优化:参与构建及优化面向电商领域的多语言、多模态(图/视频/语音等)大模型基座,全流程深入数据处理、样本标注、模型预训练(Pretrain)、有监督微调(SFT)/强化学习(RL)等关键环节;
2.前沿技术探索与创新:持续跟踪并攻关大模型领域的前沿方向 (如:Long Context、Agent-RL…
招聘城市:上海
…招聘信息
大模型算法工程师【2027届云弧计划】
2026-06-22 11:58:28
职位描述
岗位职责
在本岗位,您将有机会同时深入技术本质并驱动业务落地,具体将参与: 1. 大模型基座研发与优化:参与构建及优化面向电商领域的多语言、多模态(图/视频/语音等)大模型基座,全流程深入数据处理、样本标注、模型预训练(Pretrain)、有监督微调(SFT)/强化学习(RL)等关键环节;
2. 前沿技术探索与创新:持续跟踪并攻关大模型领域的前沿方向(如:Long Context、Agent-RL、更高效的训练/推理框架等),通过算法创新持续提升模型的准确性、泛化性与性能;
3. 大模型应用落地与赋能:将先进的模型能力与电商业务场景结合,主导技术方案的…
招聘城市:上海
… 深入理解主流大模型(如:GPT、Deepseek等)、多模态模型(如:Gemini、Qwen-VL等)的技术原理;
? 熟悉大模型训练全流程(Pretrain/SFT/RL/Agent等)或生成式模型(Diffusion、Flux等)者优先;
3. 创新能力: 具备极强的学习能力、主动性和创新思维,能够独立分析和解决复杂技术问题,对将前沿研究应用于实际挑战充满热情;
4. 成果导向: 在学术或工业项目中有突出表现者优先,例如但不限于
? 在CCF-A类会议/期刊(如NeurlPS、ICML、CVPR、ACL等)发表过论文;
? 在ACM编程竞赛、Kaggle等知名算法竞赛中获奖;
? 主导或深度参与过有较大技术影响力的大模型相关项目。
AI Infra研发工程师 (2027届云弧计划)
【岗位职责】
在本岗位,您将有机会…
招聘城市:北京,上海
岗位职责:
【愿景】
构建以大模型算法为核心的金融 AI 智能体体系,打通“理解—推理—决策—执行—反馈”的全链路闭环。通过 LLM 理解用户意图与业务上下文,通过 SFT/RL 等算法提升金融场景专业能力,通过 Agent 进行任务规划、策略选择与工具调用,动态生成话术、方案和决策建议,持续基于评测与线上反馈自我优化,推动金融业务走向智能体时代。
【职责】
负责金融场景的大模型的研发和应用,研究相关技术在AI营销、AI风控、AI客服、AI催收领域的落地价值和解决方案,通过AI赋能业务,大幅提升业务在智能交互、智能决策场景下的效果。
研究方向一:基于大模型的多轮对话理解与生成
1.深入参与对话机器人在数据建设、指令…
…算法工程师 · 大模型后训练(Post-training)负责高质量数据合成、强化学习与偏好对齐、自适应链路优化与全链路训练、多 Harness 通用能力构建构建、全链路训练与阶段联动,进行日志挖掘与数据飞轮建设。7、算法工程师 · 合版算法研究聚焦合版算法,研究数据策略与冲突消解机制,探索On-policy Distillation、知识融合等先进技术,研究数据策略与冲突消解机制,推动合版评测体系建设等。8、算法工程师 · 模型自进化围绕大模型自进化方向开展算法研究,优化模型 RSI能力,为模型注入自动迭代SFT/RL数据、自动挖掘 CPT/PT 训练数据、自动进行 Infra 调优等能力。跟踪自进化训练、自动化数据构造、Agent 能力增强等相关领域前沿进展。9、算法工程师 · 强化学习…
招聘城市:北京,上海
…Token 压缩与时空注意力机制,优化多帧推理效率,挖掘视频与直播流的时序及交互语义;
6、多模态 Agent:研发具备视觉反馈与自我修正能力的智能体,构建 VLM 工具调用与任务规划、执行、验证闭环。
任职要求:
1、本科及以上学历,计算机、人工智能、数学等相关专业;
2、深入理解 Transformer 架构与大模型训练全流程(CPT / Mid-train / SFT / RL / OPD),熟悉主流 VLM 架构(如 LLaVA、Qwen-VL、InternVL 等);
3、在大规模预训练、CPT、Mid-training、SFT、RL、在线策略蒸馏(OPD / MOPD)、MLLM 推理优化、视觉对齐或视频理解等方向有深入研究或落地经验;
4、精通 PyTorch,熟悉 Megatron-LM、DeepSpeed 等分布式训练框架,具备百亿/千亿级参数模型的大规模训练经验,熟悉 veRL、OpenRLHF 者优先;
5…
招聘城市:北京,上海,杭州
…Agent 的SFT与RL方案,提升模型在开放环境中的任务拆解、工具调用及闭环执行能力;
2、大规模对齐与强化学习: 研发并优化 SFT、RL(如GRPO 等)、OPD等算法,构建高精度的 Reward Model,解决模型在复杂指令下的对齐问题;
3、推理模型(Reasoning)优化: 探索长链推理(CoT)、强化学习驱动的自反思与自进化机制,提升模型在的 System 2 思维能力;
4、数据管线与训练基建:实现和维护高质量的数据管线和训练基建,作为实现模型能力的自我循环与持续进化的基础。
VLM Post-training方向:
本岗位侧重于构建大模型的“视觉与感知”能力。小红书拥有业界最独特的图文与短视频 UGC 数据生态,你将负责 VLM 的 Post-training,让模型…
招聘城市:北京
…年以上算法研发及工程化经验,对传统NLP和大模型都有深入的了解,在至少一个方向上做出过行业一流的成绩,在多个相关方向上都有很好的技术视野;具备面向客户的经验;
能基于开源大模型做SFT,RL,结合RAG做应用产品,有B端经验,面向客户经验优先;
具备团队管理经验。
03
销售VP/合伙人
岗位职责:
参与以及协助制定公司战略规划,由战略制定、战略解码、战略下沉、承载业务经营目标并带领商业化团队达成目标;
负责营销流程和管理体系建设、优化;开展公司在B端产品业务的多行业业务拓展,建立标杆客户、行业最佳实践以及可持续的商业化增长;
负责搭建以及培养销售团队,打造高人效、擅长大客户…
招聘城市:北京,上海
岗位职责:
简介:Coding是当前 AI 技术落地最快、商业价值最大的方向之一。从代码补全到自主修复 GitHub Issue、到端到端软件工程自动化,大模型 Coding 能力的突破正在重塑整个软件开发范式。我们正在构建下一代具有强大代码生成与自主 Agent 能力的基座模型,打造可在真实工程环境中独立运作的 AI 开发者。
岗位职责
1、负责基座大模型在代码生成、代码理解、代码 debug 等方向的能力研究与提升,提升模型在Coding任务中的 Planning、长上下文理解等核心能力。
2、探索模型在 repo 级代码理解、跨文件修改、自主 debug 等复杂任务上的能力边界。
3、参与 Post-training(SFT / RL/ PRM)等 Alignment 方法在 Coding 场景的研究与落地。
任职要求:
1、熟悉NLP…
招聘城市:北京,上海
…于构建大模型的“感官”核心,定义小红书下一代多模态智能基座。小红书拥有业界最独特的图文与短视频 UGC 数据生态,是多模态模型落地最肥沃的土壤。你将负责 VLM 的 Post-training(SFT/RL) 与 架构演进,让模型不仅能“看见”,更能“洞察”与“推理”,深度赋能搜索、广告、推荐、电商、智能创作等全链路业务场景。
【工作职责】
1. 核心模型研发:参与大规模视觉语言模型(VLM/MLLM)的预训练、微调和强化学习,优化模型在多模态理解、推理等任务上的表现;
2. 数据闭环构建:探索高质量多模态数据的自动化清洗、标注与构造方案,从源头提升模型性能;
3. 前沿技术探索:研究 Scaling Law、长文本/长视频理解、多模态 Agent 等前沿方向…