招聘城市:北京
岗位职责:
岗位职责
1、AI产品策略创新:聚焦大模型Agent、Skill技能体系、Harness工程框架前沿方向,结合用户场景挖掘创新需求,输出可落地的产品策略与迭代方案,推进AI产品能力升级与场景落地。
2、模型体验迭代优化:深耕提示词工程、上下文工程优化,负责大模型多轮对话逻辑、输出质量实战调优;搭建模块量化评估标准,结合数据与用户反馈迭代,提升模型任务完成率与整体交互体验。
3、核心模块与交互设计:独立负责Agent智能体、技能编排、工具调用等核心功能产品设计,输出标准化PRD;结合HCI交互设计思维,把控界面逻辑的合理性与易用性,精准挖掘用户痛点,持续优化产品体验与场景适配性。
任职要求
任职要求:
硬性必备要求
1、具备扎实大…
招聘城市:北京
岗位职责:
1、AI产品策略创新:聚焦大模型Agent、Skill技能体系、Harness工程框架前沿方向,结合用户场景挖掘创新需求,输出可落地的产品策略与迭代方案,推进AI产品能力升级与场景落地。
2、模型体验迭代优化:深耕提示词工程、上下文工程优化,负责大模型多轮对话逻辑、输出质量实战调优;搭建模块量化评估标准,结合数据与用户反馈迭代,提升模型任务完成率与整体交互体验。
3、核心模块与交互设计:独立负责Agent智能体、技能编排、工具调用等核心功能产品设计,输出标准化PRD;结合HCI交互设计思维,把控界面逻辑的合理性与易用性,精准挖掘用户痛点,持续优化产品体验与场景适配性。
任职要求:
硬性必备要求
1、运动爱好者,坚持跑步、骑行等…
招聘城市:北京,上海,武汉
岗位职责:
1、对业务模型训练效果的数据负责,与算法进行专业对话,结合模型能力要求进行数据策略的制定,为模型效果提供最优解决方案,支持从模型冷启、样本设计、数据生产、效果优化、线上监控的全过程,推动策略迭代提升模型效果;
2、负责搜索、安全生态、内容理解、大模型、商业交易等业务板块的模型需求,基于业务场景模型的应用效果设计运营链路,从模型实际应用收益出发,推动模型的策略、规则、数据链路的优化;
3、基于行业常见智能化应用手段,例如agent、rag、pe等,进行智能化标注策略设计,提供专业的智能化数据方案,搭建人机协同、智能化标注等数据链路,拿到效率、成本的收益;
4、保持数据行业前沿的视角和前瞻性的专业…
招聘城市:北京,上海,武汉
岗位职责:
1、对业务模型训练效果的数据负责,与算法进行专业对话,结合模型能力要求进行数据策略的制定,为模型效果提供最优解决方案,支持从模型冷启、样本设计、数据生产、效果优化、线上监控的全过程,推动策略迭代提升模型效果;
2、负责搜索、安全生态、内容理解、大模型、商业交易等业务板块的模型需求,基于业务场景模型的应用效果设计运营链路,从模型实际应用收益出发,推动模型的策略、规则、数据链路的优化;
3、基于行业常见智能化应用手段,例如agent、rag、pe等,进行智能化标注策略设计,提供专业的智能化数据方案,搭建人机协同、智能化标注等数据链路,拿到效率、成本的收益;
4、保持数据行业前沿的视角和前瞻性的专业…
招聘城市:北京,杭州
岗位职责:
【职位描述】
我们正在招募对大模型、智能体(Agent)与多模态内容理解具有浓厚研究兴趣的实习生,围绕 Agentic 内容理解体系中的核心算法问题开展前沿研究。岗位聚焦于真实复杂场景中的内容理解问题,探索基础模型、智能体架构与自进化机制在多模态任务中的能力边界与方法创新。
该岗位强调研究深度、问题导向与学术产出,适合希望在实习期间持续推进研究课题、沉淀论文成果,并将研究工作与实际高价值场景相结合的同学。
【研究方向和工作职责】
1. 研究 Agentic RL 长程任务强化学习方法,提升稳定性、一致性与任务完成能力。
2. 多模态检索与 Embedding 建模,提升多模态语义匹配和召回效果。
3. 探索 Agent 自进化机制,提升智能…
招聘城市:北京
岗位职责:
1、提升模型搜索意图判断能力,将复杂需求拆为可执行的搜索子目标,生成 Query、选择检索源、控制搜索预算
2、设计可增长、可替换、可分层的 context 架构(如对话摘要层、搜索证据层、推理草稿层、最终引用层)
3、检索后处理与引用可信度提升,Snippet 选优、去重、冲突检测与引用自检
4、降低模型幻觉,提高 evidence–answer 一致性
任职要求:
对 LLM 检索、RAG、多轮对话、搜索策略或 context 机制有兴趣
招聘城市:北京,上海
岗位职责:
岗位职责:
1、基于大模型的策略算法创新研发,包括用户舆情的多模态解析等项目
2、数据智能提效体系建设,开发基于LLM的数据分析、数据挖掘自动化流水线
任职要求:
任职要求:
1、掌握Prompt设计方法论,具备多轮对话调试经验;熟练使用LangChain/LlamaIndex等框架进行RAG系统开发
2、 熟悉大模型基础原理,了解大模型微调技术
3、扎实的Python编程能力,熟练掌握tensorflow、pytorch等深度学习代码框架
4、2026年毕业的本/硕在读(计算机、软件工程、数学或相关专业优先)。自我驱动,结果导向,对新技术有好奇心和探索能力
招聘城市:北京
岗位职责:
该岗位将大模型后训练、强化学习与 Agent 技术应用于在线约束资源分配决策系统。调度规模化营销预算,覆盖数亿用户,具备小时级真实反馈闭环。系统求解的核心问题是带全局预算约束的序贯决策——在预算硬约束下确定补贴的对象、额度、形态与时机,使增量转化、长期用户价值与投入产出比等全局目标最优
【你将参与】
1. 决策智能体(Agent):将当前由人工策略规则承担的决策生成环节智能体化。构建面向营销决策的 Agent 系统,覆盖目标解析与任务分解、数据与模型工具链调用、候选策略生成、实验设计与结果归因、闭环迭代。主要技术挑战:长程规划与上下文管理、工具调用的鲁棒性与幂等性,以及高风险场景下的…
招聘城市:北京,上海
岗位职责:
大模型从通用问答走向复杂任务执行,Agent 能力正成为模型演进的关键方向。为此我们探索将通用基座模型向原生 Agentic Foundation Model 演进,为构建下一代自主智能体提供坚实的底座支持。团队在以下方向上进行探索,若你对以下一个或者多个课题感兴趣均欢迎投递:
1)大规模高质量数据体系与轨迹合成数据建设
1.建设 Trillion 级别的大规模跨模态数据处理与合成链路,负责从训练数据获取到配比建模的全流程优化。
2.探索大规模合成数据 与自蒸馏技术,制定合成数据应用策略,构建模型持续进化的数据飞轮。
2)长上下文 (Long Context) 与高效架构演进长窗口突破
1.持续 Scaling Up 模型的上下文窗口,优化超长上下文…
招聘城市:北京,上海
岗位职责:
工作职责:
1、参与千亿级大模型的分布式强化学习 RL 训练框架研发,提升百卡~千卡级训练吞吐与资源利用率
2、参与 100B以上多模态强化学习算法流程适配(如DAPO等),各领域任务的 RL 正确性验证
3、实验并调优不同并行策略(Tensor/ZeRO/FSDP/Pipeline Parallelism)在超大规模模型上的最佳配置组合
4、协助定位分析分布式训练中的关键性能瓶颈(如GPU利用率低、显存瓶颈、网络通信阻塞、I/O延迟等),设计并实施优化方案进行验证。
5、参与研发/优化训练引擎的关键特性,如大规模集群下的稳定断点续训、高性能异步Rollout机制、以及高性能算子(Kernel)的集成与优化。
任职要求:
任职资格:
1、优秀的代码…
招聘城市:北京,上海
岗位职责:
随着大语言模型从通用问答走向复杂任务执行,Agent能力正成为模型演进的关键方向。传统大模型虽具备海量知识,但面对复杂任务的自主规划、工具调用及长期记忆管理时,往往难以应对。本课题旨在探索Midtrain这一关键阶段,推动通用基座模型向原生Agentic Foundation Model演进,为构建下一代自主智能体提供坚实的底座支持。
1. 大规模高质量数据体系与合成数据建设
数据体系构建:建设 Trillion 级别的大规模跨模态数据处理与合成链路。负责从训练数据获取到配比建模的全流程优化
合成方法演进:探索大规模合成数据 (Synthetic Data) 与自蒸馏 (Self-distillation) 技术,制定合成数据应用策略
理论探索:研究Data Scaling Laws,解决数据扩展中的模型坍塌(Model…
招聘城市:北京
岗位职责:
【课题说明】
以大语言模型(LLM)的 Workflow 、 Agent、对话能力为核心,研究方向包括上下文管理、生成式推荐、Agent Skills、Post-Training、LLM+Decision、LLM +Causal 等。主要业务场景为探索 AI 在骑手运营场景下的落地实践,实现“技术驱动业务范式”的升级转变。
【建议研究方向】
1. Agent 工作流与规划:设计具有复杂规划(Planning)与工具调用能力的 Agent,实现任务的自动化拆解与执行。
2. 生成式用户理解:基于 LLM 进行语义挖掘,构建动态用户画像(Persona),实现生成式的用户*运营策略的个性化推荐。
3. 上下文与记忆管理:攻克长窗口(Long Context)难题,设计高效的记忆(Memory)与 RAG 机制,保障长周期交互的逻辑连贯。
4. 行业大模型后训练:通过自动化样本生成、通用评估…
招聘城市:北京
岗位职责:
【课题子主题】【搜推】面向全球多国的Agentic推荐
【课题说明】
随着业务发展,keeta推荐面临多国家不同文化和餐饮环境的挑战,包括:1. 冷启动问题突出,推荐系统对本地的商家缺少理解,新市场和新用户缺乏交互数据,系统难以推荐符合本地用户偏好、受欢迎的餐厅;2. 不同国家面临非常多的本地事件,例如中东斋月、巴西狂欢节、极端天气等,传统模型依赖历史行为数据难以及时对不同事件下的需求进行响应。 本课题拟引入 Agent 与多轮强化学习技术,构建具备策略生成、动态调控与反馈优化能力的搜推一体化推荐框架,提升系统在跨文化复杂场景下的响应速度和推荐效果。
【建议研究方向】
1. 面向冷启动的语义理解与推荐建模,构建统一…
招聘城市:北京
【LongCat大模型人才校招】基础模型 - 数据策略与数据科学
更新时间:2026-06-03
工作地点:北京市
事业群:核心本地商业-基础研发平台
岗位职责
随着模型架构逐渐收敛、算力成本持续上升,高质量数据策略正在成为提升基座模型 scaling efficiency 和能力上限的核心杠杆。本方向聚焦大规模预训练数据的理解、筛选、配比、合成与系统化迭代,致力于建立数据分布、训练动态与模型能力之间的可解释映射,并将其转化为可预测、可干预、可扩展的数据策略和数据系统,持续提升模型的 token efficiency、scaling efficiency 与智能上限。
工作内容包括但不限于:
1.研究数据来源、质量、多样性、难度、覆盖度与模型能力之间的关系,建立“数据分布—训练动态—模型效果”的分析…
招聘城市:上海,北京
岗位职责:
模型训练:参与大型语言模型的训练实验,学习如何通过思维链推理提升模型在复杂任务上的表现
算法探索:学习探索前沿强化学习算法,协助团队进行奖励模型的构建和优化
Reasoning技术探索:参与模型监督、自我提升等训练优化探索
训练框架优化:学习使用LLM训练框架,参与协助优化训练流程,提升团队开发效率
任职要求:
任职资格
具备较好的编程能力和算法开发能力,熟悉常用的机器学习、深度学习算法
熟悉Llama-Factory、veRL、MS-Swift等框架,有相关项目经验更佳
了解分布式训练框架如DeepSpeed、Megatron-LM等
有较强的学习意愿和团队协作精神,能保证每周至少3天实习时间,实习期至少3个月
加分项
对强化学习有基本了解或项目…
招聘城市:北京,上海
岗位职责:
工作职责:
1、参与千亿级大模型的分布式强化学习 RL 训练框架研发,提升百卡~千卡级训练吞吐与资源利用率
2、参与 100B以上多模态强化学习算法流程适配(如DAPO等),各领域任务的 RL 正确性验证
3、实验并调优不同并行策略(Tensor/ZeRO/FSDP/Pipeline Parallelism)在超大规模模型上的最佳配置组合
4、协助定位分析分布式训练中的关键性能瓶颈(如GPU利用率低、显存瓶颈、网络通信阻塞、I/O延迟等),设计并实施优化方案进行验证。
5、参与研发/优化训练引擎的关键特性,如大规模集群下的稳定断点续训、高性能异步Rollout机制、以及高性能算子(Kernel)的集成与优化。
任职要求:
任职资格:
1、优秀的代码…
招聘城市:北京,上海
岗位职责:
1、负责生成式大模型安全防护产品策略的规划、设计和迭代,包括Safety Alignment、发prompt injection、反model jailbreak、风险生成内容过滤和实时检测机制。
2、负责设计多模态 AIGC 安全检测体系(文本/图像/视频),覆盖违规内容识别、伪造判定、真实度评估、深度伪造检测、模型生成技术追踪等方向。
3、持续跟踪和分析当前生成式AI技术的发展趋势,收集相关信息,并推动防御手段的更新和升级,以确保系统的安全性。
4、协同算法与研发团队,推动AIGC检测技术落地,优化防护效果和性能指标。
5、监控大模型安全态势,分析潜在风险,制定预防性和应急响应策略。
6、跨部门协调(如GA、安全运营、法务、数据),确保策略与业务目标对齐,并推动规模化应用。
7、跟踪行业…
招聘城市:北京,上海
岗位职责:
简介:多模态大模型能力在近年飞速发展,模态的统一、任务的统一、多种模态联合生成和实时交互带来了崭新的应用体验和生产力提升。在这个过程中,我们需要脚踏实地的同时仰望星空,发挥想象力预判新模型能力带来的应用场景革新,研究达到理想态的关键演进路径并进行度量分析,指引长期有潜力的模型迭代方向。方向包括但不限于:
1、多模Agent方向:包括在多模态的工具调用和GUI/CUA,探索结合多模原生能力的OpenClaw展现出的生产力提升潜力,从基座模型能力角度分析其中的关键影响因素并进行自动化度量,指引基座模型的迭代。
2、多模态统一方向:包括全模态统一模型、音视频联合生成等,思考…
招聘城市:上海
上海靖戈私募基金管理合伙企业(有限合伙)
其他企业金融业50人以下上海市浦东新区
招聘信息
机器学习研究岗
面议上海市浦东新区全职硕士及以上2人2026-06-30
收藏
2026-01-2916:24:24
职位描述
岗位职责:
1.聚焦预测模型核心算法研发,主导树模型/深度神经网络架构设计与调优
2.开发面向金融时序预测的定制化模型结构(如Attention-LSTM、TCN混合架构等)
3.持续跟踪时间序列分析、图神经网络、强化学习等领域前沿进展,结合业务场景进行算法创新和优化
4.创新模型训练范式,探索元学习、迁移学习在量化场景的应用
任职要求:
1.985高校计算机/应用数学/统计硕士以上学历
2.深度掌握:
-经典模型:XGBoost/LightGBM/CatBoost优化原理
-深度模型…
招聘城市:北京,上海
岗位职责:
负责建设小红书社区原生的 Agent 平台。利用 LLM、RAG、Multi-Agent 等前沿技术,深度理解用户复杂的非结构化 Query(如旅游攻略、装修避坑、穿搭建议),调度全站笔记、商品与工具资源,为用户提供能够直接解决问题的“智能方案”。
Agent 核心架构建设:负责通用 Agent 框架的设计与研发,包括意图识别(Router)、任务编排(Planning)、工具调用(Function Calling)及多轮对话状态管理(Memory),构建支持高并发、低延迟的在线智能分发系统。
大模型调优与对齐:基于开源或自研基座模型,利用 SFT、RL 等技术进行垂直领域微调。增强模型的小红书风格化表达(社区感)、复杂指令遵循能力及工具调用准确率等。
垂类智能体落地:深入旅游、美妆、装修、法律等…