招聘城市:北京,杭州
…与多模态内容理解具有浓厚研究兴趣的实习生,围绕 Agentic 内容理解体系中的核心算法问题开展前沿研究。岗位聚焦于真实复杂场景中的内容理解问题,探索基础模型、智能体架构与自进化机制在多模态任务中的能力边界与方法创新。
该岗位强调研究深度、问题导向与学术产出,适合希望在实习期间持续推进研究课题、沉淀论文成果,并将研究工作与实际高价值场景相结合的同学。
【研究方向和工作职责】
1. 研究 Agentic RL 长程任务强化学习方法,提升稳定性、一致性与任务完成能力。
2. 多模态检索与 Embedding 建模,提升多模态语义匹配和召回效果。
3. 探索 Agent 自进化机制,提升智能体自我评估、修正与持续优化能力。
4. 基于图文大模型…
招聘城市:北京
岗位职责:
1、提升模型搜索意图判断能力,将复杂需求拆为可执行的搜索子目标,生成 Query、选择检索源、控制搜索预算
2、设计可增长、可替换、可分层的 context 架构(如对话摘要层、搜索证据层、推理草稿层、最终引用层)
3、检索后处理与引用可信度提升,Snippet 选优、去重、冲突检测与引用自检
4、降低模型幻觉,提高 evidence–answer 一致性
任职要求:
对 LLM 检索、RAG、多轮对话、搜索策略或 context 机制有兴趣
招聘城市:北京,上海
…Agent 自动化评测平台(LLM-as-a-Judge),制定涵盖准确性、相关性、有用性及安全性的多维评估指标,通过离线评测与在线 A/B 实验持续驱动效果优化。
任职要求:
基础素质:计算机、人工智能等相关专业硕士及以上学历,具备扎实的机器学习/深度学习理论基础,精通 Python,熟练使用 PyTorch 等框架。
LLM 经验:深入理解 Transformer 架构,有大模型 Pre-training、SFT、RL 全流程实战经验。熟悉 LoRA、P-Tuning 等参数高效微调方法。
业务落地能力:具备极强的工程落地能力,对数据有敏锐的洞察力,善于从海量非结构化数据(User Query, Notes, Comments)中挖掘价值。
加分项:
在 NeurIPS, ICML, ICLR, ACL 等顶会发表过高质量论文。
在 LLM 大家关注的 Benchmark 榜单有深入研究或…
招聘城市:北京,上海,杭州
…和生成能力,为编程带来了新的变革。在大模型编程的实际应用里,涌现出诸多极具价值的落地场景,像代码问题的精准发现与高质量修复、代码的智能补全与生成等,这些场景切实提高了编程工作的效率与质量。
当前也普遍面临一系列亟待解决的问题与挑战:
1、怎样精准识别代码中潜藏的高质量问题,并迅速且有效地完成修复;
2、如何借助 RAG 技术等手段,精准召回相似的代码问题;
3、怎样构建更完善的评测体系,对整个编程系统以及各个应用场景进行全面且高质量的评估。
这些问题在行业内具有广泛的共性,极具研究价值。通过合作研究探寻解决方案,有望推动大模型编程领域迈向新的高度。
任职要求…
招聘城市:北京,杭州,上海
岗位职责:
传统的AI搜索依然基于RAG框架,少有的几个Agent框架也只涉及QueryPlanning,距离真实解决搜索中的实际问题还相距很远,例如做旅游攻略、做行业研究报告等等。我们判断,虽然当下LLM已经大范围的用于搜索领域,但是下一代的搜索技术变革一定是基于Agent的。本课题旨在研究基于Agent框架的基座模型。
任职要求:
1、不限年级,本科及以上在读,计算机/人工智能/软件工程等相关专业优先;
2、扎实的编程能力和算法功底,熟练掌握Python/C++/Java等至少一种编程语言;
3、扎实的机器学习/深度学习理论基础,有大规模推荐系统、计算广告、搜索引擎等核心算法项目经验;
4、在顶级学术会议或期刊发表论文,或ACM编程竞赛/机器学习等…
招聘城市:北京,上海
…职责:
随着大语言模型从通用问答走向复杂任务执行,Agent能力正成为模型演进的关键方向。传统大模型虽具备海量知识,但面对复杂任务的自主规划、工具调用及长期记忆管理时,往往难以应对。本课题旨在探索Midtrain这一关键阶段,推动通用基座模型向原生Agentic Foundation Model演进,为构建下一代自主智能体提供坚实的底座支持。
1. 大规模高质量数据体系与合成数据建设
数据体系构建:建设 Trillion 级别的大规模跨模态数据处理与合成链路。负责从训练数据获取到配比建模的全流程优化
合成方法演进:探索大规模合成数据 (Synthetic Data) 与自蒸馏 (Self-distillation) 技术,制定合成数据应用策略
理论探索:研究Data Scaling Laws,解决数据扩展中的模型坍塌(Model Collapse…
招聘城市:北京
…公司大模型Agent基础能力的建设规划和方案设计,包括RAG、MCP、Multi-Agent等。
2.深入了解不同业务的需求和场景,抽象转化为通用能力并推动建设落地。
3.关注AI行业前沿动态,完成高质量的产品调研分析,并从中发现潜在的产品迭代方向。
4.参与团队的项目管理和跨部门协作,推动项目顺利进行并达成目标。
任职要求:
1.大学本科及以上学历,计算机、AI相关专业优先。
2.对大模型产品有浓厚兴趣,关注行业动态,对Agent有自己理解。
3.良好的沟通和逻辑思维能力,具有团队合作精神。
4.可连续实习3个月以上,每周工作4-5天。
岗位亮点:
1.接触Agent前沿技术和丰富落地场景,获得实习经验和职业发展机会。
2.完整参与Agent…
招聘城市:北京
…2.标注方案制定及执行:根据标注需求和规则,完成Agentic模型训练和效果评估数据的标注方案设计和数据生产;
3.项目管理:协助mentor监控和管理数据生产项目进展,保障数据交付质量;
4.人员管理:协助mentor完成内/外部标注人员管理,包括但不限于人员信息管理、培训成长等。
任职要求:
1. 27届及以后毕业的本硕博在读同学,心理学、语言学、计算机相关等专业,有扎实的学科理论基础;
2. 英语读写流利,CET六级及以上;
3. 具有良好的逻辑思维和分析能力,能够准确理解数据任务的目的和要求,并能够高效地执行复杂的数据分析任务;
4. 对大模型行业,尤其是对模型应用感兴趣,具备良好的沟通能力和团队协作精神,能够与团队成员…
招聘城市:上海,杭州
…场景的创新应用。
任职要求:
任职资格
1、计算机科学、软件工程或相关专业在读本科生 / 研究生;
2、熟悉 Python 或 Java 至少一门语言,具备良好的编程习惯和工程实践能力;
3、了解常见机器学习算法(分类、聚类、异常检测等),具备基础的概率统计知识;
4、具备良好的学习能力和自驱力,乐于探索前沿技术,能够将思路转化为工程实现。
加分项
1、了解 AIOps 方向相关技术,如时序异常检测、根因定位、关联分析等算法,并有实际项目经验;
2、熟悉云原生可观测性技术体系,如 Prometheus、OpenTelemetry、ELK、SkyWalking 等;
3、对大模型应用、LLM/Agent 在运维场景的应用有所了解或有项目经验;
4、有开源社区贡献经历,或在技术博客、论文方面有公开…
招聘城市:北京,上海,杭州
…Research Agent System探索研究。随着GPT-Codex, Claude Code, Gemini等大模型api能力的大幅增强,基于这些api构建的agent system在通用agent领域(如openclaw),和vibe coding等方向带来了非常大的行业影响。在更严谨和更需要创新的AI技术研发和创新迭代上,如何更好的利用大模型来大幅提升研发效率甚至是做自动化的高质量研究是未来技术研发的关键趋势。我们关心如何让大模型掌握大模型研发流程中的所有context,数据、结果、实验过程(包括各种各样失败的实验)、相关论文等等,并充分利用这些信息完成设计、实现、实验、分析、迭代的完整闭环,从辅助researcher开始,到持续提升整个系统的能力边界,最终成为推进下一代模型研发的关键基础设施…
招聘城市:北京,杭州,上海
岗位职责:
传统的AI搜索依然基于RAG框架,少有的几个Agent框架也只涉及QueryPlanning,距离真实解决搜索中的实际问题还相距很远,例如做旅游攻略、做行业研究报告等等。我们判断,虽然当下LLM已经大范围的用于搜索领域,但是下一代的搜索技术变革一定是基于Agent的。本课题旨在研究基于Agent框架的基座模型。
任职要求:
1、不限年级,本科及以上在读,计算机/人工智能/软件工程等相关专业优先;
2、扎实的编程能力和算法功底,熟练掌握Python/C++/Java等至少一种编程语言;
3、扎实的机器学习/深度学习理论基础,有大规模推荐系统、计算广告、搜索引擎等核心算法项目经验;
4、在顶级学术会议或期刊发表论文,或ACM编程竞赛/机器学习等…
招聘城市:北京
…核心,研究方向包括上下文管理、生成式推荐、Agent Skills、Post-Training、LLM+Decision、LLM +Causal 等。主要业务场景为探索 AI 在骑手运营场景下的落地实践,实现“技术驱动业务范式”的升级转变。
【建议研究方向】
1. Agent 工作流与规划:设计具有复杂规划(Planning)与工具调用能力的 Agent,实现任务的自动化拆解与执行。
2. 生成式用户理解:基于 LLM 进行语义挖掘,构建动态用户画像(Persona),实现生成式的用户*运营策略的个性化推荐。
3. 上下文与记忆管理:攻克长窗口(Long Context)难题,设计高效的记忆(Memory)与 RAG 机制,保障长周期交互的逻辑连贯。
4. 行业大模型后训练:通过自动化样本生成、通用评估方案建设、reward设计与探索,大幅提升应用依赖的行业大模型质量…
招聘城市:北京,上海,杭州
…和生成能力,为编程带来了新的变革。在大模型编程的实际应用里,涌现出诸多极具价值的落地场景,像代码问题的精准发现与高质量修复、代码的智能补全与生成等,这些场景切实提高了编程工作的效率与质量。
当前也普遍面临一系列亟待解决的问题与挑战:
1、怎样精准识别代码中潜藏的高质量问题,并迅速且有效地完成修复;
2、如何借助 RAG 技术等手段,精准召回相似的代码问题;
3、怎样构建更完善的评测体系,对整个编程系统以及各个应用场景进行全面且高质量的评估。
这些问题在行业内具有广泛的共性,极具研究价值。通过合作研究探寻解决方案,有望推动大模型编程领域迈向新的高度。
任职要求…
招聘城市:上海,北京
…小红书社区 Agent 模型研发,围绕通用 Agent 框架、多轮任务规划、工具调用、记忆机制、多模态理解、环境感知、任务执行等方向开展LLM训练与落地,推动 LLM 在社区助手中的效果提升;
2、参与社区 Agent 产品能力建设,结合大模型、RAG、Function Calling、Browser / App Agent、Workflow 等技术,打造新一代端内 Agent 社区助手;
3、跟踪业内前沿 Agent 技术进展,结合业务场景完成方案设计、实验验证与迭代优化,推动技术能力在真实产品中的应用落地。
任职要求:
1、计算机、软件工程、人工智能、自动化、数学等相关专业,硕士及以上学历;
2、具备扎实的机器学习、NLP 或多模态技术基础,熟悉 LLM、RAG、Agent、Tool Use、Planning、Memory 等相关方向;
3、对 Agent 系统具有相关算法和项目经验,实践过类似…
招聘城市:北京,上海,杭州
…到“没见过也能用”的跃迁。
3)增强未知环境下的逻辑迁移与决策稳定性:重点解决 Agent 在面对新工具、新任务组合时的推理与决策问题,包括调用顺序规划、异常处理以及多工具协同,使模型在复杂业务流程中能够稳定完成任务闭环,而不是在中间步骤出现偏移或失败。
任职要求:
1、不限年级,本科及以上在读,计算机/人工智能/软件工程等相关专业优先;
2、扎实的编程能力和算法功底,熟练掌握Python/C++/Java等至少一种编程语言;
3、扎实的机器学习/深度学习理论基础,有大规模推荐系统、计算广告、搜索引擎等核心算法项目经验;
3、有LLM/MLLM等多模态理解技术背景,或大规模模型训练实际项目经验者优先;
5…
招聘城市:北京
…AI Agent领域的最新进展,引入并验证新技术的可行性,沉淀技术文档与最佳实践,推动前沿技术在rednote业务中的应用,保持团队的技术领先性;,沉淀国际顶会论文(CVPR/NeurIPS/ICLR/ACL 等)
任职要求:
1. 对大模型和Agent有较深入的理解,熟悉常见的LLM实施模式、提示工程、评估框架、检索框架等,了解Agent Architectures/Structures(Multi-Agent、Context Engineering/Management、ReAct/PlanAct/CodeAct),了解Agent相关的交互协议(MCP、A2A、FunctionCall);
2. 熟悉Agentic RL的方法,了解Agentic RL Infra(例如CodeRL,Reward System),熟悉模型的Post-Training训练技术,能针对特定模型能力问题进行SFT、RL训练优化;
3. 熟悉模型的Post-training训练技术,能针对特定模型能力问题进行SFT、RL训练优化;
4. 有较强研究能力,复现…
招聘城市:北京,上海,杭州
…能利用自然语言理解用户实时的微观意图、情感倾向与潜在需求。基于不同用户及不同上下文,能为不同用户量身定制差异化的广告投放,并且Agent能够以自然语言阐述其推理依据,让投放逻辑从“黑盒”走向透明,同时通过与用户反馈的持续交互,不断自我修正与进化。
这里面涉及到多方面的能力研究,包括基于内容的个性化能力的构建,个性化能力与大语言模型能力的结合,多模态融合能力,面向广告投放Agentic能力的微调能力以及面向广告投放系统的应用。
任职要求:
1、不限年级,本科及以上在读,计算机/人工智能/软件工程等相关专业优先;
2、精通Tensorflow,Pytorch等工具,了解深度学习技术,具有模型优化经验;
3、熟悉Linux开发环境…
招聘城市:北京
…利用线上真实交互日志,系统化挖掘 Agent 在复杂链路中的典型失效模式,如工具幻觉、目标偏离等。将发现的 Badcase 自动归因并转化为可复现的回归测试用例,建立基于回流问题的评测看板,以数据驱动方式量化模型版本迭代的真实收益。
4.探索下一代评测范式:研究人-智能体协同评估、自进化能力评估、Agentic Evaluation、Auto Research等前沿课题,推动评测范式和模型优化范式演进,产出高水平技术报告与顶会论文。
【为什么是我们】
1.美团拥有世界级的业务难题,从POC到大规模场景,充满机遇与挑战,兼顾学习和成长。
2.业界前列的NV GPU和非GPU算力规模,协同算法,AI框架,网络,计算,芯片等多个团队共同建设大模型软…
招聘城市:北京,上海
…
2.利用多模态扩展定律指导数据与训练方案,提升模型在多模态交互场景下的原生能力。
【为什么是我们】
1.团队扁平,人才密度高,近年团队在ICLR、NeurIPS、ICML、ACL等顶会累计发表论文数十篇,团队员工获EMNLP 2024 Outstanding Paper、ACL 2025 Outstanding Paper;
2.参与大语言模型核心技术研发,接触大规模RL、超长上下文、分布式训练和推理优化等前沿技术;
3.充足算力保障,拥有大规模分布式训练环境和丰富数据资源。
任职要求:
1.来自全球Top高校计算机科学、人工智能、数学、物理或相关领域应届博士/顶尖硕士毕业生;
2.在大模型领域有研究基础,或参与过有影响力的开源项目,在ICLR/NeurIPS/ICML/ACL等顶会发表论文具备扎实的…
招聘城市:上海,北京
岗位职责:
1、面向多类任务(任务型/复杂指令/多轮对话/工具使用/推理/偏好/安全),批量构造 prompt families
2、设计 Prompt diversity、difficulty 的维度设计和系统实现
3、结合模型输出结果,基于 score / RM / heuristics 做 prompt×response 联合筛选
4、全程参与做 data → model → eval → refine 的闭环和模型合版实验
5、参与 SFT-prompt 和 RL-prompt 的差异化设计(多阶段 / multi-turn RL-friendly prompt)
任职要求:
对 LLM 对齐、后训练、对话系统有兴趣,细致耐心,善于发现模型边界与异常案例