牛大妈在校招职位搜索算法研究员 有 1000+ 条结果

招聘城市:北京
北京十维视界科技有限公司
发布时间:2025-10-17
福利:"五险一金","试用期满薪","带薪年假","午餐补助","定期体检","弹性工作","节日礼物","扁平管理","技能培训"
职位名称:算法研究
学历:硕士,博士
需求人数:3
需求专业:人工智能(卓越人才培养试验班),人工智能(卓越人才培养试验班),应用数学,数学,人工智能,信息与计算科学,电子信息,信息与计算科学(强基计划),物理学,凝聚态物理,材料与化工,物理学(拔尖学生培养计划),物理类,等离子体物理,理论物理,电子信息,(专业学位)电子信息,核物理,光学,无线电物理,医学物理,粒子物理与原子核物理,凝聚态物理,应用物理学,材料物理与化学,物理学,先进制造,原子与分子物理,应用物理学(强基计划),数学类,控制理论与…
招聘城市:上海
算法研究(化学方向) 40万元/年
2025-10-11 16:37:18发布
职位要求:
职位性质:全职
工作城市:上海市浦东新区
招聘人数:1
学历要求:博士
职位类别:科学研究人员
语言能力:英语
需求专业:化学,计算机科学与技术,生物学,生物医学工程,物理学
职位描述:
岗位职责
工作职责:
1、结合化学、材料科学与人工智能技术,开发面向分子设计、性质预测、谱图分析的算法模型,支持药物研发或新材料发现项目;
2、参与构建化学领域知识图谱、分子表征学习(如SMILES/分子图建模)、性质预测(可合成性/稳定性等)等核心算法
3、与化学研发团队协作,将算法模型落地到实际项目中,解决实验设计、数据解读等业务问题;
4、跟踪计算化学与AI交叉领域的前沿进展,推动…
招聘城市:上海
创新算法研究 80万元/年
2026-03-11 14:25:31发布
职位要求:
职位性质:不限
工作城市:上海市徐汇区
招聘人数:5
学历要求:本科
职位类别:工程技术人员
需求专业:电子信息类,化学类,计算机类,生物科学类,物理学类
职位描述:
岗位职责
作为AI for Science创新算法研究,您将与团队的其他研究者与工程师合作,利用包括人工智能、分子模拟在内的计算方法,研究新药研发、生物大分子计算、生物信息、材料设计、计算化学等广泛科学领域内的前沿问题,并为相应的学术与工业场景提供新的解决方案。深势科技持续关注创新算法的应用落地,您的研究成果不仅将产生高水平学术论文,还将通过深势科技药物设计平台…
招聘城市:北京
…具备业务洞察与问题定义能力:能将模糊的研究目标拆解为可验证的实验假设,定对指标、选好方向,而非只会执行。
3.具备AI驾驭能力:能引导LLM Agent完成复杂研究任务及工程实现,能够独立完成问题建模、论文阅读、算法复现、实验设计、结果分析和迭代优化。有识别AI输出质量问题的技术判断力与review能力。
4.熟悉LLM及Agent基本机制,包括Agent Loop、Tool Use、Multi-Agent、Reasoning等;熟练使用Python及PyTorch等主流框架。
5.自驱力强,能在开放性问题中主动推进,在不完美条件下快速验证假设,动手能力和执行能力强。
加分项:
1.有AutoML、Neural Architecture Search、AI驱动科研工具(如AI Scientist、AIDE、MLR-Bench类)的研究或工程经验…
招聘城市:北京
…建成全球持续领先、客户长期信赖的履约技术平台,打造市场首选、社会认可、服务10亿用户的配送品牌。
【你将参与】
方向一:Agent 技术体系研究与 Harness 建设
1.面向真实业务场景,设计并构建 Agent 技术体系,重点攻克任务规划与分解、工具调用与协同、自我反思与纠错、记忆与知识管理等核心能力。
2.负责 Harness Agent 的开发与评估框架的搭建与持续迭代,抽象可复用的模式与组件。
3.深入分析 Agent 的失败模式,建立系统化的错误诊断、归因与自动修复机制。
方向二:Agent for Work 能力研究与探索
1.面向工作场景,设计并实现具备自主研究、知识库管理、自主循环能力的 Agent 系统。
2.重点攻克自主信息检索与整合、基于记忆与知识管理的结构化…
招聘城市:北京
…下生成最优调价方案,最大化运力供给与用户体验。
4.供需平衡与智能调控:探索供需预测、运力调控的序贯决策优化,研究LLM增强的因果推断与反事实推演,实现从"数据相关性分析"到"因果性决策"的跨越。
任职要求:
【任职资格】
2027届本科及以上学历,计算机、人工智能等相关专业,且以下条件至少满足一项:
1.在顶级期刊或学术会议(NeurIPS/ICML/ICLR/KDD/AAAI/OR等)以第一作者身份发表论文(或导师一作,自己为二作)。
2.在顶级大赛(ACM-ICPC/Kaggle等)上获奖。
3.有大厂实验室实习经验,或有贡献突出的开源项目。
加分项:
1.有强化学习、运筹优化、因果推断、时空建模方向的研究背景;熟悉LLM与决策科学融合的前沿方向。

招聘城市:北京
…ICLR/ACL等顶会最新进展,具备将前沿论文快速工程化落地的能力
2.鼓励将内部研究成果整理为学术论文,向行业输出技术影响力
任职要求:
【任职资格】
必备条件:
1.2027届计算机、数学、统计等相关专业在读或应届,本科及以上,博士/硕士优先
2.扎实的机器学习与深度学习基础,熟悉Transformer架构及其变体,具备独立阅读和复现顶会论文的能力
3.熟练掌握Python及PyTorch/JAX等主流框架,具备清晰的代码工程意识
4.对大模型的训练流程(预训练/后训练)或Agent构建有系统性理解,具备独立完成端到端实验的能力
5.具备RLHF/DPO/GRPO或其他对齐算法的实际训练与调优,对相关数据构建有深度认知
加分项:
1…
招聘城市:北京
…入口。
【你将参与】
方向一:个性化自进化与主动探索算法机制
1.探索与利用权衡: 负责设计前沿的主动探索训练目标与触发机制,引入不确定性感知等机制,使 Agent 能够根据当前交互状态、上下文历史自主判断自适应进化方向。
2.高价值信息捕获: 在极低用户打扰的约束下,设计高效的主动追问与澄清策略,精准、主动地获取用户深层高价值偏好信息。
方向二:多轮交互奖励建模与 RL 策略优化
1.长期价值奖励建模: 负责构建面向长期交互与用户留存的奖励模型体系,将用户显式反馈(追问、点击)与隐式行为(停留、改写)转化为高置信度的显式/隐式奖励信号。
2.强化学习策略对齐: 运用先进的强化学习算法(如 PPO…
招聘城市:北京
岗位职责:
【愿景】
面向美团AI搜索中的复杂业务场景,研究一套泛化增强方法,旨在解决多场景、多约束、多工具条件下模型泛化不足、调用不稳和新业务接入成本高等问题,提升模型在复杂业务搜索任务中的跨场景迁移能力、多约束执行能力、多工具调用稳定性。
【你将参与】
1.业务场景泛化:提升多业务场景下的任务适配与迁移能力。围绕外卖、到店、零售、酒旅等典型业务场景,研究统一任务建模与多场景联合训练方法,增强模型在不同业务场景、不同用户表达和不同任务类型下的适配能力与迁移能力,提高跨场景条件下的端到端任务完成效果。
2.复杂约束泛化与推理:提升复杂筛选条件下的理解与满足…
招聘城市:北京,上海
…— 这里没有束之高阁的论文复现,你写下的每一行代码都可能改变数万人的工作方式
2、 前沿技术栈,全链路参与 — 从模型研究到系统设计到线上落地,你将完整经历 AI 技术从 idea 到 impact 的全过程
3、定义级别的工作 — 你参与的不是在现有框架上做优化,而是从零定义企业 AI Operating System 的核心架构
4、与顶尖人才共事 — 团队成员均在本领域有深度研究和实践,在 AI 前沿方向持续产出
这里没有停留在实验室里的 Demo,而是真实的用户、真实的数据和真实的业务挑战。你写下的每一行代码,都可能影响数万名工的工作方式。
我们相信,未来企业的核心竞争力不只是拥有 AI,而是拥有能够…
招聘城市:北京,上海
…为什么是我们】
1.充分参与基模全链路的工作的机会,包括万卡集群上的超大规模训练,前沿算法研究,模型评测与行为研究,以及真实业务落地;
2.极具挑战的目标和远期愿景,通过代码去持续探索并突破模型智能上限;
3.对标行业极具竞争力的薪酬与资源支持。
任职要求:
1.具备扎实的机器学习、深度学习、强化学习功底。计算机、人工智能等相关专业硕士/博士学位优先;
2.动手能力出色,熟练掌握 Python 等编程语言,ACM/ICPC、NOI/IOI、TopCoder、Kaggle 等竞赛获奖者优先;
3.在 NeurIPS、ICML、ICLR、ACL等国际顶级会议发表论文,或在高质量开源项目中有重要贡献者优先;
4.具备良好的问题分析与研究能力,能够深入解决大模型训练…
招聘城市:北京,上海
岗位职责:
你将加入 LongCat Agent 算法团队,与一线研究共同推进下一代智能体的范式探索。具体方向包括但不限于:
1.Agentic RL 基础算法研究:探索面向长程多步任务的强化学习训练范式,包括稀疏奖励下的信用分配、过程奖励建模、自我博弈与多智能体协同、可扩展的 reward modeling,以及训练稳定性与样本效率优化。目标是实现Agent 能力增长的主引擎;
2.Search Agent 能力构建:研发面向开放域复杂查询的搜索智能体,覆盖多轮检索规划、查询改写、证据聚合、多源信息冲突消解与可信溯源。重点突破"深度研究"类长程任务(Deep Research)的端到端 RL 训练,让模型在数十步检索-推理交织中保持目标产出高质量分析内容。
3.生活服务助理 Agent…

美团(meituan) 大模型算法研究(实习)

兼职 北京,上海
招聘城市:北京,上海
…Human in the Loop 多轮交互下 Agent 基础建模的新方案、以及与复杂环境的交互学习能力
- 探索模型在 Non-Rule Based Outcome 场景下利用复杂信息进行有效 Reasoning 推理的范式,包括 Proactive Agent 的建模方案
- 探索研究更多内在奖励的机制,从而激发模型主动学习和自我更新的能力
- 探索构建长期记忆机制,为下一代高效的推理模型、长序列推理及建模提供基础
任职要求:
- 博士在读优先,计算机、人工智能、自动化、数学、物理等相关专业
- 在强化学习、语言模型、机器学习等一个或多个领域有较深入的研究
- 好奇心驱动,具有出色的分析、解决问题的能力,有自主探索解决方案的能力者
- 具有良好的沟通协作能力,对追求纯粹的技术有强烈热情,工作积极…
招聘城市:北京
研究方向】
1. 知识迁移与新一代时空基础模型:利用 LLM 的预训练知识与元学习(Meta-learning)能力,设计适配时序与图数据的新一代时空表征架构。探索从“任务特定模型”向“时空通用基础模型”的转变,提升系统在复杂多变环境下的泛化精度,重点优化长尾小场景的建模精度
2. 多商家选择视角的用户需求因果建模:研究如何将LLM的全局规划能力与因果推断(Causal Inference)深度融合。在多商家选择竞争下,利用LLM 辅助识别用户对时间的真实需求,构建反事实推理模型,实现有限资源下的用户需求与履约供给的最优匹配决策。
3. 基于 LLM-Agent 的系统级序贯规划:将配送时间决策建模为动态流水线中的时延分配(Deadline Assignment)问题。研究
招聘城市:北京

【建议研究方向】
1.调度大规模实时OR+ML研究:针对调度系统内多样的调度决策行为进行分析,包括但不限于过滤、压单、指派、推荐、改派等,尝试基于深度学习、强化学习等方法对已有的调度决策行为进行端到端建模,提升调度效果。
2.时空大模型在骑手行为方向研究:基于SOTA的时空大模型研究,探索针对调度系统分城市、分业务、分时段的差异化特点,基于每天百亿量级骑手路径和行为数据,探索统一的模型预测、决策能力,提升调度决策系统在不同场景下的适配能力。
3. 基于长周期收益的多对一匹配问题研究:基于订单结构挖掘与优质骑手行为学习,实现多对一订单-骑手匹配问题的分布式实时(秒级)求解,同时…
招聘城市:北京
…的强化学习决策:将因果效应预估作为奖励函数或环境模型的核心组成部分,运用强化学习(RL)技术进行序列化决策优化。重点研究如何学习干预的最佳顺序、时机与剂量,提高实时决策结果。
4.LLM + Causal融合推理:充分利用LLM的序列推理与语义理解能力,实时识别用户行为序列背后的潜在意图与决策逻辑,进行高价值特征挖掘,辅助因果图构建、混淆变量识别、反事实叙事生成,增强uplift模型能力。
我们将提供美团外卖海量、高维的交易与用户行为数据、真实的A/B实验与线上决策平台、充足的计算资源以及面向重大业务难题的极高研究自由度。目标是能直接驱动核心业务决策系统的突破性成果,同时能在顶级学术会议(如ICML…
招聘城市:北京
…或修正错误标签。因果去偏与反事实数据生成,研究利用 LLM 生成反事实样本或辅助识别未观测混淆变量,设计新的因果去偏机制。探索将LLM在因果推理和特征理解上的“大模型”能力,通过模型蒸馏(Model Distillation)技术迁移至轻量级的 Uplift 模型或深度因果网络(如 Dragonnet)中,提升模型能力。
3. 大规模非凸运筹优化求解:基于因果模型输出的弹性预估,研究在预算约束下的复杂定价组合优化问题。重点攻克非凸优化(Non-convex Optimization)目标函数的求解难题,大规模分组背包等NP-Hard问题的近似算法或高效启发式求解策略,以及基于强化学习的序贯决策问题,确保定价策略在工业级时延要求下的实时产出与效果最优。…
招聘城市:北京,上海
…Research,也有直接的落地场景。
研究方向】
1. 探索模型通过 RL Scaling 等方式使用成套工具解决复杂问题的行动和规划能力,包括 Human in the Loop 多轮交互下 Agent 基础建模的新方案、以及与复杂环境的交互学习能力。
2. 探索模型在 Non-Rule Based Outcome 场景下利用复杂信息进行有效 Reasoning 推理的范式,包括 Proactive Agent 的建模方案 。
3. 探索研究更多内在奖励的机制,从而激发模型主动学习和自我更新的能力。
4. 探索构建长期记忆机制,为下一代高效的推理模型、长序列推理及建模提供基础。
任职要求:
1. 博士在读优先,计算机、人工智能、自动化、数学、物理等相关专业。
2.在强化学习、语言模型、机器学习等一个或多个领域有较深入的研究者。
3…
招聘城市:深圳,其它
数据、模型算法研究
发布时间:2026-03-17 结束时间:2026-09-01
申请职位
公司名称:诺亦腾机器人科技(深圳)有限公司
工作地点:广东省 - 深圳市
工作性质:全职
职能类别:计算机/互联网/通信类
招聘人数:3人
薪资待遇:50000及以上
工作内容描述
岗位职责:
1、基于Real2Sim、RL、Sim2Real等技术路线,探索 human-centric data 在机器人全身控制、灵巧操作、场景交互方面的算法与工程;
2、基于 VLA、World Model 基础模型架构,探索以 human-centric data 为核心的多模态模型、世界模型的算法与工程;
3、Video、Motion、3D mesh等数据模态的补齐、增强、生成算法与工程;
任职要求 :
1、研究?向:Learning-based Control in Robotics;VLM;VLA;3D 重建;World Model;Video/Motion/3D Generation;motion生成、提取、增强…
招聘城市:北京
【LongCat大模型人才校招】基础模型通用 agent 算法研究
更新时间:2026-06-03
工作地点:北京市
事业群:核心本地商业-基础研发平台
岗位职责
我们期望探索构建这样的 AI 系统:具备真实物理世界级别的全模态信息交互与处理能力、有高学习和成长属性、可以无人监管地高效执行并完成真实复杂长程任务;从而让 AI 真正成为人类的强大帮手,对工作、生活、科研等人类社会的各个方面都进一步带来更大、更深远的有益影响。
1.探索小时或者天级别复杂长程任务下的 RL Scaling 等可靠后训练范式,实现有效的探索引导和 credit assignment,并保障训练的 robustness、efficiency & effectiveness;
2.探索模型的自进化系统构建方案,在易于模型理解使用的前提…